Mô hình chi phí bảng tin nhắn agent của OpenAI
Cập nhật September 27, 2026 · đăng lần đầu September 27, 2026
Vào tháng 9 năm 2026, các nhà nghiên cứu phát hiện một bảng tin nhắn agent của OpenAI, một lớp giao tiếp mà các agent tự hành có thể đăng tin nhắn, đọc phản hồi và phối hợp các quy trình nhiều bước mà không cần con người can thiệp. Với đội FinOps, điều này đưa vào một vector chi phí mới: lượng token tiêu thụ giữa các agent, tăng theo độ dài cuộc trao đổi chứ không theo độ phức tạp của tác vụ.
Bảng tin nhắn cho phép điều gì
Bảng tin nhắn hoạt động như một bus ngữ cảnh dùng chung. Một agent điều phối đăng bản phân rã tác vụ; các agent chuyên môn nhận các tác vụ con, đăng kết quả và thương lượng việc bàn giao. Mỗi tin nhắn là một chu kỳ prompt-completion đầy đủ, được tính phí theo đơn giá tiêu chuẩn của mô hình.
Mô hình chi phí
| Thành phần | Đơn giá (GPT-6 Astra) | Đơn giá (GPT-6 Sol) |
|---|---|---|
| Agent đăng (đầu vào) | $10.00 / 1M | $2.00 / 1M |
| Agent đọc (đầu vào đã cache) | $1.00 / 1M | $0.20 / 1M |
| Agent trả lời (đầu ra) | $50.00 / 1M | $10.00 / 1M |
Một cuộc phối hợp 10 lượt giữa ba agent theo giá Astra: khoảng 300K token = $15. Cùng cuộc trao đổi đó trên Sol: $3. Khác biệt nằm ở việc tác vụ có cần khả năng suy luận của Astra hay token rẻ hơn của Sol là đủ.
Các kịch bản chạy vượt tầm kiểm soát
- Vòng lặp thương lượng: Hai agent bất đồng về một việc bàn giao và lặp lại hơn 50 lần trước khi đi đến thống nhất.
- Bão phát sóng: Một agent đăng cho mọi người đăng ký; mỗi người trả lời, kích hoạt thêm nhiều bài đăng.
- Cuộc trò chuyện mồ côi: Các agent chờ một phản hồi không bao giờ đến, truy vấn bảng tin mỗi 30 giây.
Các biện pháp kiểm soát FinOps
- Ngân sách tin nhắn cho mỗi quy trình: Giới hạn cứng tổng token trên bảng tin cho mỗi mã tác vụ.
- Giới hạn độ sâu: Tối đa 3 bước nhảy giữa các agent trước khi chuyển cho con người xử lý.
- Định tuyến mô hình: Đưa việc phối hợp sang Sol; chỉ dành Astra cho bước tổng hợp cuối cùng.
- Hết thời gian chờ khi không hoạt động: Tự đóng các luồng sau 5 phút không có hoạt động.
Kết luận
Bảng tin nhắn làm cho các hệ thống nhiều agent có thể ghép nối, nhưng khả năng ghép nối mà không có rào chắn chi phí là một lỗ rò ngân sách. Hãy coi token giữa các agent là một trung tâm chi phí riêng, với cảnh báo và ngân sách riêng.
Liên quan
- Mô hình chi phí GPT-6 Astra
- Mô hình chi phí GPT-6 Sol
- Giới hạn fan-out và đồng thời của subagent
- Ngân sách cho ba agent
Bạn muốn áp dụng điều này cho hệ thống của mình? Hãy mang theo hóa đơn nhà cung cấp, nhật ký gateway và các quy trình chính; chúng tôi sẽ xác định yếu tố chi phí và hướng tiết kiệm. Đặt lịch kiểm toán miễn phí →