Mô hình và nền tảng AI
OpenAI cho biết các tác nhân hiện bao phủ 3,1 ngày làm việc cho mỗi ngày làm việc của nhà nghiên cứu

Tổ chức nghiên cứu của OpenAI hiện đang thực hiện 3,1 ngày làm việc của các tác nhân cho mỗi ngày làm việc của con người, công ty cho biết trong một bài tiểu luận ngày 8 tháng 9 năm 2026 mà trong đó trình bày cách họ dự định chuyển đổi khả năng của các mô hình tiên tiến thành doanh thu. Con số này, được đo so với một ngày làm việc tiêu chuẩn tám giờ vào giữa tháng 8 năm 2026, là nền tảng cho lập luận rộng hơn của giám đốc tài chính Sarah Friar rằng các mô hình có khả năng hơn, cơ sở người dùng hơn một tỷ người hoạt động hàng tuần, và chiến lược tính toán toàn diện sẽ hỗ trợ lẫn nhau.
Bài tiểu luận, có tiêu đề “The Work Now Within Reach”, là bài mới nhất của Friar trong loạt bài về kinh doanh và kinh tế tính toán của OpenAI. OpenAI đã bổ nhiệm Friar làm CFO vào tháng 6 năm 2024; trước đó cô từng là CEO của Nextdoor và là CFO của Square.
Sử dụng và Doanh thu
OpenAI cho biết các sản phẩm của mình tiếp cận hơn một tỷ người dùng hoạt động hàng tuần và 2,5 triệu doanh nghiệp, và mỗi tiến bộ nghiên cứu đều cải thiện ChatGPT, ChatGPT Work, Codex, và các ứng dụng được xây dựng trên API của công ty. Công ty cho biết việc truy cập miễn phí có hỗ trợ quảng cáo giúp mọi người khám phá nơi AI hữu ích, trong khi các gói thuê bao và dịch vụ dựa trên mức sử dụng cho phép khách hàng chi tiêu nhiều hơn khi họ nhận được giá trị cao hơn.
Dựa trên nghiên cứu các gói ChatGPT cá nhân, OpenAI cho biết khối lượng tin nhắn hàng ngày tăng khoảng 50% sau sáu tháng đăng ký so với tháng đầu tiên, và người dùng đã thử khoảng gấp đôi số lượng nhiệm vụ khác nhau. Phân tích cơ bản dựa trên mẫu 0,1% các tài khoản được tạo từ ngày 15 tháng 10 năm 2025 đến ngày 1 tháng 5 năm 2026, với hoạt động được theo dõi đến ngày 31 tháng 5 năm 2026; nó đo lường tin nhắn và độ đa dạng nhiệm vụ so với 28 ngày đầu của mỗi người dùng và phân loại tin nhắn thành 53 danh mục khả năng.
Bài tiểu luận cũng đề cập đến năm trường hợp triển khai của khách hàng. Bệnh viện Trẻ em Boston báo cáo hơn 40 chẩn đoán trong các trường hợp bệnh hiếm chưa giải quyết được trước đây nhờ nghiên cứu hỗ trợ AI. Cars24 cho biết các tác nhân của họ xử lý hơn một triệu phút hội thoại mỗi tháng trong quá trình mua và bán xe. Circles báo cáo 65% giải quyết tự động các tương tác dịch vụ khách hàng trên các quy trình hỗ trợ, và Balyasny Asset Management cho biết Công cụ Phân tích Bài phát biểu Ngân hàng Trung ương của họ đã rút ngắn thời gian phân tích kịch bản kinh tế vĩ mô từ hai ngày xuống khoảng 30 phút. Replit cung cấp Chế độ Miễn phí cho phép người dùng lên kế hoạch phần mềm mà không tiêu tốn hạn mức sử dụng của mình. Mỗi con số đều đến từ tài khoản của khách hàng được OpenAI trình bày.
Các tác nhân trong tổ chức nghiên cứu
Con số 3,1 ngày làm việc của các tác nhân xuất phát từ bản cập nhật nghiên cứu của OpenAI được công bố ngày 6 tháng 9 năm 2026, trong đó báo cáo rằng trước tháng 6 năm 2026 tổng thời gian chạy của các tác nhân trên toàn bộ tổ chức nghiên cứu vẫn dưới mức tổng thời gian làm việc của con người. Bản cập nhật đó cho biết nhà nghiên cứu trung vị đang tiêu tốn hơn 600 USD mỗi ngày cho suy luận theo giá API vào giữa tháng 8, và người dùng ở phần trăm 90 thì tiêu tốn hơn 7.000 USD token mỗi ngày.
Bản cập nhật tương tự cho biết tỷ lệ thành công của tác nhân lập trình đã tăng từ tháng 1 đến tháng 7 năm 2026 trên nhiều nhóm độ khó nhiệm vụ, đồng thời lưu ý rằng các nhiệm vụ kéo dài vẫn cần sự chỉ đạo của con người: trong sáu tháng qua, hơn một nửa các nhiệm vụ thành công ước tính mất từ bốn đến tám giờ thời gian con người đã có ít nhất một lần can thiệp. Trong bài tiểu luận, OpenAI cho biết con người vẫn đặt ưu tiên nghiên cứu và đánh giá kết quả, và các đội đang sử dụng các tác nhân để giải quyết các vấn đề hạ tầng mà trước đây cần hỗ trợ chuyên môn.
Khả năng mô hình và chi phí tính toán
Bài tiểu luận của Friar định vị GPT-6 Astra là động lực khả năng hiện tại, mô tả nó là hiện đại nhất trong việc sử dụng máy tính, duyệt web, kỹ thuật phần mềm, an ninh mạng, khoa học và công việc chuyên môn. Trong thông báo phát hành, OpenAI cho biết Astra đạt điểm 98% trong FrontierMath Tier 4, 99,9% trong ARC-AGI-3, và 100% trong ExploitBench, đồng thời đáp ứng ngưỡng Quan trọng trong an ninh mạng theo Khung Chuẩn bị của công ty. Đó là các kết quả do OpenAI tự báo cáo. Công ty cho biết Astra bắt đầu triển khai cho một tập hợp hạn chế các tổ chức vào ngày 3 tháng 9 năm 2026, và sẽ có sẵn rộng rãi trên các gói trả phí của ChatGPT, API, Microsoft Azure và AWS Bedrock trong những ngày kế tiếp.
Về kinh tế phục vụ, bài tiểu luận nhắc lại hai con số từ bài đăng kỹ thuật của OpenAI ngày 29 tháng 7 năm 2026 về GPT-5.6: cải tiến phần mềm phục vụ sản xuất đã giảm chi phí phục vụ đầu cuối xuống 20%, và công việc giải mã suy đoán đã tăng hiệu suất sinh token hơn 15%. Cả hai cải tiến đều đạt được với GPT-5.6 Sol hoạt động trong Codex, bao gồm việc tự động viết lại các nhân sản xuất, theo như bài đăng kỹ thuật.
Bài tiểu luận cũng tóm tắt kết quả đầu tiên của Jalapeño, con chip suy luận tùy chỉnh của OpenAI, lần đầu được công bố ngày 25 tháng 8 năm 2026. Trong các thử nghiệm InferenceX trên GPT-OSS 120B, DeepSeek R1 và Kimi K2.5, OpenAI cho biết chip này cung cấp từ 1,5 đến 1,9 lần lưu lượng token đỉnh mỗi watt so với các hệ thống thương mại đã thử, sử dụng công suất chip được định mức để chuẩn hoá so sánh, và độ trễ đầu cuối thấp hơn từ 1,7 đến 3,6 lần. OpenAI cho biết dự định sẽ bắt đầu triển khai Jalapeño trong hạ tầng tính toán của mình vào cuối năm, cùng với các bộ tăng tốc từ NVIDIA, AMD và các đối tác khác, và rằng các phiên bản thế hệ thứ hai và thứ ba đang được phát triển.
Friar viết rằng OpenAI đánh giá mỗi khoản đầu tư dựa trên nhu cầu mà nó có thể phục vụ, tốc độ trở nên có năng suất, và liệu lợi nhuận có biện minh cho vốn đã bỏ ra hay không, và doanh thu từ việc chấp nhận ngày càng tăng sẽ tài trợ cho nghiên cứu và hạ tầng tiếp theo.












