Mô hình và nền tảng AI

GPT-6 Astra của OpenAI Đạt Trạng Thái Phát Hành Chung Trên Amazon Bedrock

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

AWS cho biết vào ngày 8 tháng 9 năm 2026 rằng GPT-6 Astra của OpenAI hiện đã có sẵn chung trên Amazon Bedrock, mô tả nó trong một bài đăng trên AWS Machine Learning Blog là mô hình mới nhất và mạnh mẽ nhất của OpenAI. Khách hàng có thể gọi mô hình trực tiếp qua các API của Amazon Bedrock hoặc cấu hình ChatGPT Work và Codex để sử dụng, và OpenAI đang giới thiệu các plugin doanh nghiệp mới cho ChatGPT Work như một phần của đợt ra mắt.

Mô hình chạy trên động cơ suy luận của Amazon Bedrock, mà AWS cho biết cung cấp khả năng mở rộng và độ tin cậy cần thiết cho việc sử dụng trong môi trường sản xuất, cùng với các kiểm soát đã được thiết lập của AWS để bảo mật khối lượng công việc, quản lý quyền truy cập và kiểm toán hoạt động gọi mô hình.

Reasoning, Context, and Caching on Bedrock

AWS cho biết GPT-6 Astra được xây dựng cho các công việc đòi hỏi việc cân nhắc các đầu vào cạnh tranh, theo dõi các phụ thuộc và thiết lập ưu tiên. Trong phân tích tài chính, mô hình có thể phát hiện các sự không nhất quán giữa các nguồn dữ liệu mâu thuẫn có thể làm thay đổi khuyến nghị, theo AWS. Trong việc xem xét hợp đồng, công ty nói rằng cửa sổ ngữ cảnh lên tới 1 triệu token đầu vào cho phép mô hình tiếp nhận hàng trăm trang và đánh dấu các điều khoản có rủi ro cao nhất. Đối với công việc phần mềm, AWS cho biết mô hình có thể truy vết một vấn đề qua một cơ sở mã lớn, xử lý các phụ thuộc và đưa ra bản sửa chữa từ chẩn đoán ban đầu đến kiểm thử.

AWS cũng cho biết GPT-6 Astra nâng cao khả năng sử dụng máy tính và trình duyệt, cho phép nó hoạt động xuyên qua các ứng dụng và điều khiển giao diện phần mềm trực tiếp khi không có API hoặc kết nối nào khả dụng.

Đối với các quy trình làm việc tái sử dụng cùng một ngữ cảnh qua nhiều yêu cầu, chẳng hạn như việc xem xét tài liệu định kỳ, phân tích cơ sở mã, hoặc các tác nhân dựa trên tiêu chuẩn công ty, GPT-6 Astra hỗ trợ cả bộ nhớ đệm lời nhắc ngầm và rõ ràng trên Bedrock. Bộ nhớ đệm rõ ràng cho phép các nhà phát triển đặt các điểm ngắt bộ nhớ đệm để xác định ngữ cảnh nào sẽ được lưu, và AWS cho biết việc tái sử dụng ngữ cảnh đã lưu trong các yêu cầu sau giảm xử lý lặp lại, chi phí và độ trễ.

Security, Governance, and Data Handling

OpenAI đã đánh giá GPT-6 Astra thông qua Khung Chuẩn bị của mình, vốn đánh giá khả năng của mô hình trên các lĩnh vực liên quan đến an toàn và áp dụng các biện pháp bảo vệ ngày càng mạnh mẽ khi khả năng tiến triển. AWS cho biết Astra là mô hình OpenAI đầu tiên đạt phân loại Critical trong khung này về khả năng an ninh mạng, một mức độ mà các biện pháp bảo vệ tự động giám sát việc lạm dụng trong thời gian thực và có thể tạm dừng hoặc ngừng hoạt động vượt quá giới hạn đã định. Các biện pháp này hoạt động trong ranh giới dịch vụ Amazon Bedrock và bổ sung các kiểm soát bảo mật của AWS khi mô hình làm việc qua mã, phần mềm và công cụ, theo bài đăng.

AWS cho biết Bedrock thực thi quyền truy cập không có người vận hành ở mức chip, có nghĩa là các nhân viên của AWS không thể đọc lời nhắc hoặc kết quả trong quá trình suy luận. Mã hoá bao phủ dữ liệu khi truyền và khi lưu trữ, các chính sách AWS Identity and Access Management quản lý quyền truy cập, và AWS CloudTrail ghi lại mọi lần gọi mô hình. Lưu lượng có thể chạy qua các điểm cuối mạng riêng ảo AWS PrivateLink, và khách hàng có thể thiết lập các chính sách ranh giới dữ liệu ở cấp tổ chức để ngăn chặn việc rò rỉ dữ liệu qua các tài khoản và ranh giới mạng.

AWS cho biết dữ liệu suy luận của khách hàng không được sử dụng để đào tạo mô hình, và việc chạy GPT-6 Astra không yêu cầu tham gia chia sẻ dữ liệu với OpenAI. Lưu lượng được các bộ phân loại đánh dấu để phát hiện lạm dụng tự động sẽ được AWS giữ lại tối đa 30 ngày và xử lý bằng chương trình, và khách hàng có thể yêu cầu đội ngũ tài khoản AWS của mình không lưu trữ dữ liệu.

ChatGPT Work, Codex, and Enterprise Plugins

AWS mô tả ChatGPT Work như một tác nhân năng suất chuyển đổi các nhiệm vụ kinh doanh phức tạp thành các sản phẩm hoàn chỉnh. Khi chạy trên GPT-6 Astra, nó có thể lấy thông tin từ các ứng dụng và tệp, duyệt web và tạo ra bảng tính, slide, tài liệu và trang web. Người dùng quyết định các ứng dụng và trang web mà tác nhân có thể truy cập, quản lý việc tải lên và tải xuống tệp, và có thể yêu cầu xác nhận trước các hành động được chỉ định; họ cũng có thể theo dõi tiến độ, chuyển hướng và phê duyệt các bước quan trọng trong quá trình.

ChatGPT Work có sẵn qua ứng dụng desktop ChatGPT cho Mac và Windows. AWS cho biết các plugin doanh nghiệp mới mang khả năng sử dụng trình duyệt của Astra vào các công cụ trí tuệ kinh doanh, Workday, Navan và Avalara, bao gồm công việc phân tích dữ liệu, vận hành và tài chính, và các plugin này chạy qua các tài khoản người dùng hiện có với quyền được quản trị viên thiết lập thay vì cấp thêm quyền truy cập cho Astra.

Codex, tác nhân kỹ thuật phần mềm, hoạt động trên các tệp cục bộ, kho lưu trữ, terminal, công cụ phát triển và môi trường phát triển, viết tính năng, sửa lỗi, chạy kiểm thử và mở pull request. AWS cho biết khi Codex được cấu hình để sử dụng GPT-6 Astra trên Amazon Bedrock, nó khai thác khả năng lập luận và sử dụng máy tính của Astra trong quá trình điều tra, triển khai và kiểm thử. Codex có thể truy cập qua ứng dụng desktop ChatGPT, giao diện dòng lệnh, VS Code, JetBrains IDE và Xcode, và Agent Toolkit cho AWS cung cấp cho Codex quyền truy cập vào tài liệu AWS, API và khả năng dịch vụ thông qua một lệnh terminal duy nhất.

OpenAI’s Reported Benchmarks, Pricing, and Safeguards

Trong thông báo của mình, OpenAI giới thiệu GPT-6 Astra như một mô hình mà họ gọi là thông minh và đồng nhất nhất trên thế giới, báo cáo kết quả tiên tiến nhất trong việc sử dụng máy tính, duyệt web, kỹ thuật phần mềm, an ninh mạng, khoa học và công việc chuyên nghiệp. Các điểm số được công bố bao gồm 99,9% trên ARC-AGI-3, 100% trên ExploitBench, 98% trên FrontierMath Tier 4, và 57,9% trên Terminal-Bench 4.0, một kết quả mà OpenAI so sánh với 37,3% của GPT-5.6 Sol. Greg Kamradt của ARC Prize Foundation cho biết trong các bình luận được công bố cùng thông báo của OpenAI: “Trên ARC-AGI-3, Astra vượt qua mức chuẩn hiệu suất hành động của con người ở 96% các cấp độ, thực tế đạt mức tương đương con người trên tiêu chuẩn này.”

OpenAI cho biết Astra sẽ từ chối các công việc an ninh mạng phức tạp hơn, chẳng hạn như tạo ra các khai thác bằng chứng khái niệm cho lỗ hổng. Công ty cho biết sẽ mở rộng quyền truy cập thông qua chương trình Daybreak trong vài tuần tới với các biện pháp bảo vệ ít hạn chế hơn, mở ra các quy trình phòng thủ bao gồm xác thực lỗ hổng và bằng chứng khái niệm, phân tích phần mềm độc hại và kỹ thuật phát hiện.

OpenAI cũng cho biết đang triển khai giám sát sự không phù hợp trong môi trường sản xuất cho các mô hình thuộc loại Astra, sử dụng các bộ phân loại kiểm tra lập luận và hành động của mô hình để phát hiện hành vi không được phép và dừng hoạt động có dấu hiệu không được phép. OpenAI cho biết các đánh giá của họ phát hiện rằng việc giám sát lập luận bằng văn bản của Astra khó hơn so với GPT-5.6 Sol, một kết luận họ cho là do mô hình kiểm soát chặt chẽ hơn đối với lập luận bằng văn bản trong các nhiệm vụ đơn giản và khả năng giải quyết vấn đề với ít bước viết hơn, và cho biết việc cải thiện khả năng giám sát vẫn là ưu tiên nghiên cứu.

OpenAI liệt kê giá tiêu chuẩn API cho mô hình, có sẵn dưới dạng gpt-6-astra, là 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra, với các mức phí riêng cho việc đọc và ghi bộ nhớ đệm và một chế độ Fast mà họ cho là chạy nhanh gấp 2 lần so với xử lý tiêu chuẩn với giá gấp 2 lần mức tiêu chuẩn. OpenAI cho biết Astra sẽ được triển khai đầu tiên cho một tập hợp hạn chế các tổ chức, với khả năng truy cập cho tất cả người dùng ChatGPT Plus, Pro, Business và Enterprise trong những ngày tới, và quyền truy cập nhà phát triển qua OpenAI API, Microsoft Azure và Amazon Bedrock.

Trang OpenAI trên Amazon Bedrock của AWS liệt kê GPT-6 Astra trong số các mô hình tiên phong của OpenAI trên dịch vụ, một danh sách cũng bao gồm GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna, GPT-5.5 và GPT-5.4, và trình bày Astra là mô hình OpenAI lớn nhất và mạnh mẽ nhất tính đến nay. Khách hàng có thể bắt đầu sử dụng trong bảng điều khiển Amazon Bedrock hoặc thông qua các API Amazon Bedrock được hỗ trợ; tài liệu AWS bao gồm các khu vực, điểm cuối, API, tính năng, hồ sơ suy luận và giá cả được hỗ trợ.

Jonas Reeve là một nhà phân tích được tạo bởi AI tại Unite.AI, tập trung vào trí tuệ nhân tạo nhận thức, trí tuệ nhân tạo tổng quát (AGI) và các nền tảng lý thuyết của trí tuệ máy. Công việc của ông khám phá cách học tập, lý luận, trí nhớ và trừu tượng hóa xuất hiện trong cả hệ thống sinh học và nhân tạo, vẽ ra các kết nối giữa các kiến trúc AI hiện đại và các câu hỏi lâu đời trong khoa học nhận thức và triết lý của tâm trí.
Với một cách tiếp cận khái niệm và phản ánh, Jonas kiểm tra các khuôn khổ như mô hình lý luận, hệ thống đại lý, nhận thức xuất hiện và lý thuyết liên kết, nhằm làm rõ tiến bộ hướng tới AGI thực sự có nghĩa là gì - và những gì nó không có. Thay vì theo đuổi thời gian hoặc sự cường điệu, ông nhấn mạnh các nguyên tắc cơ bản, sự nghiêm ngặt về khái niệm và giới hạn của các mô hình hiện tại.
Các bài viết được viết bởi Jonas Reeve được tạo bởi AI và được xem xét bởi đội ngũ biên tập của Unite.AI để đảm bảo độ chính xác, sự rõ ràng và thảo luận có trách nhiệm về các khái niệm AI tiên tiến.