Mô hình và nền tảng AI

Microsoft Mang GPT-6 Astra của OpenAI tới Foundry Với Quyền Truy Cập Hạn Chế

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Microsoft đã bắt đầu triển khai GPT-6 Astra, mô hình tiên tiến mới nhất của OpenAI, thông qua Chương Trình Truy Cập Hạn Chế Microsoft Foundry, với khả năng mở rộng cho các khách hàng tham gia trong những ngày tới và mức giá dựa trên tiêu thụ bắt đầu từ $10 cho mỗi triệu token đầu vào trong triển khai Standard Global, theo thông báo trên Blog Microsoft Azure.

Thông báo, do Steve Sweetman và Naomi Moneypenny soạn, mô tả Astra là một mô hình được thiết kế để tiếp nhận một thách thức mở, suy luận qua nhiều bước, tạo ra một kế hoạch và đưa ra kết quả cuối cùng. Bài viết đặt mô hình vào ba chức năng công việc: lập kế hoạch có chủ đích và hỗ trợ quyết định, trong đó mô hình chia thách thức thành các bước, đánh giá các lựa chọn, truyền đạt khuyến nghị và xác định các hành động tiếp theo để xem xét; đầu ra được tinh chỉnh, trong đó nó áp dụng ngữ cảnh, mẫu và tiêu chuẩn chất lượng xuyên suốt quy trình để tạo ra tài liệu, bảng tính, bản trình bày và phân tích sẵn sàng cho việc xem xét; và thực thi trên các ứng dụng, sử dụng công cụ và máy tính để hoàn thành các nhiệm vụ đa bước với sự giám sát của con người.

Sử Dụng Máy Tính và Kiểm Soát Doanh Nghiệp

Astra có khả năng sử dụng máy tính được thiết kế để hoạt động trên các ứng dụng quen thuộc, bao gồm các quy trình làm việc không có API riêng. Theo bài đăng trên Azure, mô hình có thể diễn giải thông tin trên màn hình và tương tác với các giao diện được phê duyệt để hỗ trợ các nhiệm vụ như cập nhật hồ sơ, điều hướng công cụ phát triển, kiểm thử phần mềm và tổng hợp kết quả thành báo cáo. Bài viết lưu ý rằng OpenAI báo cáo kết quả tiên tiến trên một số đánh giá sử dụng máy tính, đồng thời cảnh báo hiệu suất có thể thay đổi tùy theo nhiệm vụ, công cụ, cấu hình và các biện pháp bảo vệ.

Microsoft kết hợp các khả năng này với các biện pháp kiểm soát bao bọc. Vì nội dung hiển thị trong một ứng dụng có thể không đầy đủ, gây hiểu lầm hoặc được thiết kế để ảnh hưởng đến hành vi của tác nhân, bài viết cho biết Foundry giúp khách hàng xác định quyền truy cập, phê duyệt và giám sát, cũng như thiết kế quy trình làm việc với các chứng thực có phạm vi, tài nguyên được phê duyệt, các điểm kiểm tra của con người cho các hành động quan trọng, và hồ sơ hoạt động phù hợp với yêu cầu rủi ro của họ.

Bài đăng trên Azure liệt kê các kịch bản doanh nghiệp mà Microsoft cho biết đang gặp, bao gồm công việc kỹ thuật phần mềm trong đó Astra tái tạo các lỗi phức tạp, điều tra nguyên nhân khả dĩ, đề xuất giải pháp và chuẩn bị các thay đổi cho việc kiểm thử và xem xét của nhà phát triển; công việc phân tích kinh doanh trong đó nó xây dựng và tinh chỉnh các bảng điều khiển trên Power BI; sản xuất tài liệu chuyên nghiệp theo các mẫu và tiêu chuẩn doanh nghiệp hiện có; và các quy trình ứng dụng như cập nhật hồ sơ khách hàng, xử lý biểu mẫu và kiểm thử website khi API chuyên dụng bị hạn chế.

Về quản trị, bài viết cho biết Foundry bổ trợ cho công việc ở mức mô hình của OpenAI bằng Microsoft Entra quản lý danh tính và truy cập, mã hóa khi truyền và lưu trữ, tùy chọn mạng riêng, kiểm soát truy cập dựa trên vai trò, lọc nội dung, đánh giá an toàn, giám sát và công cụ quản trị. Các lời nhắc và đầu ra không được sử dụng để đào tạo mô hình. Bài viết bổ sung rằng những khả năng này giúp khách hàng cấu hình các biện pháp bảo vệ và duy trì giám sát nhưng không loại bỏ rủi ro hoặc thay thế trách nhiệm của mỗi tổ chức trong việc lựa chọn và cấu hình các kiểm soát phù hợp với kịch bản và nghĩa vụ pháp lý của mình.

Những Điều OpenAI Báo Cáo Khi Ra Mắt

Thông báo ra mắt GPT-6 Astra của OpenAI cho biết mô hình đang được triển khai cho một nhóm tổ chức hạn chế và sẽ trở nên khả dụng trong những ngày tới cho tất cả người dùng ChatGPT Plus, Pro, Business và Enterprise, cũng như thông qua OpenAI API, Microsoft Azure và AWS Bedrock.

Trong các số liệu mà OpenAI báo cáo: Astra đạt 57,9% trên Terminal-Bench 4.0, một bài đánh giá lập trình, so với 37,3% của GPT-5.6 Sol; 72,6% trên bộ đánh giá sử dụng máy tính offline OSWorld 2.0, so với 65,7% của GPT-5.6 Sol; và 96,0% trên GPQA Diamond, một chuẩn đoán khoa học cấp độ sau đại học. OpenAI cũng báo cáo rằng trong các mô phỏng độ trễ trên OSWorld 2.0, Astra đạt hiệu suất sử dụng máy tính cao hơn với thời gian thực hiện nhiệm vụ giảm khoảng 47% so với GPT-5.6 Sol, và khi kết hợp với bộ công cụ Codex được cập nhật, điều này tương đương với tốc độ hoàn thành nhiệm vụ nhanh hơn 1,9 lần trên chuẩn đoán Mind2Web. Đây là kết quả đánh giá do OpenAI tự báo cáo.

Về an toàn, OpenAI cho biết trong bản cập nhật ngày 1 tháng 9 năm 2026 rằng họ đánh giá Astra đáp ứng ngưỡng khả năng an ninh mạng Critical theo Khung Sẵn Sàng — là mô hình đầu tiên của công ty được chỉ định ở mức này — có nghĩa là với các công cụ và quyền truy cập phù hợp, nó có thể phát hiện các lỗ hổng bảo mật chưa được biết và phát triển cách khai thác chúng trên các hệ thống được bảo vệ tốt mà không cần hướng dẫn chi tiết từng bước của con người. OpenAI cho biết họ đã hoãn một số phần của quá trình phát triển và phát hành Astra trong vài tuần để tăng cường các biện pháp bảo vệ, và phiên bản hiện đang ra mắt từ chối các nhiệm vụ an ninh mạng nâng cao hơn như tạo ra các bằng chứng khai thác, với việc mở rộng quyền truy cập phòng thủ dự kiến thông qua chương trình Daybreak trong những tuần tới. Bài đăng trên Azure cũng lưu ý rằng OpenAI mô tả Astra là mô hình phù hợp nhất của họ cho đến nay và dự định công bố các đánh giá về sự phù hợp, an toàn và sử dụng máy tính trong tài liệu ra mắt.

Triển Khai và Giá Cả

GPT-6 Astra sẽ có sẵn thông qua các triển khai Standard, bao gồm các tùy chọn Global và U.S. Data Zone, và khách hàng có thể lựa chọn triển khai dựa trên yêu cầu tải công việc. Microsoft mô tả mô hình dựa trên tiêu thụ như một cách để các đội ngũ bắt đầu xây dựng mà không cần cam kết dung lượng dự trữ, và cho biết Astra được thiết kế để tối ưu token trong công việc phức tạp, đồng thời lưu ý rằng mức sử dụng và chi phí thực tế sẽ thay đổi tùy theo tải công việc và cấu hình.

Bảng giá công bố liệt kê triển khai Standard Global ngữ cảnh ngắn với mức 10,00 USD cho mỗi triệu token đầu vào, 1,00 USD cho mỗi triệu token đầu vào được lưu trong bộ nhớ đệm, 12,50 USD cho mỗi triệu lần ghi bộ nhớ đệm, và 50,00 USD cho mỗi triệu token đầu ra. Triển khai Standard Global ngữ cảnh dài được niêm yết với 20,00 USD đầu vào, 2,00 USD đầu vào bộ nhớ đệm, 25,00 USD ghi bộ nhớ đệm, và 75,00 USD đầu ra. Giá cho Standard Data Zone (Mỹ) là 11,00 USD đầu vào, 1,10 USD đầu vào bộ nhớ đệm, 13,75 USD ghi bộ nhớ đệm, và 55,00 USD đầu ra cho ngữ cảnh ngắn, và 22,00 USD đầu vào, 2,20 USD đầu vào bộ nhớ đệm, 27,50 USD ghi bộ nhớ đệm, và 82,50 USD đầu ra cho ngữ cảnh dài.

Khách hàng có thể đánh giá mô hình thông qua catalog Foundry Models và xây dựng các quy trình làm việc đa ứng dụng với Dịch vụ Đại lý Foundry, theo bài đăng trên Azure. Bài viết cũng bao gồm các phát biểu từ các đối tác ra mắt: CTO của Replit Luis Hector Chavez cho biết GPT-6 Astra qua Microsoft Foundry bổ sung khả năng đại lý vượt ra ngoài việc tạo mã, và Phó Chủ tịch Dữ liệu và AI của Albertsons Companies Anirban Nandi cho biết Azure OpenAI trên Microsoft Foundry giúp nhà bán lẻ cân bằng tốc độ áp dụng với bảo mật, quản trị và các kiểm soát vận hành.

Aiden Cross là một chiến lược gia được tạo bởi AI tại Unite.AI, chuyên về chiến lược sản phẩm AI, thực hiện và các thách thức thực tế khi chuyển đổi các mô hình thử nghiệm thành các sản phẩm sẵn sàng cho thị trường. Công việc của ông tập trung vào cách các công ty khởi nghiệp và các đội doanh nghiệp chuyển từ các nguyên mẫu và demo sang các hệ thống đáng tin cậy được sử dụng bởi khách hàng thực sự.
Với quan điểm thực tế và chi tiết, Aiden phân tích các bản đồ sản phẩm, chiến lược tiếp thị, quyết định nền tảng và các lựa chọn tổ chức mà quyết định liệu các sáng kiến AI có thành công hay không. Ông đặc biệt chú ý đến các thực tế triển khai, việc áp dụng của người dùng, các hạn chế về cơ sở hạ tầng và sự phù hợp giữa khả năng kỹ thuật và giá trị kinh doanh.
Các bài viết được viết bởi Aiden Cross được tạo bởi AI và được đội ngũ biên tập của Unite.AI xem xét để đảm bảo sự rõ ràng, chính xác và phạm vi bao quát có trách nhiệm về cách các sản phẩm AI được xây dựng, vận chuyển và mở rộng trong thế giới thực.