Mô hình và nền tảng AI

OpenAI ra mắt GPT-6.1 Sol tại DevDay với các công cụ Codex và ChatGPT mới

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

OpenAI giới thiệu GPT-6.1 Sol, một bản nâng cấp của mô hình GPT-6 Sol, tại sự kiện DevDay 2026 vào ngày 29 tháng 9, 2026, phát hành mô hình này trong API với giá 2 USD mỗi triệu token đầu vào và 10 USD mỗi triệu token đầu ra. Bản phát hành là một phần của hơn 20 thông báo chi tiết trong tổng kết DevDay 2026 của công ty, bao gồm các công cụ dành cho nhà phát triển Codex, API, tính năng hợp tác của ChatGPT, plugin và các gói đăng ký.

Theo thông báo GPT-6.1 Sol, mô hình gần như sánh bằng trí tuệ của GPT-6 Astra trong lập trình có tính đại lý, sử dụng máy tính và công việc chuyên nghiệp, với chi phí token đầu vào và đầu ra tiêu chuẩn của Astra chỉ bằng một phần năm. OpenAI cho biết chi phí đầu vào được lưu trong bộ nhớ đệm là 0,10 USD mỗi triệu token, mức giá này được mô tả là thấp hơn 95% so với giá đầu vào tiêu chuẩn và thấp hơn 50% so với giá đầu vào được lưu trong bộ nhớ đệm của GPT-6 Sol.

GPT-6.1 Sol có sẵn bắt đầu từ ngày 29 tháng 9, 2026 cho tất cả người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex, và các nhà phát triển có thể truy cập nó qua API của OpenAI dưới tên gpt-6.1-sol. Hiện tại nó chưa có trên Chat. OpenAI cho biết một tùy chọn GPT-6.1 Sol Ultrafast, với tốc độ tạo token nhanh gấp tới tám lần so với tốc độ tiêu chuẩn của mô hình trong Codex, sẽ ra mắt trong vài ngày tới. Công ty nói rằng các thông báo này mở ra ChatGPT như một bề mặt chung, nơi con người và các đại lý có thể hợp tác và nơi các nhà phát triển có thể triển khai các trải nghiệm gốc cho khoảng 1,2 tỷ người dùng hàng tuần.

Kết quả Hiệu năng và An toàn của GPT-6.1 Sol

Trong DeepSWE v1.1, một bộ chuẩn cho các nhiệm vụ kỹ thuật phần mềm phức tạp trên các cơ sở mã thực tế, OpenAI báo cáo rằng GPT-6.1 Sol sánh bằng GPT-6 Astra với chi phí khoảng một phần năm trong khi vượt qua điểm cao nhất của GPT-6 Sol thêm 6,4 điểm phần trăm với nỗ lực và chi phí suy luận thấp hơn. Trong GDP.pdf, đo lường độ chính xác của mô hình khi trả lời các câu hỏi chuyên nghiệp bằng tài liệu PDF phức tạp, công ty cho biết mô hình đạt điểm cao hơn Opus 5.5 với các dự phòng với chi phí mỗi nhiệm vụ dưới một nửa, và tiếp cận hiệu năng của Astra với chi phí mỗi nhiệm vụ khoảng một phần năm.

Trong AutomationBench, kiểm tra xem các đại lý có hoàn thành đúng các quy trình kinh doanh đa bước hay không, OpenAI báo cáo GPT-6.1 Sol đạt điểm cao hơn Opus 5.5 thêm 2,2 điểm phần trăm với mức nỗ lực suy luận trung bình và chi phí khoảng một phần ba, và cao hơn GPT-6 Sol thêm 4,8 điểm phần trăm trong cùng điều kiện. Trong bộ quy trình sử dụng máy tính ngoại tuyến của OSWorld 2.0, công ty cho biết mô hình vượt trội hơn GPT-6 Sol tới bảy điểm phần trăm với mức nỗ lực suy luận tối đa và chỉ cách điểm của Astra 2,1 điểm phần trăm với chi phí mỗi nhiệm vụ khoảng một phần bảy.

Trong Terminal-Bench Science 0.1, bao gồm các quy trình khoa học như phân tích dữ liệu, mô phỏng và chứng minh định lý, OpenAI báo cáo GPT-6.1 Sol tăng hơn gấp đôi điểm số của GPT-6 Sol ở mức nỗ lực suy luận tối đa, đồng thời trung bình chi phí $5,47 mỗi nhiệm vụ, so với $23,21 cho Opus 5.5 và $23,80 cho Astra. Công ty lưu ý rằng GPT-6 Astra vẫn đạt điểm cao nhất trong số các mô hình được thử nghiệm, với 68,1%. OpenAI cho biết các đánh giá mô hình của mình được thực hiện trong môi trường nghiên cứu nội bộ hoặc qua API, và các đánh giá mô hình của đối thủ được lấy từ các báo cáo công khai.

Về độ chính xác, OpenAI báo cáo tỷ lệ phản hồi chứa lỗi thực tế đã giảm từ 11,4% với GPT-6 Sol xuống 7,7% với GPT-6.1 Sol ở mức nỗ lực suy luận thấp, giảm khoảng 32%, và tỷ lệ lỗi của mô hình mới vẫn nằm trong vòng 1,9 điểm phần trăm so với Astra trên các thiết lập đã thử. Công ty lưu ý rằng đánh giá này sử dụng các cuộc trò chuyện đã được ẩn danh, trong đó người dùng đã đánh dấu lỗi của mô hình trước, và những lời nhắc cố ý khó khăn này không phản ánh việc sử dụng thông thường.

OpenAI cũng báo cáo kết quả đánh giá sự đồng nhất cải thiện so với GPT-6 Sol, với tỷ lệ thất bại thấp hơn về tính minh bạch khi công cụ bị hỏng, tuân thủ các hạn chế rõ ràng và tránh các kết quả không được phép trong các nhiệm vụ đại lý. Trong một đánh giá về việc các đại lý có tiết lộ công cụ tìm kiếm bị hỏng hay chỉ đưa ra phỏng đoán, công ty cho biết GPT-6.1 Sol không tiết lộ vấn đề trong 2,1% trường hợp, so với 4,9% đối với GPT-6 Sol và 1,5% đối với Astra, và cho biết không phát hiện nỗ lực vượt qua bộ kiểm duyệt an toàn tự động. Chi tiết đầy đủ xuất hiện trong phụ lục thẻ hệ thống GPT-6.1 Sol.

Công cụ Nhà phát triển Mới trong Codex và API

Codex hiện có thể chạy trên máy tính, từ xa trên điện thoại, hoặc trong đám mây trên bất kỳ thiết bị nào, với môi trường phát triển có thể tái sử dụng, cung cấp cho các nhóm một thiết lập chung với các cài đặt và quyền được phê duyệt; truy cập đám mây có sẵn trên các gói Plus, Pro, Business, Healthcare, Education và Enterprise. Giao diện dòng lệnh Codex được cập nhật thêm điều khiển bằng giọng nói và chế độ /agents để ủy quyền và theo dõi nhiều nhiệm vụ, và trải nghiệm Đánh giá Mã mới trong ứng dụng desktop ChatGPT có thể thực hiện lần kiểm tra tự động đầu tiên trên các thay đổi trong đám mây, với phản hồi được chia sẻ trên các pull request của GitHub hoặc merge request của GitLab. Cả hai đều có sẵn trên mọi gói.

Codex Security Cloud quét các kho lưu trữ GitHub theo yêu cầu hoặc theo lịch trình, điều tra các phát hiện, loại bỏ trùng lặp và chuẩn bị các bản sửa lỗi trong đám mây, đồng thời cung cấp quyền truy cập vào các mô hình được cung cấp qua Daybreak Blue mà không cần ứng dụng Daybreak riêng. Dịch vụ này có sẵn cho người dùng Pro, Business, Enterprise và Edu trên desktop và web.

The Decisions API áp dụng trí tuệ của Luna vào các câu hỏi do người dùng định nghĩa với các câu trả lời có sẵn và giới hạn, cho phép các nhà phát triển phân loại nội dung, định tuyến yêu cầu, hoặc chọn hành động tiếp theo của một tác nhân; nó đã vào giai đoạn xem trước hạn chế vào ngày 29 tháng 9 năm 2026 với kế hoạch ra mắt rộng rãi trong những ngày tới. Agents API hiện hỗ trợ việc sử dụng máy tính và mang lại các khả năng đa tác nhân của Codex, tìm kiếm công cụ, gọi công cụ và nén ngữ cảnh vào các ứng dụng; nó có sẵn qua API và trong Codex và ChatGPT Work trên các gói Pro 500 và Enterprise. OpenAI cũng đã hợp tác với Amazon trên Bedrock Managed Agents, giúp điều chỉnh các khả năng cốt lõi của Agents API để chạy nguyên bản trên AWS và tích hợp với các tài nguyên AWS.

Ultrafast, một cấp tốc độ cao cấp, cung cấp tốc độ tạo token nhanh tới tám lần, đạt 300 token mỗi giây, trong Codex và nhanh tới sáu lần trong API, theo OpenAI. GPT-6 Astra Ultrafast hiện đã có sẵn trong API và trong ChatGPT Work và Codex trên các gói Pro 500 và Enterprise, trong khi GPT-6.1 Sol Ultrafast sẽ sớm ra mắt.

Cộng tác, plugin và các gói ChatGPT

ChatGPT Space là một không gian chung nơi các đồng đội, ChatGPT và dấu chấm của người dùng có thể xây dựng trên kiến thức chung, có sẵn trên các gói Pro, Business và Enterprise trên máy tính để bàn và web, trong khi trên di động chỉ hỗ trợ tìm kiếm, đọc và chia sẻ trang cho đến khi tính năng tạo và chỉnh sửa trên di động được triển khai. Pages, một loại tài liệu mới được xây dựng cho sự hợp tác giữa con người và tác nhân, có sẵn trên cùng các gói, và các slide hợp tác với hỗ trợ đồng thời nhiều người chỉnh sửa và xuất ra PowerPoint hoặc Google Slides sẽ được ra mắt trong vài tuần tới.

Người dùng Business và Enterprise hiện có thể tạo các đội trong ChatGPT và giao nhiệm vụ định kỳ cho đội, chạy theo lịch hoặc phản hồi các sự kiện như email mới hoặc tin nhắn Slack, và họ có thể đề cập @ChatGPT trong các kênh, luồng hoặc tin nhắn trực tiếp của Slack và Microsoft Teams mà không cần mỗi đồng đội có giấy phép riêng. Plugin Meetings, đang ở giai đoạn beta trong ứng dụng desktop ChatGPT trên macOS cho người dùng Pro và Business với quyền truy cập Enterprise sẽ sớm có, ghi chú và lưu trữ các bản tóm tắt cá nhân hoá kèm mục hành động trong ChatGPT Space, xóa âm thanh sau khi ghi chú sẵn sàng. Các hồ sơ có thể chia sẻ để giới thiệu các Sites và plugin tái sử dụng hiện có trên các gói Free, Go, Plus, Pro, Business và Enterprise, với việc chia sẻ kỹ năng bị giới hạn trong không gian làm việc.

Đối với các nhà phát triển, các phần mở rộng plugin thêm các trang chủ thanh bên, bảng điều khiển tương tác và trình xem tệp bên trong ChatGPT, và OpenAI đã bổ sung công cụ Plugin Creator, quy trình gửi lại được thiết kế lại, cải thiện xếp hạng và khám phá plugin, lưu trữ plugin trong Sites trên các gói Business, Enterprise, Healthcare và Edu, và hỗ trợ đặc tả MCP Events đề xuất để các plugin có thể bắt đầu tự động hoá khi có sự kiện xảy ra trong ứng dụng kết nối.

Đăng nhập bằng ChatGPT cho phép người dùng Plus và Pro áp dụng hạn mức gói của họ trên 16 đối tác, bao gồm Devin của Cognition, Notion, Vercel, T3, OpenClaw và Dactyl, với kiểm soát mức sử dụng cho từng công cụ, trong khi đăng nhập danh tính khả dụng trên toàn cầu. Gói Pro 500 mới cung cấp mức sử dụng cao nhất mà OpenAI mô tả, gấp 25 lần mức cho ChatGPT Plus, bao gồm quyền truy cập Ultrafast và hiện đã có sẵn. OpenAI Marketplace cho phép các khách hàng doanh nghiệp đủ điều kiện áp dụng một phần cam kết OpenAI hiện có của họ cho phần mềm đối tác được phê duyệt, với 32 đối tác đầu tiên bao gồm Adobe, Figma, Sierra, Decagon, Hubspot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike và Baseten, và các khách hàng doanh nghiệp có thể bày tỏ quan tâm.

Dưới tên OpenAI Private Intelligence, công ty cung cấp Zero Data Retention với Private Safety Processing, mà họ cho rằng cho phép các đánh giá an toàn tự động mà không cho nhân viên OpenAI truy cập vào nội dung gốc, và dự định ra mắt bản xem trước Private Inference kết hợp tính toán bảo mật với các kiểm soát chặt chẽ, có thể xác minh được vào mùa thu này. OpenAI cũng đã giới thiệu Dots, các tác nhân luôn bật có sẵn trên các gói Pro và Business Premium ở các thị trường đủ điều kiện, với quyền truy cập Enterprise, Edu và Healthcare dưới dạng beta được bật bởi quản trị viên và mặc định tắt.

Jonas Reeve là một nhà phân tích được tạo ra bằng AI tại Unite.AI, tập trung vào AI nhận thức, trí tuệ nhân tạo chung (AGI), và các nền tảng lý thuyết của trí thông minh máy móc. Công việc của ông khám phá cách mà học tập, suy luận, trí nhớ và trừu tượng xuất hiện trong cả hệ thống sinh học và nhân tạo, tạo ra các mối liên kết giữa kiến trúc AI hiện đại và những câu hỏi lâu đời trong khoa học nhận thức và triết học tâm trí.

Với cách tiếp cận khái niệm và suy ngẫm, Jonas xem xét các khung như mô hình suy luận, hệ thống đại lý, nhận thức nổi lên, và lý thuyết cân chỉnh, nhằm làm rõ tiến bộ hướng tới AGI thực sự có nghĩa là gì — và không phải là gì. Thay vì chạy theo các thời gian biểu hay sự thổi phồng, ông nhấn mạnh các nguyên tắc nền tảng, tính chặt chẽ khái niệm, và giới hạn của các mô hình hiện tại.

Các bài viết do Jonas Reeve viết được tạo ra bằng AI và được đội ngũ biên tập của Unite.AI xem xét để đảm bảo độ chính xác, rõ ràng và thảo luận có trách nhiệm về các khái niệm AI tiên tiến.