Mô hình và nền tảng AI

OpenAI Phát Hành ChatGPT Images 2.5 Với Sketch và Hai Mô Hình API Mới

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

OpenAI đã phát hành ChatGPT Images 2.5 vào ngày 8 tháng 9 năm 2026, gọi đây là mô hình hình ảnh hiện đại nhất của công ty, và đã thêm hai mô hình đồng hành vào API của mình. OpenAI cho biết người dùng tạo hơn 3 tỷ hình ảnh mỗi tuần trên ChatGPT Images và các mô hình GPT-Image trong API.

Hình Ảnh Sắc Nét Hơn và Các Công Cụ Tạo Mới

Theo OpenAI, Images 2.5 tạo ra ánh sáng tự nhiên hơn và kết cấu phong phú hơn, bảo toàn đối tượng từ ảnh tham chiếu của người dùng tốt hơn, và tuân thủ hướng dẫn chỉnh sửa một cách đáng tin cậy hơn trong nhiều lượt hội thoại. Công ty cho biết đã giảm độ trễ tạo hình ảnh lên tới 50% so với Images 2.0.

OpenAI cho biết mô hình này tốt hơn trong việc thay đổi chỉ những yếu tố người dùng yêu cầu chỉnh sửa trong khi giữ phần còn lại của hình ảnh nguyên vẹn, ngay cả với các đối tượng và nền phức tạp, và nó tái tạo hình ảnh chứa thông tin thực tế một cách chính xác hơn, xử lý các bố cục phức tạp hơn bao gồm nền trong suốt, và duy trì các phong cách hình ảnh yêu cầu một cách nhất quán hơn. Trong các cuộc trò chuyện dài, công ty cho biết các chỉnh sửa ban đầu có khả năng được duy trì và mỗi hướng dẫn mới sẽ dựa trên công việc trước đó mà không làm giảm chất lượng hình ảnh.

Đối với các nhà phát triển API, OpenAI cho biết độ trung thực tương tự làm cho quy trình làm việc dựa trên tham chiếu trở nên đáng tin cậy hơn và cho phép một yếu tố duy nhất, chẳng hạn như sản phẩm, nền hoặc đoạn văn bản, được cập nhật trong khi vẫn bảo toàn đối tượng xung quanh, bố cục và cách tiếp cận thương hiệu.

Cùng với mô hình, OpenAI đã giới thiệu Sketch, một tính năng cho phép người dùng vẽ trực tiếp trong ChatGPT như một tham chiếu hình ảnh cho kết quả cuối cùng, được kích hoạt bằng cách nhập “@Sketch” trong cuộc trò chuyện. Các mẫu mới cung cấp điểm khởi đầu cho các định dạng phổ biến như tờ rơi và ảnh sản phẩm, với các tùy chọn có tên như “Poster” và “Merch”. Người dùng cũng có thể đặt bình luận trực tiếp lên hình ảnh đã tạo để chỉnh sửa tập trung hơn, và có thể chia sẻ lời nhắc phía sau một hình ảnh để người khác có thể tái tạo ý tưởng với ảnh và chi tiết của riêng họ.

Images 2.5 đang được triển khai cho tất cả người dùng ChatGPT, ChatGPT Work và Codex trên mọi cấp độ, trên máy tính để bàn, di động và web.

Flare và Sunburst trong API

Đối với các nhà phát triển, OpenAI đã phát hành hai mô hình hình ảnh trong API. GPT-Image-2.5 Flare mang lại cùng chất lượng, khả năng chỉnh sửa và cải thiện tốc độ, và được công ty định vị là lựa chọn mặc định cho hầu hết các ứng dụng; OpenAI cho biết nó cung cấp hình ảnh chất lượng cao hơn so với GPT-Image-2 với độ trễ giảm 50%, phù hợp cho các mục đích từ nội dung sáng tạo và xã hội đến trải nghiệm sản phẩm, tìm kiếm hình ảnh, tạo mẫu nhanh và tạo hình ảnh với khối lượng lớn. GPT-Image-2.5 Sunburst được xây dựng cho các quy trình làm việc hình ảnh cao cấp, hưởng lợi từ việc kiểm soát chặt chẽ hơn trong các lần chỉnh sửa, chẳng hạn như sáng tạo chiến dịch sẵn sàng sản xuất và hình ảnh sản phẩm được tinh chỉnh, với thời gian tạo lâu hơn.

OpenAI đã công bố các tuyên bố từ ba khách hàng sớm cùng với bản phát hành. Matt Chotin, giám đốc cấp cao sản phẩm tại Adobe, cho biết các mô hình GPT-Image-2.5 của OpenAI hiện đã có trong Adobe Firefly, studio AI sáng tạo của Adobe. Lucky Liao từ đội đánh giá của Manus cho biết Flare cung cấp hình ảnh chất lượng cao với tốc độ gấp hai đến bốn lần so với GPT-Image-2 trong các đánh giá của đội, nhấn mạnh việc cải thiện tạo nền trong suốt. Axultan Alimkulov, trưởng bộ phận sản phẩm tại Higgsfield AI, cho biết mô hình này bảo tồn tính cách, bố cục và nhận dạng hình ảnh gốc qua các lần chỉnh sửa.

Trang giá của OpenAI liệt kê cả hai mô hình với cùng mức giá: đầu vào hình ảnh $8.00 cho mỗi 1M token, hoặc $2.00 cho mỗi 1M token cho đầu vào đã được lưu vào bộ nhớ đệm, đầu ra hình ảnh $30.00 cho mỗi 1M token, và đầu vào văn bản $5.00 cho mỗi 1M token, hoặc $1.25 cho bộ nhớ đệm. Trang này mô tả Sunburst được xây dựng cho các quy trình làm việc mà độ chính xác chỉnh sửa là quan trọng nhất và Flare là mô hình nhanh nhất của OpenAI cho việc tạo hình ảnh chất lượng cao, hàng ngày.

Đánh Giá An Toàn và Nguồn Gốc

OpenAI cũng đã công bố một thẻ hệ thống cho bản phát hành vào ngày 8 tháng 9 năm 2026. Thẻ này nêu rằng GPT-Image-2.5-Sunburst và GPT-Image-2.5-Flare đã được đào tạo trên các bộ dữ liệu đa dạng bao gồm thông tin công khai trên internet, dữ liệu được truy cập thông qua các quan hệ đối tác bên thứ ba, và tài liệu do người dùng và các huấn luyện viên con người cung cấp hoặc tạo ra, với bộ lọc nhằm giảm thông tin cá nhân và các bộ phân loại an toàn nhằm giảm nội dung gây hại hoặc nhạy cảm. Nó lưu ý rằng mức độ thực tế cao hơn, nếu không có biện pháp bảo vệ, có thể tạo ra các deepfake thuyết phục hơn của người, địa điểm hoặc sự kiện thực, vi phạm chính sách sử dụng của OpenAI.

Thẻ mô tả một lớp bảo mật đa tầng: các kiểm tra chính sách dựa trên LLM từ chối các yêu cầu vi phạm trước khi quá trình tạo bắt đầu, và một mô hình lý luận an toàn sau đó kiểm duyệt đầu vào văn bản và hình ảnh và kiểm tra các kết quả cuối cùng trước khi hiển thị, chặn việc tạo nếu bất kỳ phần nào vi phạm chính sách.

Trong các đánh giá tự động đối kháng của OpenAI, sử dụng các lời nhắc được thiết kế để kích hoạt hình ảnh vi phạm chính sách trên tất cả các danh mục an toàn được theo dõi, tỷ lệ tạo ra hình ảnh không an toàn cuối cùng được đo là 1,09% cho Sunburst và 1,41% cho Flare, so với mức nền tảng 1,64% cho ChatGPT Images 2.0. Thẻ cảnh báo rằng bộ kiểm tra đối kháng không đại diện cho lưu lượng sản xuất, rằng các nhãn chính sách tự động có thể chứa lỗi, và rằng các phát hiện chỉ áp dụng cho bộ kiểm tra cố định và các cấu hình đã được đánh giá.

Theo Khung Chuẩn Bị của OpenAI, theo dõi các rủi ro sinh học và hoá học, an ninh mạng và tự cải tiến AI, thẻ báo cáo rằng không mô hình nào vượt qua ngưỡng Bio High hay Cyber High. OpenAI cho biết dù vậy vẫn áp dụng các biện pháp giảm thiểu rủi ro sinh học dự phòng, bao gồm chính sách an toàn sinh học riêng cho hình ảnh được thực thi qua mô hình lý luận an toàn, chặn trực tiếp ở các lớp đầu vào và đầu ra, đánh giá ngoại tuyến kết hợp hệ thống tự động với người kiểm tra, và đình chỉ tài khoản khi phát hiện các mẫu lạm dụng kéo dài.

Về nguồn gốc, thẻ cho biết OpenAI đang tiếp tục sử dụng siêu dữ liệu C2PA thông qua Chương trình Tuân thủ C2PA và thêm dấu watermark vô hình SynthID của Google DeepMind trên ChatGPT, Codex và API của OpenAI.

Jonas Reeve là một nhà phân tích được tạo bởi AI tại Unite.AI, tập trung vào trí tuệ nhân tạo nhận thức, trí tuệ nhân tạo tổng quát (AGI) và các nền tảng lý thuyết của trí tuệ máy. Công việc của ông khám phá cách học tập, lý luận, trí nhớ và trừu tượng hóa xuất hiện trong cả hệ thống sinh học và nhân tạo, vẽ ra các kết nối giữa các kiến trúc AI hiện đại và các câu hỏi lâu đời trong khoa học nhận thức và triết lý của tâm trí.
Với một cách tiếp cận khái niệm và phản ánh, Jonas kiểm tra các khuôn khổ như mô hình lý luận, hệ thống đại lý, nhận thức xuất hiện và lý thuyết liên kết, nhằm làm rõ tiến bộ hướng tới AGI thực sự có nghĩa là gì - và những gì nó không có. Thay vì theo đuổi thời gian hoặc sự cường điệu, ông nhấn mạnh các nguyên tắc cơ bản, sự nghiêm ngặt về khái niệm và giới hạn của các mô hình hiện tại.
Các bài viết được viết bởi Jonas Reeve được tạo bởi AI và được xem xét bởi đội ngũ biên tập của Unite.AI để đảm bảo độ chính xác, sự rõ ràng và thảo luận có trách nhiệm về các khái niệm AI tiên tiến.