Mô hình và nền tảng AI
AWS Thêm Grok 4.7 của xAI vào Amazon Bedrock với Cửa sổ Ngữ cảnh 500K

Amazon Web Services đã công bố vào ngày 28 tháng 9 năm 2026 rằng mô hình Grok 4.7 của xAI hiện đã có trên Amazon Bedrock, được thêm vào danh mục mô hình Bedrock với cửa sổ ngữ cảnh 500K token, hỗ trợ nhập văn bản và hình ảnh, và bốn mức nỗ lực suy luận có thể cấu hình. thông báo trên Blog Machine Learning của AWS mô tả Grok 4.7 là một mô hình tiên tiến được xây dựng cho lập trình, các tác nhân chạy lâu dài và công việc tri thức.
xAI lần đầu tiên phát hành Grok 4.7 vào ngày 21 tháng 9 năm 2026, trong một thông báo ra mắt cho phép mô hình có sẵn trên Cursor và Grok Build và thông qua Grok API, các công cụ lập trình bên thứ ba, và các bộ định tuyến mô hình cùng các nền tảng đám mây. Trong thông báo đó, xAI định giá mô hình bắt đầu ở mức 2 USD cho mỗi triệu token đầu vào và 6 USD cho mỗi triệu token đầu ra, và cho biết họ cung cấp một biến thể nhanh gấp đôi tốc độ đầu ra với giá gấp đôi.
xAI cho biết Grok 4.7 được xây dựng cho
Theo xAI, như được trích dẫn trong bài đăng của AWS, Grok 4.7 là mô hình mạnh nhất của họ cho lập trình và công việc tri thức, với trọng tâm vào khả năng chịu đựng hơn là tốc độ thô: mô hình làm việc lâu hơn trên các nhiệm vụ khó và kiểm tra công việc của mình một cách cẩn thận hơn trước khi tiếp tục. xAI báo cáo rằng Grok 4.7 sử dụng một mô hình nền tảng mới, lớn hơn, được đào tạo qua một quá trình học tăng cường dài hơn trên một tập hợp nhiệm vụ khó hơn, ưu tiên các vấn đề mất nhiều giờ để hoàn thành. xAI ghi nhận việc đào tạo này mang lại hai khả năng: xác minh tốt hơn công việc của mô hình, và sử dụng hiệu quả hơn cửa sổ ngữ cảnh 500K token cho các nhiệm vụ dài. xAI cũng cho biết họ đã đào tạo mô hình để hiểu một cách bản địa bộ khung Grok Bot, điều mà họ cho là nguyên nhân cải thiện trong các nhiệm vụ hội thoại và công việc tri thức chung.
xAI còn báo cáo khả năng tạo tài liệu và bài thuyết trình mạnh hơn và mô tả những cải tiến trong công việc tri thức chuyên nghiệp như của luật sư, y tá và nhà phân tích tài chính. Các đánh giá đã công bố của họ bao gồm kỹ thuật phần mềm với CursorBench và DeepSWE, công việc terminal và văn phòng kéo dài nhiều giờ với Terminal-Bench và AA Briefcase, kỹ thuật điện với EEBench, công việc pháp lý với Harvey Legal Agent Benchmark, và suy luận lâm sàng với HealthBench Professional.
Số Liệu Đánh Giá Độc Lập
Bài đăng của AWS cũng trích dẫn Artificial Analysis, mà họ mô tả là thực hiện các đánh giá riêng thay vì dựa vào số liệu do nhà phát triển báo cáo. Trong các kết quả đó, Grok 4.7 đạt Intelligence Index là 46 so với 44 của Grok 4.6, Coding Agent Index là 56 so với 47, AA‑Briefcase Elo là 1.657 so với 1.546, GDPval‑AA Elo là 1.695 so với 1.605, và AA‑Omniscience Index là 32 so với 30, với tỷ lệ ảo giác là 29% so với 34%. Artificial Analysis đo lường Grok 4.7 ở mức nỗ lực suy luận xhigh và Grok 4.6 ở mức nỗ lực mà họ báo cáo cho mỗi chỉ số.
Bài đăng chỉ ra sự đánh đổi ở hàng cuối cùng của bảng đó: Grok 4.7 đã sử dụng khoảng 81.000 token đầu ra cho mỗi nhiệm vụ Intelligence Index, trong khi Grok 4.6 chỉ khoảng 38.000, điều mà bài đăng mô tả là gần gấp đôi mỗi nhiệm vụ và là lý do để đặt mức nỗ lực một cách có chủ đích thay vì kế thừa mặc định.
An toàn và An ninh mạng
Theo xAI, Grok 4.7 được xây dựng với một bộ bảo vệ hoàn toàn mới và là mô hình mạnh nhất mà họ đã thử nghiệm về việc từ chối và khả năng chống jailbreak. xAI đặt mục tiêu trong các lĩnh vực sử dụng kép như an ninh mạng và công việc sinh học là vẫn hữu ích cho các nhiệm vụ hợp pháp trong khi từ chối những nhiệm vụ nguy hiểm. Đối với an ninh mạng cụ thể, xAI báo cáo mô hình chỉ cho phép một phần nhỏ các lời nhắc rủi ro sử dụng kép đi qua trong khi hiếm khi chặn công việc bảo mật hợp pháp, và họ đã bắt đầu cung cấp cho một số đối tác an ninh mạng quyền truy cập chỉ bằng lời mời vào khả năng red‑team của Grok 4.7 cho nghiên cứu phòng thủ.
Cách Grok 4.7 Được Đóng Gói trên Amazon Bedrock
Trên Bedrock, Grok 4.7 chấp nhận đầu vào văn bản và hình ảnh và trả về văn bản. Mô hình được cung cấp trên điểm cuối bedrock-runtime thông qua các hồ sơ suy luận xuyên khu vực, vì vậy các yêu cầu chỉ định một hồ sơ thay vì một ID mô hình thuần: us.xai.grok-4.7 cho hồ sơ địa lý Hoa Kỳ, hoặc global.xai.grok-4.7 cho hồ sơ Toàn cầu, cả hai đều tại đường dẫn /openai/v1 của URL cơ bản bedrock-runtime. Grok 4.7 hỗ trợ Responses API, Chat Completions API, InvokeModel và Converse API.
Vì mô hình tương thích với OpenAI, OpenAI SDK hoạt động trên đường dẫn /openai/v1 với một token bearer, có thể là khóa API Amazon Bedrock hoặc một token ngắn hạn được tạo từ chứng chỉ AWS Identity and Access Management (IAM). Các AWS SDK tiếp cận cùng mô hình qua Converse, ký các yêu cầu bằng các chứng chỉ AWS thông thường.
Mô hình cũng kết nối với các tính năng tiêu chuẩn của Bedrock. Bộ nhớ đệm lời nhắc ngầm được áp dụng tự động cho các tiền tố lời nhắc lặp lại, vì vậy các tác nhân gửi lại một lời nhắc hệ thống lớn hoặc tài liệu tham chiếu ở mỗi lượt sẽ trả mức phí đã lưu cho tiền tố đó. Bedrock Guardrails được gắn bằng ID và phiên bản trong yêu cầu, áp dụng bộ lọc nội dung, các chủ đề bị cấm, việc xóa thông tin cá nhân có thể nhận dạng và các chính sách từ ngữ cho cả lời nhắc và phản hồi. Đầu ra có cấu trúc hạn chế phản hồi theo một JSON Schema để mã downstream có thể phân tích trực tiếp, và việc ghi nhật ký gọi API ghi lại mỗi lần gọi trong Amazon CloudWatch kèm theo yêu cầu, phản hồi và số lượng token bao gồm token suy luận.
Hồ sơ Định Tuyến, Cấp Dịch Vụ và Quyền Truy Cập
Hồ sơ Toàn cầu định tuyến mỗi yêu cầu tới bất kỳ khu vực AWS thương mại nào được hỗ trợ, phân phối tải lên nhiều dung lượng hơn và có giá thấp hơn so với hồ sơ địa lý. Bài viết lưu ý rằng sự đánh đổi là giảm kiểm soát vị trí mà yêu cầu được phục vụ, điều này có thể dẫn đến độ trễ biến đổi hơn. Hồ sơ địa lý của Hoa Kỳ giữ việc xử lý trong phạm vi địa lý Hoa Kỳ, đáp ứng yêu cầu lưu trú dữ liệu tại Hoa Kỳ.
Ba cấp dịch vụ được cung cấp. Standard là trả phí theo token mà không có cam kết; Priority cung cấp xử lý nhanh hơn, được ưu tiên với mức phí cao; và Flex cung cấp quyền truy cập chi phí thấp hơn cho công việc không yêu cầu thời gian. Giá theo token cho từng cấp được hiển thị trên trang giá của Amazon Bedrock.
Trước lần gọi đầu tiên, người dùng xác nhận rằng mô hình có sẵn cho họ trong bảng điều khiển Bedrock cho khu vực AWS mà họ dự định sử dụng. Về quyền, bedrock:InvokeModel được đánh giá dựa trên ba tài nguyên: dự án mặc định của tài khoản, hồ sơ suy luận có tên, và mô hình nền tảng cơ bản, mà Amazon Resource Name của nó được đặt dấu đại diện trên các khu vực vì các hồ sơ xuyên khu vực định tuyến ra ngoài khu vực gọi. Xác thực bằng token mang (bearer-token) cũng yêu cầu bedrock:CallWithBearerToken, và các hồ sơ được phân quyền riêng lẻ, vì vậy một chính sách đặt tên hồ sơ US sẽ không bao phủ hồ sơ Global.
Khả năng suy luận luôn được kích hoạt trên Grok 4.7. Mức độ nỗ lực được thiết lập thông qua tham số reasoning trên Responses API hoặc qua additionalModelRequestFields trên Converse, với giá trị high làm mặc định. Nội dung suy luận được mã hoá; nó có thể được trả về bằng cách truyền include: \”reasoning.encrypted_content\” trong yêu cầu Responses API và sau đó gửi lại trong các vòng tiếp theo để cung cấp cho mô hình suy luận trước đó của nó như ngữ cảnh trong một cuộc hội thoại đa vòng. API Chat Completions không trả về token suy luận.
Bài viết khuyên nên coi khóa API Amazon Bedrock dài hạn như một chứng chỉ chỉ dùng cho khám phá, sử dụng token bearer ngắn hạn được tạo từ chứng chỉ IAM cho môi trường sản xuất, và xóa khóa khám phá khỏi bảng điều khiển Bedrock khi không còn cần thiết.












