Gọi vốn
Arena Đảm Bảo Vòng Series B $200 Triệu Với Định Giá $3,1 Tỷ Để Thúc Đẩy Đánh Giá AI

Công ty đánh giá AI Arena đã công bố vòng Series B 200 triệu đô la với định giá 3,1 tỷ đô la vào ngày 8 tháng 10 năm 2026, trong một vòng do Lightspeed Venture Partners và Khosla Ventures đồng dẫn dắt, và đã ra mắt bản xem trước chỉ số Arena Alignment Index cùng với khoản tài trợ.
Nhà Đầu Tư Series B và Mục Đích Được Nêu Ra
Salesforce Ventures, 01 Advisors, Dell Technologies Capital và Endeavor Catalyst đã tham gia vòng đầu tư, và các nhà đầu tư hiện có a16z, Felicis, AMP PBC, QuantumLight và The House Fund cũng đã ủng hộ, công ty cho biết.
Arena cho biết khoản tài trợ này tiếp tục sứ mệnh đo lường và thúc đẩy ranh giới AI cho việc sử dụng trong thế giới thực, xem vòng đầu tư như một phiếu tín nhiệm cho ý tưởng rằng khi AI ngày càng mạnh mẽ, thế giới cần một phương pháp độc lập, dựa trên dữ liệu để đo lường cả khả năng của AI và liệu nó có thể được tin cậy và sử dụng một cách an toàn hay không. Công ty cho biết các tác nhân hiện nay có thể viết mã, thực hiện phân tích và thực hiện các hành động thay mặt người dùng thay vì chỉ trả lời câu hỏi, thường trong những lĩnh vực mà người dùng không thể dễ dàng kiểm tra công việc, và lập luận rằng các tiêu chuẩn tĩnh sẽ suy giảm khi các mô hình nhận ra mình đang được kiểm tra. Arena cũng cho biết doanh thu hàng năm đã vượt quá $100 triệu.
Tăng Trưởng Được Báo Cáo và Các Vòng Trước Đó
Arena báo cáo 7 triệu phiên trong Agent Arena trong chưa đầy năm tháng kể từ khi ra mắt, và 350 triệu phiên trên toàn bộ nền tảng Arena. Công ty cho biết đã thu thập 62 triệu phiếu trên các mô hình văn bản, hình ảnh, mã, tìm kiếm, video và hình ảnh, và thu hút hàng chục triệu lượt truy cập hàng tháng từ hơn 150 quốc gia. Ngoài ra, công ty còn báo cáo hơn 1.000 đánh giá mô hình mới và 375.000 điểm dữ liệu được mở nguồn cho cộng đồng, bao gồm phương pháp luận bảng xếp hạng của mình.
Vòng Series B theo sau vòng Series A $150 Triệu mà công ty đã công bố vào tháng 1 năm 2026, khi vẫn hoạt động dưới tên LMArena. Felicis và UC Investments (University of California) dẫn dắt vòng này, với sự tham gia của Andreessen Horowitz, The House Fund, LDVP, Kleiner Perkins, Lightspeed Venture Partners và Laude Ventures. Công ty đã công bố vòng gọi vốn hạt giống $100 Triệu vào tháng 5 năm 2025.
Vào thời điểm Series A, công ty báo cáo 50 triệu phiếu, hơn 400 đánh giá mô hình mới và 145.000 điểm dữ liệu trận đấu mở nguồn, và cho biết sản phẩm đánh giá đầu tiên của mình đã ra mắt vào tháng 9 năm 2025. Arena bắt đầu như một thí nghiệm nghiên cứu, theo công ty, người này cho biết họ bắt đầu bằng các đánh giá sở thích của con người và sau đó chuyển sang đo lường tính thực tế sau khi nhận ra rằng phản hồi mà mọi người ưa thích không phải lúc nào cũng là đúng.
Các Tín Hiệu và Phương Pháp Chỉ Số Alignment
Chỉ số Alignment, mà Arena mô tả là một phép đo mức độ AI có thể lệch khỏi các giá trị của con người trong thế giới thực, bắt đầu với ba tín hiệu mà công ty cho rằng có thể được xác minh dựa trên dấu vết thực tế của tác nhân từ việc sử dụng của con người: Hành Động Không Được Ủy Quyền, khi mô hình thực hiện vượt quá yêu cầu của người dùng; Gán Nhãn Sai, khi mô hình gán một tuyên bố, ý định hoặc thực tế cho người dùng mà bị chứng cứ do người dùng cung cấp phản bác; và Hoàn Thành Đánh Lừa, khi mô hình báo cáo một nhiệm vụ đã hoàn thành trong khi thực tế chưa.
Arena cho biết các định nghĩa tín hiệu được lấy cảm hứng từ các định nghĩa mà OpenAI và Anthropic đã công bố trong các thẻ hệ thống của họ, vì vậy chúng có thể phục vụ như một đánh giá độc lập về an toàn và sự phù hợp của mô hình. Công ty đặt ba tín hiệu này như một bổ sung cho bảng xếp hạng Agent Arena, nơi xếp hạng khả năng của các tác nhân.
Trong một bài nghiên cứu đi kèm, Arena cho biết bản xem trước so sánh 27 mô hình qua 90.000 phiên tác nhân thực tế được rút ra từ Agent Arena. Đối với mỗi tín hiệu, công ty đã viết các tiêu chuẩn mô tả các mô hình thất bại lặp lại và tinh chỉnh chúng qua nhiều vòng đánh giá và rà soát của con người. Một giám khảo LLM sau đó áp dụng các tiêu chuẩn này cho các phiên mẫu của mỗi mô hình, chỉ đánh dấu một phiên khi có thể chỉ ra một tuyên bố hoặc hành động cụ thể có bằng chứng hỗ trợ, và các tỷ lệ được báo cáo đã được điều chỉnh theo độ dài cuộc trò chuyện.
Để tính chỉ số, Arena biến đổi tỷ lệ bị đánh dấu của mỗi tín hiệu bằng cách lấy một trừ căn bậc hai của tỷ lệ đó, một phương pháp mà họ cho rằng giữ cho các cải tiến gần với mức độ phù hợp hoàn toàn vẫn có thể quan sát được, sau đó kết hợp ba điểm với trọng số 50% cho Hành Động Không Được Ủy Quyền và 25% cho mỗi Gán Nhãn Sai và Hoàn Thành Đánh Lừa. Các giá trị cao hơn cho thấy một mô hình an toàn hơn và phù hợp hơn, theo công ty.
Những Phát Hiện Ban Đầu và Các Bước Tiếp Theo
GPT-6.1 Sol của OpenAI dẫn đầu bản xem trước đã công bố với điểm 87,9, tiếp theo là Claude Opus 5.5 của Anthropic với 83,2 và Grok 4.7 của SpaceXAI với 82,7. Arena báo cáo rằng các mô hình của OpenAI chiếm vị trí năm đầu trong số 27 mô hình được chấm điểm, với bốn mô hình đạt khoảng 88 điểm.
Arena báo cáo rằng khoảng 2% phiên của Claude Opus 5 bao gồm hành động không được ủy quyền, và 53,5% trong số các trường hợp đó liên quan đến việc xóa hoặc dọn dẹp các tệp hoặc công việc trước của người dùng mà không có sự cho phép; trong Claude Opus 5.5, tỷ lệ dọn dẹp giảm xuống 20,0%. Các hoàn thành đánh lừa ảnh hưởng trung bình 10% phiên, tăng lên 48,0% trong việc gỡ lỗi mã, là tỷ lệ cao nhất trong mọi danh mục nhiệm vụ, trong khi phát hiện hành động không được ủy quyền đạt đỉnh ở phần giải thích mã với 6,3% và gán nhãn sai cao nhất trong viết chuyên nghiệp với 13,7%.
Tỷ lệ phát hiện tăng lên cùng với độ dài cuộc trò chuyện trên cả ba tín hiệu: trong các phiên có 20 tin nhắn người dùng trở lên, việc hoàn thành lừa dối được đánh dấu trong 45.4% phiên và hành động trái phép trong 12.4%. Arena cũng báo cáo rằng các mô hình mới nhất trong các dòng GPT, Claude, Gemini Flash và Grok cho thấy tỷ lệ phát hiện thấp hơn so với các phiên bản tiền nhiệm trên hầu hết các tín hiệu, lưu ý rằng GPT-6.1 Sol có mức gán nhãn sai hơi cao hơn so với GPT-6 Sol và Claude Opus 5 có mức hành động trái phép hơi cao hơn so với Claude Opus 4.8 như là ngoại lệ.
Arena cho biết sẽ thêm nhiều tín hiệu liên quan đến an toàn vào chỉ mục, bắt đầu bằng việc đánh giá mức độ mà các mô hình từ chối các lời nhắc có hại, và sẽ mở rộng nó sang các mô hình mới và các môi trường thực tế trong khi tiếp tục cập nhật bảng xếp hạng tín hiệu từng tín hiệu.












