Gọi vốn
Gentrace Secures $8M Series A để Cách Mạng Hóa Kiểm Thử Trí Tuệ Nhân Tạo Tạo Sinh

Gentrace, một nền tảng tiên tiến cho việc kiểm thử và giám sát các ứng dụng trí tuệ nhân tạo tạo sinh, đã công bố việc hoàn thành thành công vòng tài trợ Series A trị giá 8 triệu đô la do Matrix Partners dẫn đầu, với sự đóng góp từ Headline và K9 Ventures. Mốc tài trợ này, mang lại cho công ty tổng tài trợ lên đến 14 triệu đô la, trùng hợp với việc ra mắt công cụ chủ chốt của nó, Experiments—một giải pháp đầu tiên trong ngành được thiết kế để làm cho việc kiểm thử mô hình ngôn ngữ lớn (LLM) trở nên dễ tiếp cận, hợp tác và hiệu quả hơn trên các tổ chức.
Sự thúc đẩy toàn cầu nhằm tích hợp trí tuệ nhân tạo tạo sinh vào các ngành công nghiệp đa dạng – từ giáo dục đến thương mại điện tử – đã tạo ra nhu cầu quan trọng đối với các công cụ đảm bảo rằng các hệ thống AI đáng tin cậy, an toàn và phù hợp với nhu cầu của người dùng. Tuy nhiên, hầu hết các giải pháp hiện có đều bị phân mảnh, đòi hỏi kỹ thuật cao và chỉ giới hạn trong các đội ngũ kỹ thuật. Gentrace nhằm mục đích phá vỡ các rào cản này với một nền tảng thúc đẩy sự hợp tác xuyên chức năng, cho phép các bên liên quan từ quản lý sản phẩm đến chất lượng đảm bảo (QA) đóng vai trò tích cực trong việc tinh chỉnh các ứng dụng AI.
“Trí tuệ nhân tạo tạo sinh đã mang lại những cơ hội đáng kinh ngạc, nhưng sự phức tạp của nó thường khiến việc thử nghiệm và phát triển đáng tin cậy trở nên khó khăn,” Doug Safreno, CEO và đồng sáng lập của Gentrace cho biết. “Với Gentrace, chúng tôi đang xây dựng không chỉ một công cụ, mà còn là một khuôn khổ cho phép các tổ chức phát triển các hệ thống AI đáng tin cậy, hiệu suất cao một cách hợp tác và hiệu quả.”
Địa Chỉ Thử Thách Của Phát Triển Trí Tuệ Nhân Tạo Tạo Sinh
Sự trỗi dậy của trí tuệ nhân tạo tạo sinh đã rất nhanh chóng, nhưng cũng như vậy là những thách thức xung quanh việc triển khai nó. Các mô hình như GPT (Generative Pre-trained Transformer) đòi hỏi phải kiểm thử rộng rãi để xác thực các phản hồi của chúng, xác định lỗi và đảm bảo an toàn trong các ứng dụng thực tế. Theo các nhà phân tích thị trường, lĩnh vực kỹ thuật trí tuệ nhân tạo tạo sinh dự kiến sẽ tăng trưởng lên 38,7 tỷ đô la vào năm 2030, với tốc độ tăng trưởng hàng năm kép (CAGR) là 34,2%. Sự tăng trưởng này nhấn mạnh nhu cầu cấp thiết đối với các công cụ kiểm thử và giám sát tốt hơn.
Trong lịch sử, việc kiểm thử AI đã dựa vào các quy trình thủ công, bảng tính hoặc các nền tảng tập trung vào kỹ thuật mà không thể mở rộng hiệu quả cho nhu cầu của doanh nghiệp. Những phương pháp này cũng tạo ra các silo, ngăn cản các đội ngũ ngoài kỹ thuật – như quản lý sản phẩm hoặc các quan chức tuân thủ – đóng góp tích cực vào các quy trình đánh giá. Nền tảng của Gentrace giải quyết những vấn đề này thông qua một phương pháp tiếp cận ba trụ cột:
- Môi Trường Kiểm Thử Được Thiết Kế Đặc Biệt
Gentrace cho phép các tổ chức mô phỏng các kịch bản thế giới thực, cho phép các mô hình AI được đánh giá trong điều kiện phản ánh việc sử dụng thực tế. Điều này đảm bảo rằng các nhà phát triển có thể xác định các trường hợp biên, mối quan tâm về an toàn và các rủi ro khác trước khi triển khai. - Phân Tích Hiệu Suất Toàn Diện
Các thông tin chi tiết về hiệu suất của LLM, chẳng hạn như tỷ lệ thành công, tỷ lệ lỗi và thời gian phản hồi, cho phép các đội ngũ xác định xu hướng và liên tục cải thiện chất lượng mô hình. - Hợp Tác Chức Năng Thông Qua Experiments
Công cụ Experiments mới được ra mắt cho phép các đội ngũ sản phẩm, chuyên gia chủ đề và chuyên gia QA kiểm thử và đánh giá trực tiếp đầu ra của AI mà không cần chuyên môn lập trình. Bằng cách hỗ trợ các quy trình làm việc tích hợp với các công cụ như OpenAI, Pinecone và Rivet, Experiments đảm bảo việc áp dụng trơn tru trên các tổ chức.
Điều Gì Làm Cho Gentrace Đứng Ra?
Công cụ Experiments của Gentrace được thiết kế để dân chủ hóa việc kiểm thử AI. Các công cụ truyền thống thường đòi hỏi chuyên môn kỹ thuật, khiến các đội ngũ ngoài kỹ thuật không thể tham gia vào các quy trình đánh giá quan trọng. Ngược lại, giao diện không cần mã của Gentrace cho phép người dùng kiểm thử các hệ thống AI một cách trực quan. Các tính năng chính của Experiments bao gồm:
- Kiểm Thử Trực Tiếp Đầu Ra Của AI: Người dùng có thể tương tác trực tiếp với đầu ra của LLM trong nền tảng, giúp dễ dàng đánh giá hiệu suất trong thế giới thực.
- Kịch Bản “Giả Sử”: Các đội ngũ có thể dự đoán các chế độ lỗi tiềm năng bằng cách chạy các thử nghiệm giả định mô phỏng các điều kiện đầu vào khác nhau hoặc các trường hợp biên.
- Trước Khi Triển Khai: Trước khi triển khai các thay đổi, các đội ngũ có thể đánh giá cách các cập nhật sẽ ảnh hưởng đến hiệu suất và ổn định.
- Hỗ Trợ Đầu Ra Đa Phương Tiện: Gentrace đánh giá không chỉ đầu ra dựa trên văn bản mà còn cả đầu ra đa phương tiện, chẳng hạn như đường ống xử lý hình ảnh-sang-văn bản hoặc video, khiến nó trở thành một công cụ đa năng cho các ứng dụng AI tiên tiến.
Những khả năng này cho phép các tổ chức chuyển từ việc gỡ lỗi phản ứng sang phát triển chủ động, cuối cùng giảm thiểu rủi ro triển khai và cải thiện sự hài lòng của người dùng.
Kết Quả Đáng Kinh Ngạc Từ Các Lãnh Đạo Ngành
Cách tiếp cận đổi mới của Gentrace đã thu hút được sự quan tâm từ các người dùng sớm, bao gồm Webflow, Quizlet và một nhà bán lẻ Fortune 100. Những công ty này đã báo cáo lại các kết quả chuyển đổi:
- Quizlet: Tăng cường hiệu suất kiểm thử lên 40 lần, giảm chu kỳ đánh giá từ vài giờ xuống dưới một phút.
- Webflow: Cải thiện sự hợp tác giữa các đội ngũ kỹ thuật và sản phẩm, cho phép điều chỉnh cuối cùng nhanh hơn các tính năng AI.
“Gentrace biến việc đánh giá LLM thành một quá trình hợp tác. Đó là một phần quan trọng của ngăn xếp kỹ thuật AI của chúng tôi để cung cấp các tính năng phù hợp với người dùng,” Bryant Chou, đồng sáng lập và kiến trúc sư trưởng tại Webflow cho biết.
Madeline Gilbert, Kỹ Sư Học Máy Cấp Cao tại Quizlet, nhấn mạnh sự linh hoạt của nền tảng: “Gentrace cho phép chúng tôi thực hiện các đánh giá tùy chỉnh phù hợp với nhu cầu cụ thể của mình. Nó đã cải thiện đáng kể khả năng dự đoán tác động của các thay đổi trong các mô hình AI của chúng tôi.”
Đội Lãnh Đạo Sáng Tạo
Đội ngũ lãnh đạo của Gentrace kết hợp chuyên môn trong AI, DevOps và cơ sở hạ tầng phần mềm:
- Doug Safreno (CEO): Đồng sáng lập trước đây của StacksWare, một nền tảng quan sát doanh nghiệp được VMware mua lại.
- Vivek Nair (CTO): Xây dựng cơ sở hạ tầng kiểm thử có thể mở rộng tại Uber và Dropbox.
- Daniel Liem (COO): Có kinh nghiệm trong việc thúc đẩy sự xuất sắc về hoạt động tại các công ty công nghệ tăng trưởng cao.
Đội ngũ cũng đã thu hút được các cố vấn và nhà đầu tư thiên thần từ các công ty hàng đầu, bao gồm Figma, Linear và Asana, giúp xác thực thêm sứ mệnh và vị trí thị trường của họ.
Phát Triển Cho Tương Lai
Với nguồn vốn mới được huy động, Gentrace dự định sẽ mở rộng đội ngũ kỹ thuật, sản phẩm và tiếp thị để hỗ trợ nhu cầu doanh nghiệp ngày càng tăng. Lộ trình phát triển bao gồm các tính năng tiên tiến như thử nghiệm dựa trên ngưỡng (tự động hóa việc xác định ngưỡng hiệu suất) và tự tối ưu hóa (cải thiện mô hình động dựa trên dữ liệu đánh giá).
Ngoài ra, Gentrace cam kết tăng cường khả năng tuân thủ và bảo mật. Công ty gần đây đã đạt được chứng nhận ISO 27001, phản ánh cam kết của họ trong việc bảo vệ dữ liệu khách hàng.
Gentrace Trong Hệ Sinh Thái Trí Tuệ Nhân Tạo Rộng Lớn Hơn
Các bản cập nhật gần đây của nền tảng nhấn mạnh cam kết của họ đối với sự đổi mới liên tục:
- Đánh Giá Địa Phương và Dữ Liệu: Cho phép các đội ngũ sử dụng dữ liệu độc quyền hoặc nhạy cảm một cách an toàn trong cơ sở hạ tầng của riêng họ.
- Đánh Giá So Sánh: Hỗ trợ việc kiểm thử đầu đối đầu để xác định mô hình hoặc đường ống có hiệu suất tốt nhất.
- Giám Sát Sản Xuất: Cung cấp thông tin chi tiết thời gian thực về cách các mô hình hoạt động sau khi triển khai, giúp các đội ngũ phát hiện vấn đề trước khi chúng trở nên nghiêm trọng.
Hỗ Trợ Đối Tác và Xác Thực Thị Trường
Kojo Osei của Matrix Partners nhấn mạnh giá trị của nền tảng: “Trí tuệ nhân tạo tạo sinh sẽ chỉ thực sự đạt được tiềm năng của nó nếu các tổ chức có thể tin tưởng vào đầu ra của nó. Gentrace đang thiết lập một tiêu chuẩn mới cho độ tin cậy và khả năng sử dụng của AI.”
Jett Fein, Đối Tác tại Headline, thêm: “Khả năng của Gentrace trong việc tích hợp trơn tru vào các quy trình làm việc doanh nghiệp phức tạp khiến nó trở nên không thể thiếu cho các tổ chức triển khai AI trên quy mô lớn.”
Định Hình Tương Lai Của Trí Tuệ Nhân Tạo Tạo Sinh
Khi trí tuệ nhân tạo tạo sinh tiếp tục định hình lại các ngành công nghiệp, các công cụ như Gentrace sẽ là thiết yếu để đảm bảo việc triển khai an toàn và hiệu quả của nó. Bằng cách cho phép các đội ngũ đa dạng đóng góp vào việc kiểm thử và phát triển, Gentrace đang thúc đẩy một văn hóa hợp tác và trách nhiệm giải trình trong AI.












