Mô hình và nền tảng AI

Cerebras Giới Thiệu Giải Pháp Trình Diễn AI Nhanh Nhất Thế Giới: 20 Lần Tốc Độ Với Chi Phí Thấp Hơn

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Cerebras Systems (CBRS ), một công ty tiên phong trong lĩnh vực tính toán hiệu suất cao cho AI, đã giới thiệu một giải pháp đột phá đang thay đổi cách thức hoạt động của AI. Vào ngày 27 tháng 8 năm 2024, công ty đã công bố ra mắt Cerebras Inference, dịch vụ trình diễn AI nhanh nhất trên thế giới. Với các chỉ số hiệu suất vượt trội so với các hệ thống dựa trên GPU truyền thống, Cerebras Inference mang lại tốc độ 20 lần nhanh hơn với chi phí thấp hơn, thiết lập một tiêu chuẩn mới cho lĩnh vực tính toán AI.

Tốc Độ và Hiệu Suất Chi Phí Không Tương Xứng

Cerebras Inference được thiết kế để cung cấp hiệu suất vượt trội trên nhiều mô hình AI khác nhau, đặc biệt là trong phân khúc mô hình ngôn ngữ lớn (LLM) đang phát triển nhanh chóng. Ví dụ, nó xử lý 1.800 token mỗi giây cho mô hình Llama 3.1 8B và 450 token mỗi giây cho mô hình Llama 3.1 70B. Hiệu suất này không chỉ nhanh hơn 20 lần so với các giải pháp dựa trên GPU của NVIDIA (NVDA ) mà còn có chi phí thấp hơn đáng kể. Cerebras cung cấp dịch vụ này bắt đầu từ chỉ 10 xu mỗi triệu token cho mô hình Llama 3.1 8B và 60 xu mỗi triệu token cho mô hình Llama 3.1 70B, đại diện cho sự cải thiện 100 lần về hiệu suất giá so với các dịch vụ dựa trên GPU hiện có.

Giữ Gìn Độ Chính Xác Trong Khi Đẩy Nhanh Tốc Độ

Một trong những khía cạnh ấn tượng nhất của Cerebras Inference là khả năng duy trì độ chính xác hàng đầu trong khi cung cấp tốc độ không thể sánh được. Không giống như các phương pháp khác phải hy sinh độ chính xác để đạt được tốc độ, giải pháp của Cerebras vẫn giữ trong phạm vi 16-bit cho toàn bộ quá trình suy luận. Điều này đảm bảo rằng lợi ích về hiệu suất không phải trả giá bằng chất lượng đầu ra của mô hình AI, một yếu tố quan trọng đối với các nhà phát triển tập trung vào độ chính xác.

Micah Hill-Smith, Đồng sáng lập và CEO của Artificial Analysis, đã nhấn mạnh tầm quan trọng của thành tựu này: “Cerebras đang cung cấp tốc độ nhanh hơn một bậc so với các giải pháp dựa trên GPU cho các mô hình AI Llama 3.1 8B và 70B của Meta. Chúng tôi đo được tốc độ trên 1.800 token đầu ra mỗi giây trên Llama 3.1 8B và trên 446 token đầu ra mỗi giây trên Llama 3.1 70B – một kỷ lục mới trong các điểm chuẩn này.”

Sự Quan Trọng Của Trình Diễn AI Tăng Cường

Trình diễn AI là phân khúc tăng trưởng nhanh nhất trong lĩnh vực tính toán AI, chiếm khoảng 40% thị trường phần cứng AI tổng thể. Sự ra đời của trình diễn AI tốc độ cao như Cerebras đã mở ra cơ hội mới và đánh dấu một kỷ nguyên mới cho các ứng dụng AI. Với Cerebras Inference, các nhà phát triển có thể xây dựng các ứng dụng AI thế hệ tiếp theo đòi hỏi hiệu suất phức tạp và thời gian thực, chẳng hạn như các tác nhân AI và hệ thống thông minh.

Andrew Ng, Người sáng lập DeepLearning.AI, đã nhấn mạnh tầm quan trọng của tốc độ trong phát triển AI: “DeepLearning.AI có nhiều công việc đòi hỏi phải kích hoạt mô hình ngôn ngữ lớn (LLM) nhiều lần để đạt được kết quả. Cerebras đã xây dựng khả năng trình diễn ấn tượng mà sẽ rất hữu ích cho các công việc như vậy.

Hỗ Trợ Ngành Công Nghiệp Rộng Lớn và Đối Tác Chiến Lược

Cerebras đã nhận được sự hỗ trợ mạnh mẽ từ các nhà lãnh đạo trong ngành và đã hình thành các quan hệ đối tác chiến lược để đẩy nhanh sự phát triển của các ứng dụng AI. Kim Branson, Phó Chủ tịch cấp cao về AI/ML tại GlaxoSmithKline, một khách hàng sớm của Cerebras, đã nhấn mạnh tiềm năng chuyển đổi của công nghệ này: “Tốc độ và quy mô thay đổi mọi thứ.”

Các công ty khác như LiveKit, Perplexity, và Meter cũng đã thể hiện sự hào hứng về tác động mà Cerebras Inference sẽ mang lại cho hoạt động của họ. Những công ty này đang tận dụng sức mạnh của khả năng tính toán của Cerebras để tạo ra các trải nghiệm AI phản hồi nhanh hơn, tương tác người dùng tốt hơn trong các công cụ tìm kiếm và cải thiện hệ thống quản lý mạng.

Cerebras Inference: Các Tầng và Khả Năng Tiếp Cận

Cerebras Inference có sẵn trên ba tầng giá cạnh tranh: Miễn phí, Nhà phát triển và Doanh nghiệp. Tầng Miễn phí cung cấp quyền truy cập API miễn phí với giới hạn sử dụng hào phóng, giúp nó trở nên dễ tiếp cận với nhiều người dùng. Tầng Nhà phát triển cung cấp một tùy chọn triển khai linh hoạt, không cần máy chủ, với mô hình Llama 3.1 được định giá 10 xu và 60 xu mỗi triệu token. Tầng Doanh nghiệp phục vụ các tổ chức có khối lượng công việc liên tục, cung cấp mô hình tinh chỉnh, thỏa thuận cấp dịch vụ tùy chỉnh và hỗ trợ chuyên dụng, với giá cả có sẵn theo yêu cầu.

Nguồn Sức Mạnh Của Cerebras Inference: Bộ Xử Lý Wafer Scale Engine 3 (WSE-3)

Ở trung tâm của Cerebras Inference là hệ thống CS-3 của Cerebras, được cung cấp bởi bộ xử lý Wafer Scale Engine 3 (WSE-3) hàng đầu trong ngành. Bộ xử lý AI này không có đối thủ về kích thước và tốc độ, cung cấp 7.000 lần băng thông bộ nhớ hơn so với H100 của NVIDIA. Quy mô lớn của WSE-3 cho phép nó xử lý nhiều người dùng đồng thời, đảm bảo tốc độ cực nhanh mà không ảnh hưởng đến hiệu suất. Kiến trúc này cho phép Cerebras tránh những sự đánh đổi thường gặp trong các hệ thống dựa trên GPU, cung cấp hiệu suất hàng đầu cho các khối lượng công việc AI.

Tích Hợp Mượt Mà và API Dễ Sử Dụng Cho Nhà Phát Triển

Cerebras Inference được thiết kế với các nhà phát triển trong tâm trí. Nó có một API tương thích hoàn toàn với API Hoàn thành trò chuyện của OpenAI, cho phép di chuyển dễ dàng với tối thiểu thay đổi mã. Cách tiếp cận thân thiện với nhà phát triển này đảm bảo rằng việc tích hợp Cerebras Inference vào các công việc hiện có là dễ dàng nhất có thể, cho phép triển khai nhanh chóng các ứng dụng AI hiệu suất cao.

Cerebras Systems: Đẩy Mạnh Sự Đổi Mới Trong Nhiều Ngành Công Nghiệp

Cerebras Systems không chỉ là một nhà lãnh đạo trong lĩnh vực tính toán AI mà còn là một người chơi chính trong nhiều ngành công nghiệp khác, bao gồm chăm sóc sức khỏe, năng lượng, chính phủ, tính toán khoa học và dịch vụ tài chính. Các giải pháp của công ty đã đóng vai trò quan trọng trong việc thúc đẩy các đột phá tại các tổ chức như Phòng thí nghiệm Quốc gia, Aleph Alpha, Bệnh viện Mayo và GlaxoSmithKline.

Bằng cách cung cấp tốc độ không thể sánh được, khả năng mở rộng và độ chính xác, Cerebras đang giúp các tổ chức trong các lĩnh vực này giải quyết một số vấn đề thách thức nhất trong AI và hơn thế nữa. Dù đó là tăng tốc phát hiện thuốc trong chăm sóc sức khỏe hay nâng cao khả năng tính toán trong nghiên cứu khoa học, Cerebras đang ở vị trí hàng đầu trong việc thúc đẩy sự đổi mới.

Kết Luận: Một Kỷ Nguyên Mới Cho Trình Diễn AI

Cerebras Systems đang thiết lập một tiêu chuẩn mới cho trình diễn AI với việc ra mắt Cerebras Inference. Bằng cách cung cấp tốc độ 20 lần nhanh hơn so với các hệ thống dựa trên GPU truyền thống với chi phí thấp hơn, Cerebras không chỉ làm cho AI trở nên dễ tiếp cận hơn mà còn mở đường cho thế hệ tiếp theo của các ứng dụng AI. Với công nghệ hàng đầu, quan hệ đối tác chiến lược và cam kết đổi mới, Cerebras đang sẵn sàng dẫn dắt ngành công nghiệp AI vào một kỷ nguyên mới về hiệu suất và khả năng mở rộng không từng có.

Để biết thêm thông tin về Cerebras Systems và thử nghiệm Cerebras Inference, vui lòng truy cập www.cerebras.ai.

Antoine là một nhà lãnh đạo có tầm nhìn và là đối tác sáng lập của Unite.AI, được thúc đẩy bởi niềm đam mê không ngừng nghỉ để định hình và quảng bá tương lai của AI và robot. Là một doanh nhân hàng loạt, ông tin rằng AI sẽ gây ra sự gián đoạn cho xã hội giống như điện, và thường được bắt gặp khi nói về tiềm năng của các công nghệ phá vỡ và AGI.

Là một nhà tương lai học, ông dành để khám phá cách những đổi mới này sẽ định hình thế giới của chúng ta. Ngoài ra, ông là người sáng lập của Securities.io, một nền tảng tập trung vào đầu tư vào các công nghệ tiên tiến đang định nghĩa lại tương lai và thay đổi toàn bộ lĩnh vực.