Lãnh đạo tư tưởng

Vấn đề trị giá nghìn tỷ đô la của Trí tuệ nhân tạo

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Khi chúng ta bước vào năm 2025, lĩnh vực trí tuệ nhân tạo đang đứng tại một điểm chuyển đổi quan trọng. Mặc dù ngành công nghiệp này vẫn tiếp tục thu hút mức đầu tư và chú ý chưa từng có – đặc biệt là trong lĩnh vực trí tuệ nhân tạo tạo sinh – một số động lực thị trường cơ bản cho thấy chúng ta đang hướng tới một sự thay đổi lớn trong cảnh quan trí tuệ nhân tạo trong năm tới.

Dựa trên kinh nghiệm của tôi trong việc lãnh đạo một công ty khởi nghiệp trí tuệ nhân tạo và quan sát sự tiến hóa nhanh chóng của ngành công nghiệp, tôi tin rằng năm nay sẽ mang lại nhiều thay đổi cơ bản: từ các mô hình khái niệm lớn (LCMs) dự kiến sẽ xuất hiện như những đối thủ nghiêm túc với các mô hình ngôn ngữ lớn (LLMs), sự trỗi dậy của phần cứng trí tuệ nhân tạo chuyên dụng, đến các công ty công nghệ lớn bắt đầu xây dựng cơ sở hạ tầng trí tuệ nhân tạo lớn, điều này cuối cùng sẽ đặt họ vào vị trí để vượt qua các công ty khởi nghiệp như OpenAI và Anthropic – và, ai biết, có thể thậm chí bảo đảm sự độc quyền trí tuệ nhân tạo của họ sau tất cả.

Thử thách duy nhất của các công ty trí tuệ nhân tạo: Không phải là phần mềm hay phần cứng

Vấn đề cơ bản nằm ở cách các công ty trí tuệ nhân tạo hoạt động trong một vùng đất trung gian chưa từng thấy giữa các doanh nghiệp phần mềm truyền thống và phần cứng. Không giống như các công ty phần mềm thuần túy chủ yếu đầu tư vào vốn nhân lực với chi phí vận hành tương đối thấp, hoặc các công ty phần cứng thực hiện đầu tư vốn dài hạn với con đường rõ ràng đến lợi nhuận, các công ty trí tuệ nhân tạo phải đối mặt với một sự kết hợp độc đáo của các thách thức làm cho các mô hình tài trợ hiện tại của họ trở nên nguy hiểm.

Những công ty này yêu cầu chi tiêu vốn lớn ban đầu cho các cụm GPU và cơ sở hạ tầng, chi khoảng 100-200 triệu đô la mỗi năm cho tài nguyên tính toán alone. Tuy nhiên, không giống như các công ty phần cứng, họ không thể phân bổ những khoản đầu tư này trong các giai đoạn dài. Thay vào đó, họ hoạt động trong các chu kỳ nén 2 năm giữa các vòng tài trợ, mỗi lần cần phải chứng minh sự tăng trưởng theo cấp số nhân và hiệu suất tiên tiến để chứng minh sự đánh giá lại giá trị tiếp theo của họ.

Vấn đề phân biệt LLMs

Bổ sung vào thách thức cấu trúc này là một xu hướng đáng lo ngại: sự hội tụ nhanh chóng của khả năng mô hình ngôn ngữ lớn (LLM). Các công ty khởi nghiệp, như công ty kỳ lân Mistral AI và những công ty khác, đã chứng minh rằng các mô hình mã nguồn mở có thể đạt được hiệu suất tương đương với các mô hình mã nguồn đóng, nhưng sự khác biệt kỹ thuật mà trước đây đã chứng minh sự định giá cao là ngày càng khó duy trì.

Nói cách khác, trong khi mỗi mô hình LLM mới tự hào về hiệu suất ấn tượng dựa trên các tiêu chuẩn chuẩn, một sự thay đổi thực sự quan trọng trong kiến trúc mô hình cơ bản không diễn ra.

Các hạn chế hiện tại trong lĩnh vực này xuất phát từ ba khu vực quan trọng: sự sẵn có của dữ liệu, vì chúng ta đang cạn kiệt vật liệu đào tạo chất lượng cao (như được xác nhận bởi Elon Musk gần đây); phương pháp thu thập, vì chúng đều áp dụng các phương pháp phản hồi của con người tương tự được tiên phong bởi OpenAI; và kiến trúc tính toán, vì chúng phụ thuộc vào cùng một nhóm phần cứng GPU chuyên dụng hạn chế.

Điều đang xuất hiện là một mô hình trong đó lợi ích ngày càng đến từ hiệu quả chứ không phải quy mô. Các công ty đang tập trung vào việc nén nhiều kiến thức vào ít token hơn và phát triển các sản phẩm kỹ thuật tốt hơn, như hệ thống thu hồi tăng cường (retrieval-augmented generation). Về cơ bản, chúng ta đang tiếp cận một cao nguyên tự nhiên nơi việc ném nhiều tài nguyên hơn vào vấn đề mang lại lợi ích giảm dần.

Do tốc độ đổi mới chưa từng có trong hai năm qua, sự hội tụ của khả năng LLM đang diễn ra nhanh hơn bất kỳ ai dự đoán, tạo ra một cuộc đua chống lại thời gian cho các công ty đã huy động vốn.

Dựa trên các xu hướng nghiên cứu mới nhất, biên giới tiếp theo để giải quyết vấn đề này là sự xuất hiện của mô hình khái niệm lớn (LCMs) như một kiến trúc mới, đột phá cạnh tranh với LLMs trong lĩnh vực cốt lõi của chúng, đó là hiểu ngôn ngữ tự nhiên (NLP).

Về mặt kỹ thuật, LCMs sẽ có một số lợi thế, bao gồm khả năng hiệu suất tốt hơn với ít lần lặp lại và khả năng đạt được kết quả tương tự với các đội nhỏ hơn. Tôi tin rằng những LCM thế hệ tiếp theo này sẽ được phát triển và thương mại hóa bởi các đội spin-off, những người nổi tiếng ‘cựu công nghệ lớn’ thành lập các công ty khởi nghiệp mới để dẫn đầu cuộc cách mạng này.

Sự không phù hợp về thời gian tiền tệ hóa

Sự nén của các chu kỳ đổi mới đã tạo ra một vấn đề quan trọng khác: sự không phù hợp giữa thời gian đưa ra thị trường và tiền tệ hóa bền vững. Mặc dù chúng ta đang chứng kiến tốc độ chưa từng có trong việc dọc hóa các ứng dụng trí tuệ nhân tạo – với các đại lý giọng nói trí tuệ nhân tạo, ví dụ, đi từ khái niệm đến sản phẩm tạo doanh thu trong vài tháng – sự thương mại hóa nhanh chóng này che giấu một vấn đề sâu sắc hơn.

Hãy xem xét điều này: một công ty khởi nghiệp trí tuệ nhân tạo được định giá 20 tỷ đô la ngày nay sẽ cần phải tạo ra khoảng 1 tỷ đô la doanh thu hàng năm trong 4-5 năm để chứng minh việc niêm yết công khai tại một mức hợp lý. Điều này đòi hỏi không chỉ sự xuất sắc về công nghệ mà còn là sự chuyển đổi cơ bản của toàn bộ mô hình kinh doanh, từ tập trung vào nghiên cứu và phát triển sang bán hàng, tất cả trong khi duy trì tốc độ đổi mới và quản lý chi phí cơ sở hạ tầng khổng lồ.

Trong ý nghĩa đó, các công ty khởi nghiệp mới tập trung vào LCM sẽ xuất hiện trong năm 2025 sẽ ở trong vị trí tốt hơn để huy động vốn, với định giá ban đầu thấp hơn làm cho chúng trở thành mục tiêu tài trợ hấp dẫn hơn cho các nhà đầu tư.

Thiếu hụt phần cứng và các giải pháp thay thế mới

Hãy để chúng ta xem xét kỹ hơn về cơ sở hạ tầng. Ngày nay, mỗi cụm GPU mới được mua ngay cả trước khi nó được xây dựng bởi các người chơi lớn, buộc các người chơi nhỏ hơn phải cam kết với các hợp đồng dài hạn với các nhà cung cấp dịch vụ đám mây hoặc rủi ro bị loại khỏi thị trường hoàn toàn.

Nhưng điều thực sự thú vị là: trong khi mọi người đang chiến đấu vì GPU, đã có một sự thay đổi thú vị trong cảnh quan phần cứng mà vẫn chưa được chú ý nhiều. Kiến trúc GPU hiện tại, được gọi là GPGPU (GPU mục đích chung), vô cùng không hiệu quả cho những gì hầu hết các công ty thực sự cần trong sản xuất. Nó giống như sử dụng một siêu máy tính để chạy một ứng dụng máy tính.

Đây là lý do tại sao tôi tin rằng phần cứng trí tuệ nhân tạo chuyên dụng sẽ là sự thay đổi lớn tiếp theo trong ngành công nghiệp của chúng ta. Các công ty như Groq và Cerebras (CBRS ) đang xây dựng phần cứng chuyên dụng cho suy luận, rẻ hơn 4-5 lần để vận hành so với GPU truyền thống. Có, có chi phí kỹ thuật cao hơn ban đầu để tối ưu hóa các mô hình cho các nền tảng này, nhưng đối với các công ty chạy các khối lượng công việc suy luận lớn, lợi ích hiệu quả là rõ ràng.

Mật độ dữ liệu và sự trỗi dậy của các mô hình nhỏ hơn, thông minh hơn

Di chuyển đến biên giới đổi mới tiếp theo trong trí tuệ nhân tạo sẽ có thể đòi hỏi không chỉ sức mạnh tính toán lớn hơn – đặc biệt là cho các mô hình lớn như LCMs – mà còn đòi hỏi các tập dữ liệu phong phú và toàn diện hơn.

Thật thú vị, các mô hình nhỏ hơn, hiệu quả hơn đang bắt đầu thách thức các mô hình lớn hơn bằng cách tận dụng cách chúng được đào tạo dày đặc trên dữ liệu có sẵn. Ví dụ, các mô hình như Microsoft’s (MSFT ) FeeFree hoặc Google’s Gema2B, hoạt động với ít tham số hơn – thường khoảng 2 đến 3 tỷ – nhưng đạt được mức hiệu suất tương đương với các mô hình lớn hơn có 8 tỷ tham số.

Những mô hình nhỏ này đang trở nên cạnh tranh hơn vì mật độ dữ liệu cao của chúng, khiến chúng trở nên mạnh mẽ mặc dù kích thước của chúng. Sự chuyển dịch này hướng tới các mô hình nhỏ gọn nhưng mạnh mẽ phù hợp với lợi thế chiến lược mà các công ty như Microsoft và Google nắm giữ: khả năng tiếp cận các tập dữ liệu đa dạng khổng lồ thông qua các nền tảng như Bing và Google Search.

Động lực này tiết lộ hai “cuộc chiến” quan trọng đang diễn ra trong phát triển trí tuệ nhân tạo: một cuộc chiến về sức mạnh tính toán và một cuộc chiến về dữ liệu. Mặc dù tài nguyên tính toán là quan trọng để đẩy ranh giới, mật độ dữ liệu đang trở nên quan trọng không kém – nếu không muốn nói là quan trọng hơn. Các công ty có quyền truy cập vào các tập dữ liệu khổng lồ được đặt ở vị trí độc nhất để đào tạo các mô hình nhỏ với hiệu quả và độ bền không thể sánh được, củng cố sự thống trị của họ trong cảnh quan trí tuệ nhân tạo đang phát triển.

Ai sẽ thắng trong cuộc chiến trí tuệ nhân tạo?

Trong bối cảnh này, mọi người đều thắc mắc ai trong cảnh quan trí tuệ nhân tạo hiện tại được đặt ở vị trí tốt nhất để giành chiến thắng. Dưới đây là một số suy nghĩ.

Các công ty công nghệ lớn đã mua trước toàn bộ cụm GPU trước khi xây dựng, tạo ra một môi trường khan hiếm cho các người chơi nhỏ hơn. Đơn đặt hàng 100.000+ GPU của Oracle và các động thái tương tự của Meta và Microsoft thể hiện xu hướng này.

Với việc đầu tư hàng trăm tỷ đô la vào các sáng kiến trí tuệ nhân tạo, những công ty này đòi hỏi hàng nghìn kỹ sư và nhà nghiên cứu trí tuệ nhân tạo chuyên dụng. Điều này tạo ra một nhu cầu về tài năng chưa từng có mà chỉ có thể được đáp ứng thông qua các vụ mua lại chiến lược – có khả năng dẫn đến nhiều công ty khởi nghiệp bị hấp thụ trong những tháng tới.

Mặc dù năm 2025 sẽ được dành cho nghiên cứu và phát triển quy mô lớn và xây dựng cơ sở hạ tầng cho những người chơi này, nhưng vào năm 2026, họ sẽ ở trong vị trí để tấn công như chưa từng có nhờ vào nguồn lực không thể sánh được.

Điều này không có nghĩa là các công ty trí tuệ nhân tạo nhỏ hơn bị định đoạt – hoàn toàn không. Ngành công nghiệp sẽ tiếp tục đổi mới và tạo ra giá trị. Một số đổi mới chính trong ngành, như LCMs, có khả năng sẽ được dẫn dắt bởi các diễn viên mới nổi và nhỏ hơn trong năm tới, cùng với Meta, Google/Alphabet (GOOG ) và OpenAI với Anthropic, tất cả đều đang làm việc trên các dự án thú vị vào lúc này.

Tuy nhiên, chúng ta có khả năng sẽ chứng kiến một sự tái cấu trúc cơ bản về cách các công ty trí tuệ nhân tạo được tài trợ và định giá. Khi vốn đầu tư mạo hiểm trở nên chọn lọc hơn, các công ty sẽ cần phải chứng minh con đường rõ ràng đến kinh tế đơn vị bền vững – một thách thức cụ thể cho các doanh nghiệp mã nguồn mở cạnh tranh với các giải pháp độc quyền được tài trợ tốt.

Đối với các công ty trí tuệ nhân tạo mã nguồn mở cụ thể, con đường tiến về phía trước có thể đòi hỏi tập trung vào các ứng dụng dọc cụ thể nơi khả năng minh bạch và tùy chỉnh của họ cung cấp lợi thế rõ ràng so với các giải pháp độc quyền.

Jean-Louis Quéguiner là Người sáng lập và Giám đốc điều hành của Gladia. Ông trước đây từng là Phó Chủ tịch Tập đoàn Dữ liệu, Trí tuệ nhân tạo và Máy tính lượng tử tại OVHcloud, một trong những nhà cung cấp dịch vụ đám mây hàng đầu của châu Âu. Ông holds một Bằng Thạc sĩ về Trí tuệ nhân tạo biểu tượng từ Đại học Québec ở Canada và Arts et Métiers ParisTech ở Paris. Trong suốt sự nghiệp của mình, ông đã giữ các vị trí quan trọng trong nhiều ngành công nghiệp, bao gồm phân tích dữ liệu tài chính, ứng dụng học máy cho quảng cáo kỹ thuật số thời gian thực và phát triển các API Trí tuệ nhân tạo giọng nói.