Phỏng vấn

Brian Hartzband, Chủ tịch Hoạt động tại Hoa Kỳ, GMEX Robotics – Loạt Phỏng vấn

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Brian Hartzband, Chủ tịch Hoạt động tại Hoa Kỳ, GMEX Robotics, dẫn dắt việc mở rộng tại Hoa Kỳ của công ty, tập trung vào việc xây dựng dấu chân thương mại, phát triển các quan hệ đối tác chiến lược và đưa các nền tảng AI vật lý và robot vào triển khai thực tế. Trước khi gia nhập GMEX Robotics, Hartzband đã dành gần bốn năm tại TEKsystems trong các vai trò tuyển dụng kỹ thuật và quản lý tài khoản phục vụ khách hàng chính phủ và giáo dục đại học. Trước đó, ông đồng sáng lập và giúp lãnh đạo Handcrafted 4 Home, nơi ông thúc đẩy mở rộng thị trường Hoa Kỳ và các quan hệ đối tác với các nhà bán lẻ lớn và nền tảng thương mại điện tử. Ở giai đoạn đầu sự nghiệp, Hartzband làm việc trong quản lý tài sản tại Merrill Lynch và UBS, nơi ông tư vấn cho các khách hàng có tài sản cao và siêu cao, và giúp xây dựng một danh mục khách hàng quốc tế đáng kể.

GMEX Robotics là một công ty AI vật lý và robot niêm yết trên Nasdaq, phát triển các máy thông minh cho môi trường thương mại. Trước đây được biết đến với tên Fitell Corporation, công ty theo cách tiếp cận mà họ mô tả là “Terminal + Brain”, kết hợp phần cứng robot được thiết kế riêng với khả năng AI linh hoạt thay vì dựa vào một nền tảng công nghệ hoàn toàn tích hợp dọc. Mục tiêu thương mại hóa lớn đầu tiên của họ là 2F Culinary AI, một nền tảng robot nhà bếp thương mại bao gồm các hệ thống Bon Vivant 3.0 và Max, sử dụng cảm biến, điều khiển dựa trên AI và quy trình làm việc có thể lập trình để tự động hoá quá trình chuẩn bị thực phẩm. GMEX cũng đã xác định vận tải và logistics, tự động hoá công nghiệp, và khai thác tài nguyên là các lĩnh vực mở rộng dài hạn. Vào tháng 3 năm 2026, công ty công bố một thỏa thuận trị giá AU$4.2 million, bao gồm ít nhất 50 hệ thống robot nhà bếp thông minh cho một tập đoàn khách sạn tại Úc, tiếp theo là đơn đặt hàng triển khai đầu tiên vào tháng 5.

Bạn mới gia nhập GMEX Robotics với vai trò Chủ tịch Hoạt động tại Hoa Kỳ sau một sự nghiệp trải dài trong lĩnh vực dịch vụ tài chính, khởi nghiệp, tuyển dụng công nghệ và quan hệ doanh nghiệp. Điều gì thuyết phục bạn rằng AI vật lý và robot là chương tiếp theo phù hợp, và những ưu tiên của bạn khi xây dựng sự hiện diện của GMEX tại Hoa Kỳ là gì?

Tôi nhận thấy giá trị của AI và robot, đặc biệt là trong lĩnh vực trí tuệ xã hội, đang diễn ra ngay hiện tại. Tôi muốn đóng góp vào đó. Điều khiến tôi hào hứng về GMEX là mô hình Terminal + Brain. Chúng tôi không cố gắng tự làm mọi thứ. Chúng tôi xây dựng phần cứng đáng tin cậy và thực tế, và kết nối nó với AI hàng đầu. Đó là một cách tiếp cận hoàn toàn khác so với cách hầu hết các công ty robot hoạt động. Hiện tại tôi đang nói chuyện với các nhà đầu tư về những gì chúng tôi thực sự đang xây dựng và thiết lập các quan hệ đối tác quan trọng tại Hoa Kỳ. Đây là thời điểm thích hợp cho việc này.

GMEX mô tả chiến lược của mình là một hệ sinh thái \”Terminal + Brain\” trong đó phần cứng robot kết nối thế giới vật lý với lớp trí tuệ AI. Bạn có thể giải thích cách kiến trúc này hoạt động và những gì bạn cho rằng làm nó khác biệt so với các cách tiếp cận tích hợp dọc hơn trong lĩnh vực robot không?

Hầu hết các công ty robot cố gắng tự xây dựng mọi thứ; phần cứng, phần mềm, AI. Điều đó tốn kém và chậm chạp. Chúng tôi làm khác đi. Terminal là phần cứng của chúng tôi. Brain là lớp điều phối AI, mà chúng tôi xây dựng thông qua các quan hệ đối tác như 247meta. Lợi thế là tính linh hoạt. Nếu có AI tốt hơn xuất hiện, chúng tôi tích hợp mà không cần xây dựng lại robot. Chúng tôi không bị ràng buộc vào một lựa chọn duy nhất. Chúng tôi tập trung vào những gì chúng tôi giỏi nhất; phần cứng đáng tin cậy và thực tiễn, và hợp tác với AI hàng đầu thay vì cố gắng vượt qua mọi đối thủ về công nghệ một mình. Điều này đồng nghĩa với việc lặp lại nhanh hơn, vốn thấp hơn, và chúng tôi di chuyển với tốc độ đổi mới AI, không phải thời gian của kỹ thuật cơ khí.

GMEX đã ký một thỏa thuận để mua cổ phần ban đầu trong MediaMeta.ai, công nghệ của họ tập trung vào trí tuệ xã hội và mô hình hành vi con người. “Trí tuệ xã hội” có nghĩa là gì trong bối cảnh một robot, và những khả năng mới nào nó có thể mở ra mà các mô hình AI đa phương tiện hiện nay không thể cung cấp một cách đáng tin cậy?

Trí tuệ xã hội có nghĩa là những robot suy nghĩ về con người, không chỉ về nhiệm vụ. AI hiện nay rất mạnh về thị giác, ngôn ngữ và suy luận. Nhưng nó yếu trong việc đọc hiểu một người, trạng thái cảm xúc của họ, những gì họ thực sự cần, và cách làm việc cùng họ trong môi trường thực tế. Chúng tôi đã ký một thỏa thuận xác định với MediaMeta vì việc họ tập trung vào mô hình hành vi con người giải quyết đúng khoảng trống này. Đó là hướng mà lộ trình dài hạn của MediaMeta đang hướng tới, phát triển AI trí tuệ xã hội và mô hình hành vi như một lớp hiểu ngữ cảnh có thể cuối cùng bổ sung cho hệ sinh thái Terminal + Brain của chúng tôi. Tùy thuộc vào việc phát triển, tích hợp và thử nghiệm, những khả năng này có thể giúp robot giải thích ngữ cảnh, mô hình giao tiếp và ý định của con người, điều này là sự khác biệt giữa một robot chỉ hoàn thành nhiệm vụ và một robot thực sự hữu ích.

Ở đâu mà các robot tiên tiến nhất hiện nay vẫn gặp khó khăn khi giải thích con người? Các hạn chế lớn nhất là về việc nhận biết cảm xúc và ý định, hiểu ngữ cảnh xã hội, thích nghi với sự khác biệt văn hoá, hay là điều gì đó cơ bản hơn?

Tất cả những điều trên. Nhưng vấn đề thực sự là việc phát triển AI đã tối ưu cho việc hoàn thành nhiệm vụ—liệu robot có thể nhặt vật, di chuyển trong phòng không? Điều đó có thể đo lường được. Đọc người thì không. Vì vậy nó nhận được ít sự chú ý hơn. Robot có thể nhận ra ai đó trông buồn bã, nhưng chúng yếu trong việc hiểu tại sao họ buồn và điều gì thực sự giúp ích. Ngay cả những sai lầm nhỏ cũng làm giảm niềm tin. Một robot đạt 90% các tín hiệu xã hội đúng nghe có vẻ tốt trong môi trường thử nghiệm, nhưng trong thực tế, 10% còn lại lại quan trọng. Mọi người quyết định không muốn làm việc với máy đó. Chúng tôi cần đảo ngược ưu tiên. Đó là những gì chúng tôi đang xây dựng tại GMEX.

Một robot hoạt động trong nhà kho thường có thể hoạt động trong các quy tắc tương đối có cấu trúc, trong khi một robot trong bệnh viện, khách sạn, trường học hoặc nhà ở phải đối mặt với hành vi con người khó đoán hơn nhiều. Ngăn xếp AI cần thay đổi như thế nào khi robot chuyển sang những môi trường xã hội phức tạp hơn này?

Trí tuệ xã hội. Trong một nhà kho, bạn có thể mã hoá các quy tắc. Môi trường dự đoán được. Khi bạn đưa một robot vào không gian có người, mọi thứ thay đổi. Con người ứng biến, thay đổi quyết định, có những ngày không tốt. AI cần đọc được điều đó trong thời gian thực và thích nghi. Nó không còn dựa trên quy tắc nữa. Nó dựa trên ngữ cảnh. Robot phải hiểu khoảnh khắc, con người, môi trường và quyết định điều hợp lý. Điều đó đòi hỏi kết nối nhanh và một kiến trúc hoàn toàn khác ở tầng dưới. Nó cũng cần biết khi nào nên yêu cầu trợ giúp thay vì đoán sai.

Việc mô hình hành vi con người không thể tránh khỏi việc đặt ra các câu hỏi về quyền riêng tư, sự đồng ý, thiên vị và việc hiểu sai ý định của con người. Các nhà phát triển nên xây dựng trí tuệ xã hội vào robot như thế nào mà không tạo ra những máy móc trở nên quá xâm phạm hoặc đưa ra những giả định có thể gây hậu quả đối với con người?

Cuối cùng, việc xây dựng trí tuệ xã hội vào robot là để chúng hữu ích mà không gây kỳ quặc. Robot không nên phân tích tâm lý con người hay đoán ý nghĩa mà ai đó “định” muốn nói—đó là cách gây ra các vấn đề về quyền riêng tư và những giả định sai lầm. Hãy chỉ dựa vào những gì có thể quan sát được: cách người di chuyển, khoảng cách họ giữ, các cử chỉ. Cung cấp cho người kiểm soát với các dấu hiệu quyền riêng tư rõ ràng và các tương tác đồng ý đơn giản. Giữ dấu chân dữ liệu nhỏ, xử lý cục bộ khi có thể, và kiểm toán hành vi để nó đối xử công bằng với mọi người. MediaMeta đang chuẩn hoá một khung Bảo vệ Dữ liệu và AI Có Trách Nhiệm nhằm bao phủ việc giảm thiểu dữ liệu, tính minh bạch, đánh giá thiên vị, giám sát con người và khả năng truy xuất. Đó là cách tiếp cận suy nghĩ mà chúng tôi muốn tích hợp vào hệ thống của mình. Nếu robot không chắc người muốn gì, nó nên chậm lại, tạo không gian, hoặc tạm dừng. Đó là cách xây dựng nhận thức xã hội mà không vượt quá ranh giới.

Bạn thực sự đánh giá như thế nào để biết một robot đã cải thiện khả năng hiểu con người chưa? Loại tiêu chuẩn, mô phỏng hoặc thử nghiệm thực tế nào cần thiết để đo lường trí tuệ xã hội thay vì chỉ xem robot có hoàn thành nhiệm vụ thành công hay không?

Bạn không thể chỉ nhìn vào việc robot có hoàn thành nhiệm vụ hay không. Bạn phải xem các hành vi vi mô: robot có tạo khoảng cách thoải mái không, có nhường đường khi ai đó bước vào đường đi của nó không, di chuyển với thời gian phù hợp, có do dự khi ý định không rõ ràng không? Trong mô phỏng, bạn áp lực kiểm tra với đám đông dày đặc, dừng đột ngột, cử chỉ mơ hồ. Trong thực tế, bạn quan sát liệu robot có cảm giác dự đoán được và thoải mái với những người xung quanh không, và liệu nó có hành xử nhất quán giữa các nhóm khác nhau. Đó là tiêu chuẩn thực sự, không phải chỉ hoàn thành nhiệm vụ, mà là liệu con người có cảm thấy robot “hiểu” cách di chuyển và phối hợp trong không gian chung hay không.

GMEX đã bắt đầu thương mại hoá nền tảng robot nấu ăn Bon Vivant. Những triển khai thực tế ban đầu đã dạy công ty gì về khoảng cách giữa việc trình diễn một robot được hỗ trợ bởi AI và vận hành nó một cách đáng tin cậy trong môi trường thương mại?

Có một khoảng cách thực sự giữa việc chứng minh một robot có thể thực hiện một nhiệm vụ và chứng minh nó có thể thực hiện nhiệm vụ đó một cách đáng tin cậy, ngày này qua ngày khác, trong môi trường thương mại. Trong một buổi demo, mọi thứ đều được kiểm soát. Các nhà bếp thực tế có nhiệt độ cao, khối lượng lớn, thiết bị không thể đoán trước được va chạm, nguyên liệu thay đổi, con người liên tục thay đổi nhịp độ. Bon Vivant là cố định, vì vậy thách thức không phải là việc định vị; mà là tính lặp lại, độ bền, khả năng phục hồi lỗi và duy trì tích hợp với quy trình làm việc hiện có. Chúng tôi đã học được rằng độ tin cậy đến từ việc xử lý những thứ “nhàm chán”: chịu được nhiệt và dầu mỡ, duy trì hiệu chuẩn, phục hồi một cách duyên dáng khi có sự cố, giữ tốc độ mà không làm chậm con người. Robot công nghiệp không chỉ là chứng minh robot có thể nấu ăn. Đó là chứng minh nó có thể nấu ăn một cách nhất quán, an toàn, mà không trở thành gánh nặng trong một doanh nghiệp thực tế.

GMEX cũng đang phát triển một nền tảng AI đa‑đại lý được thiết kế để điều phối các mô hình và quy trình làm việc khác nhau. Bạn nhìn nhận như thế nào về việc các đại lý AI kỹ thuật số và robot vật lý cuối cùng sẽ hội tụ, và liệu lớp trí tuệ chung có thể cuối cùng điều phối cả các đại lý phần mềm và các đội máy móc không?

Các tác nhân AI kỹ thuật số và robot vật lý sẽ ngày càng hội tụ quanh một lớp phối hợp chung. Các tác nhân phần mềm có thể diễn giải yêu cầu và quản lý quy trình công việc kỹ thuật số. Robot thực hiện các nhiệm vụ trong thế giới vật lý. Một lớp trí tuệ chung kết nối hai bên bằng cách chuyển đổi mục tiêu kinh doanh thành các nhiệm vụ, lựa chọn mô hình và tác nhân phù hợp, và điều phối thực thi. Sự khác biệt then chốt là phối hợp so với kiểm soát: lớp chung quyết định những gì cần xảy ra và ai sẽ thực hiện, trong khi các hệ thống riêng của robot vẫn chịu trách nhiệm về định vị, điều khiển chuyển động và an toàn. Trong một kho hàng, ví dụ, các tác nhân phần mềm xử lý đơn hàng và kiểm tra tồn kho, trong khi lớp phối hợp yêu cầu một robot thích hợp di chuyển hàng hoá. Phản hồi này lại được đưa ngược lại và thông báo bước tiếp theo. Giám sát của con người và các cơ chế an toàn vẫn luôn cần thiết. Đó là nơi chúng tôi tập trung với 247meta – một lộ trình có giai đoạn qua tích hợp giao diện, mô phỏng và các dự án thí điểm có kiểm soát để hỗ trợ các quy trình làm việc phối hợp giữa phần mềm doanh nghiệp và máy móc vật lý.

Nếu trí tuệ xã hội trở thành lớp nền tảng của AI vật lý, bạn cho rằng nó sẽ thay đổi gì trong ngành công nghiệp robot? Liệu việc hiểu hành vi con người cuối cùng có quan trọng bằng những tiến bộ về độ khéo léo, thị giác máy tính và suy luận cho việc áp dụng robot rộng rãi không?

Trí tuệ xã hội sẽ tái định hình robot một cách căn bản. Ngành công nghiệp đã tập trung vào khả năng phần cứng, hệ thống thị giác, hiệu suất – tất cả đều quan trọng nhưng không gì đảm bảo robot hoạt động mượt mà quanh con người trong một căn bếp hay trên dây chuyền sản xuất. Trí tuệ xã hội là yếu tố khiến robot trở nên dự đoán được, dễ dàng di chuyển quanh, và phù hợp với cách con người tự nhiên di chuyển và phối hợp. Khi robot chuyển từ các buổi trình diễn có kiểm soát sang môi trường thương mại thực tế, phần này của hệ thống trở nên quan trọng không kém phần cứng và lớp điều khiển. Hiểu hành vi con người sẽ quan trọng tương đương với những tiến bộ trong nhận thức hay độ tin cậy. Đó là sự khác biệt giữa một robot có thể thực hiện công việc và một robot phù hợp với luồng hoạt động thực tế.

Cảm ơn bạn đã tham gia phỏng vấn tuyệt vời, độc giả muốn tìm hiểu thêm về công ty robot này nên truy cập GMEX Robotics.

Antoine là một nhà lãnh đạo có tầm nhìn và là đối tác sáng lập của Unite.AI, được thúc đẩy bởi niềm đam mê không ngừng nghỉ để định hình và quảng bá tương lai của AI và robot. Là một doanh nhân hàng loạt, ông tin rằng AI sẽ gây ra sự gián đoạn cho xã hội giống như điện, và thường được bắt gặp khi nói về tiềm năng của các công nghệ phá vỡ và AGI.

Là một nhà tương lai học, ông dành để khám phá cách những đổi mới này sẽ định hình thế giới của chúng ta. Ngoài ra, ông là người sáng lập của Securities.io, một nền tảng tập trung vào đầu tư vào các công nghệ tiên tiến đang định nghĩa lại tương lai và thay đổi toàn bộ lĩnh vực.