Phỏng vấn
Hakob Astabatsyan, Đồng sáng lập & CEO của Synthflow – Loạt phỏng vấn

Hakob Astabatsyan, Đồng sáng lập và CEO của Synthflow, đang dẫn đầu sự phát triển của công nghệ giọng nói AI tiên tiến giúp các doanh nghiệp tự động hóa các cuộc gọi khách hàng với khả năng phản hồi giống con người. Đặt trụ sở tại Berlin, Hakob đã đồng sáng lập Synthflow vào năm 2023 với mục tiêu đưa công nghệ AI trò chuyện tiên tiến đến các công ty mọi quy mô.
Dưới sự lãnh đạo của ông, Synthflow đã nhanh chóng mở rộng trên toàn Đức và Mỹ, cho phép khách hàng trong lĩnh vực bất động sản, chăm sóc sức khỏe, tài chính và các ngành khác triển khai các đại lý giọng nói tùy chỉnh không cần mã trong vài tuần. Các đại lý AI này xử lý các cuộc gọi đến và đi, tích hợp với hơn 200 ứng dụng và CRM, và hoạt động với chi phí thấp và độ chính xác cao. Với sự tăng trưởng doanh thu nhanh chóng và đội ngũ toàn cầu ngày càng phát triển, Synthflow đang trở thành một nền tảng tự động hóa giọng nói hàng đầu – và Hakob đang ở tiền phong của sự mở rộng này.
Điều gì đã truyền cảm hứng cho bạn để bắt đầu Synthflow, và làm thế nào nền tảng của bạn với tư cách là một chiến lược gia và doanh nhân loạt đã ảnh hưởng đến sứ mệnh của công ty?
Khi chúng tôi bắt đầu Synthflow, giọng nói AI vẫn còn trong giai đoạn sơ khai, chỉ giới hạn ở các IVR robot và kịch bản mã hóa cứng. Nhưng sau khi làm việc trên nhiều công ty khởi nghiệp và dự án công nghệ, tôi có thể thấy một cơ hội sâu sắc hơn. Nền tảng của tôi với tư cách là một chiến lược gia đã dạy tôi cách nhận ra những khoảnh khắc khi một sự thay đổi trong cơ sở hạ tầng làm thay đổi một ngành, và đó chính xác là những gì các mô hình ngôn ngữ lớn đã làm cho giọng nói.
Chúng tôi biết rằng nếu chúng tôi có thể kết hợp AI tiên tiến với tương tác giọng nói thời gian thực, chúng tôi có thể biến đổi giao tiếp khách hàng. Sứ mệnh của chúng tôi để dân chủ hóa giọng nói AI không chỉ là một khẩu hiệu; đó là một phản ứng với khoảng trống thị trường. Ngôi sao Bắc đẩu của chúng tôi luôn là xây dựng tự động hóa giống con người dễ dàng triển khai, có thể mở rộng và bảo mật.
Sứ mệnh của bạn là “dân chủ hóa việc tiếp cận tự động hóa giọng nói AI.” Điều đó trông như thế nào trong thực tế đối với các doanh nghiệp nhỏ và vừa?
Dân chủ hóa giọng nói AI có nghĩa là loại bỏ các rào cản kỹ thuật và tài chính đã hạn chế việc tiếp cận công nghệ này. Cho dù bạn là một công ty khởi nghiệp đang mở rộng nhanh, một công ty vừa phải đang tìm cách hiện đại hóa giao tiếp khách hàng, hay một đội ngũ doanh nghiệp đang tìm cách tự động hóa, mục tiêu của chúng tôi là đưa tự động hóa giọng nói giống con người có thể triển khai trong vài ngày.
Đây là lý do tại sao chúng tôi xây dựng Synthflow như một nền tảng không cần mã. Thay vì dựa vào tài nguyên kỹ thuật hoặc tích hợp dài dòng, các đội ngũ trên bán hàng, hỗ trợ và vận hành có thể thiết kế và ra mắt các đại lý giọng nói thông qua một giao diện dựa trên trình duyệt đơn giản. Đó là một sự thay đổi từ AI được coi là một dự án R&D hậu trường thành một công cụ kinh doanh tiền tuyến.
Bạn có thể hướng dẫn chúng tôi qua quá trình xây dựng và triển khai một đại lý giọng nói từ đầu sử dụng các công cụ của bạn?
Điều đó thực sự rất trực quan. Giao diện không cần mã, dựa trên trình duyệt của chúng tôi cho phép người dùng kéo và thả các yếu tố để thiết kế một luồng cuộc gọi hoàn chỉnh từ lời chào đến theo dõi. Bạn có thể định nghĩa âm điệu, hành vi dự phòng và tích hợp với các hệ thống hiện có của mình như CRM hoặc lịch.
Chúng tôi xử lý mọi thứ sau hậu trường – chuyển đổi giọng nói sang văn bản, tổng hợp giọng nói, LLM và thiết lập cuộc gọi – để các đội ngũ có thể tập trung vào trải nghiệm, không phải là đường ống. Đó là cách chúng tôi đã kiếm được huy hiệu Triển khai Nhanh nhất của G2 cho Trợ lý AI trên toàn cầu, vì hầu hết khách hàng của chúng tôi đều chuyển từ không có gì sang trực tuyến trong dưới hai tuần.
Các đột phá nào đã cho phép bạn đạt được độ trễ giống con người dưới 500ms và thời gian hoạt động gần như hoàn hảo?
Đạt được độ trễ dưới 500ms là một cột mốc kỹ thuật quan trọng. Điều đó đòi hỏi sự kết hợp của tính toán biên, kiến trúc truyền trực tuyến thời gian thực và tối ưu hóa cấp mô hình. Chúng tôi đã tách lớp chuyển đổi giọng nói sang văn bản và văn bản sang giọng nói khỏi các suy luận LLM để đảm bảo xử lý song song bất cứ nơi nào có thể.
Về phía cơ sở hạ tầng, chúng tôi đã thiết kế cho sự tin cậy từ ngày đầu tiên – tận dụng tính dư thừa, định tuyến chuyển đổi và hệ thống đám mây phân tán để duy trì thời gian hoạt động ngay cả khi có khối lượng lớn. Ngày nay, chúng tôi xử lý hơn 40 triệu cuộc gọi mỗi tháng, và khách hàng của chúng tôi được hưởng lợi từ quy mô đã được thử nghiệm đó.
Làm thế nào Synthflow tránh được ảo giác và ở trong “hàng rào” an toàn cho thương hiệu trong suốt các cuộc trò chuyện?
Không giống như các rô-bốt trò chuyện chung chung cố gắng xử lý mọi thứ, các đại lý giọng nói của chúng tôi được xây dựng để có mục tiêu. Sự tập trung đó giảm đáng kể khả năng ảo giác. Nếu một đại lý được thiết kế để sắp xếp các cuộc gọi, nó đơn giản sẽ không phản hồi với các lời nhắc không liên quan như “kể cho tôi một câu chuyện” hoặc “thời tiết như thế nào.” Nó gắn bó với nhiệm vụ nó được tạo ra, giữ cho cuộc trò chuyện có mục đích và trên đường ray.
Ngoài ra, nền tảng của chúng tôi bao gồm một cơ sở kiến thức tích hợp cho phép bạn định nghĩa chính xác những gì đại lý nên biết – và quan trọng hơn, những gì nó không nên. Điều này làm cho việc giữ cho các cuộc trò chuyện an toàn cho thương hiệu, chính xác và liên quan trở nên dễ dàng, đồng thời cung cấp cho bạn quyền kiểm soát đầy đủ về cách AI xử lý thông tin.
Điều gì khiến người dùng tin tưởng một đại lý giọng nói AI, và những việc thường đi sai trong trải nghiệm khách hàng?
Sự tin tưởng đến từ tốc độ, liên quan và âm điệu. Nếu một AI phản hồi nhanh, hiểu ý định và nghe có vẻ tự nhiên, mọi người sẽ có nhiều khả năng tham gia. Chúng tôi đã xây dựng các tín hiệu con người tinh tế như khoảng ngừng và từ ngữ để làm cho các cuộc trò chuyện cảm giác thật.
Những việc thường đi sai khi AI cố gắng làm quá nhiều. Đó là lý do tại sao các đại lý của chúng tôi tập trung vào các nhiệm vụ cụ thể và chuyển tiếp khi cần. Điều đó không phải là làm mọi thứ – mà là làm những việc đúng đắn.
Đó được nói, chúng tôi biết một số người vẫn còn hoài nghi. Và điều đó là công bằng – mọi công nghệ mới đều đi qua giai đoạn đó. Với tư cách là một người tiên phong trong giọng nói AI, chúng tôi coi đó là công việc của mình không chỉ xây dựng công nghệ tuyệt vời, mà còn giúp mọi người cảm thấy tự tin khi sử dụng nó.
Làm thế nào bạn đảm bảo rằng các đại lý giọng nói Synthflow xử lý dữ liệu nhạy cảm một cách bảo mật trong khi tuân thủ HIPAA, SOC2 và GDPR?
Bảo mật và tuân thủ là cốt lõi của kiến trúc của chúng tôi. Chúng tôi được chứng nhận theo SOC 2 và GDPR, và hoạt động với các biện pháp bảo vệ HIPAA cho khách hàng chăm sóc sức khỏe. Điều này bao gồm mã hóa dữ liệu khi nghỉ và trong quá trình truyền, kiểm soát truy cập dựa trên vai trò, nhật ký kiểm tra và các khuôn khổ đồng ý được tích hợp vào luồng cuộc gọi.
Vai trò của con người vẫn còn trong Synthflow – và nơi nào là sự hợp tác giữa con người và AI quan trọng nhất?
Con người sẽ luôn đóng một vai trò quan trọng. Synthflow không ở đây để thay thế con người, chúng tôi ở đây để làm cho họ tốt hơn trong công việc của mình. Các đại lý giọng nói AI của chúng tôi xử lý các cuộc gọi lặp đi lặp lại, cho phép các đội ngũ con người tập trung vào những gì họ làm tốt nhất: xử lý các cuộc trò chuyện phức tạp, tình cảm và có tác động cao.
Chúng tôi nghĩ rằng tương lai của giao tiếp khách hàng giống như một cuộc tiếp sức. AI chạy phần đầu của cuộc trò chuyện – nắm bắt ý định, thu thập chi tiết, xử lý các hành động thường xuyên. Khi mọi thứ trở nên phức tạp hơn, nó chuyển giao cho một con người với toàn bộ ngữ cảnh để họ có thể tiếp tục một cách liền mạch. Loại hợp tác giữa con người và AI đó tạo ra những trải nghiệm tốt hơn cho cả hai bên của cuộc trò chuyện.
Bạn đặt trụ sở tại Berlin. Hệ sinh thái công nghệ châu Âu ảnh hưởng đến chiến lược phát triển của Synthflow như thế nào, đặc biệt là xung quanh quyền riêng tư và quy định AI?
Đặt trụ sở tại châu Âu, đặc biệt là tại Berlin, đã làm sắc nét sự tập trung của chúng tôi vào quyền riêng tư, AI đạo đức và phát triển tuân thủ. Khách hàng châu Âu đòi hỏi các tiêu chuẩn cao, và chúng tôi đã chấp nhận điều đó như một lợi thế cạnh tranh. Kiến trúc của chúng tôi được thiết kế để có chủ quyền về dữ liệu và sẵn sàng cho quy định, điều này đặt chúng tôi vào vị trí tốt khi các quy định AI toàn cầu được thắt chặt.
Berlin cũng cung cấp một nhóm tài năng duy nhất. Nó đã giúp chúng tôi phát triển một cách có suy nghĩ trong khi vẫn giữ được niềm tin, điều này là thiết yếu khi sản phẩm của bạn nói trực tiếp với khách hàng thay mặt cho một thương hiệu.
Bạn nhìn thấy tương lai của các đại lý giọng nói AI đang đi tới đâu – và xu hướng nào trong AI doanh nghiệp hiện đang bị đánh giá thấp?
Tương lai đang tăng tốc nhanh hơn bất kỳ ai dự đoán. Trong vài năm tới, tôi tin rằng hơn một nửa tất cả các tương tác giọng nói B2B sẽ được thúc đẩy bởi AI, và chúng tôi đã bắt đầu thấy những dấu hiệu của các cuộc trò chuyện AI-to-AI quản lý các quy trình làm việc hoàn chỉnh.
Một xu hướng bị đánh giá thấp là sự trỗi dậy của việc dàn xếp AI không cần mã và mã thấp. Mọi người đều nói về các mô hình, nhưng khóa thật sự đến khi các doanh nghiệp có thể triển khai và lặp lại các giải pháp AI mà không cần viết mã. Và chúng tôi rất hào hứng khi trở thành một phần của làn sóng đó.
Cảm ơn bạn vì cuộc phỏng vấn tuyệt vời, những người đọc muốn tìm hiểu thêm nên truy cập Synthflow.












