Інтерв’ю
Ярек Кутиловський, засновник та генеральний директор DeepL – Серія інтерв’ю

Ярек Кутиловський є засновником і генеральним директором DeepL, просунутим інструментом перекладу на основі штучного інтелекту, відомим своєю вражаючою точністю та природною звучністю перекладів.
DeepL має на меті зруйнувати мовні бар’єри для підприємств у всьому світі. Більше 100 000 підприємств і урядів та мільйони осіб у 228 глобальних ринках довіряють платформі Language AI DeepL для перекладу, подібного до людського, і кращого письма. Розроблений з урахуванням безпеки підприємства, компанії по всьому світу використовують рішення DeepL, спеціально налаштовані для мови, щоб трансформувати ділові комунікації, розширювати ринки та підвищувати продуктивність. Заснована у 2017 році, DeepL сьогодні нараховує понад 1000 працівників і підтримується відомими інвесторами, включаючи Benchmark, IVP та Index Ventures.
Можете розповісти нам про ранню концепцію DeepL і як цілі компанії змінилися з моменту її заснування?
Коли я заснував компанію у 2017 році, ми були на поворотному етапі з глибоким навчання. Воно справді почало набирати популярність, що надихнуло на назву нашої компанії. У нас завжди була мета наділити організації можливістю процвітати і зростати глобально без мовних бар’єрів, що все ще є нашою місією сьогодні. Тому ми почали експериментувати з технологією та її застосуванням у мовній сфері, і швидко побачили, наскільки вона може бути потужною – було зрозуміло, що нейронні мережі та штучний інтелект будуть наступним великим проривом у перекладі, і що те, чого ми можемо досягти з нейронними мережами, значно перевищить традиційні рішення. З урахуванням цього ми вирішили упакувати свої знання у продукт і поділитися ним із світом.
Що почалося як веселий проект швидко перерос у щось більш значуще. Ліше через кілька місяців після офіційного запуску нашого першого продукту, DeepL Translate, у 2017 році, у нас були деякі з найважливіших європейських і німецьких компаній, які стукали у нашу двері, зацікавлені у впровадженні наших рішень. Це розуміння про актуальність і критичну важливість нашого продукту для великих організацій надихнуло нас глибше вивчити їхні проблеми та інвестувати час у справжнє розуміння того, як наша технологія могла б їх вирішити. Ми розробили більш конкретну комерційну стратегію та чіткі плани монетизації, зосередившись спочатку на випуску продукту для широкої громадськості та пізніше на бізнес-стороні. Перемотавши вперед до сьогодні, ми значно виросли, розширивши нашу команду, продукти та мережу клієнтів. Тепер у нас є мільйони індивідуальних користувачів наших спеціалізованих інструментів перекладу та письма на основі штучного інтелекту, а також понад 100 000 підприємств і урядів-партнерів у всьому світі, включаючи 50% компаній Fortune 500 і лідерів, таких як Nikkei (власник Financial Times), Coursera, Deutsche Bahn, Zendesk та інші.
Ви заснували DeepL у сфері, яка вже була домінована великими гравцями, такими як Google (GOOGL ) і Microsoft. Яка була ваша стратегія, щоб зайняти свою нішу у такому конкурентному ландшафті?
Ми були проти великої технології з моменту нашого заснування, що тримало нас мобільними, інноваційними та мотивованими пропонувати нашим користувачам найкраще рішення. Але я викликаю будь-кого, хто стверджує, що вони вирішили проблему мови для бізнесу та корпоративних випадків з загальними моделями – ось де DeepL виділяється і є справді унікальним у світі Language AI і перекладу.
Ми відрізняємося від загальних систем штучного інтелекту тим, що наші рішення перекладу та письма на основі штучного інтелекту спеціально розроблені для мовних випадків; ця спеціалізація дозволяє нам досягти вищої точності та точності, одночасно мінімізуючи галюцинації та дезінформацію. Одне дело перекласти меню під час відпустки – але більшість наших клієнтів – це підприємства та фахівці, де ставки значно вищі. Припустіть, що юрист потребує перекладу високо нюансових, критичних та конфіденційних юридичних документів; або великий медіа-видавець, який покладався на нашу платформу для перекладу тисяч історій на день, в режимі реального часу, які потім розповсюджуються мільйонам глобальних читачів. Ці складні випадки вимагають рівня точності, налаштування, захисту даних та безпеки, яких загальні моделі не можуть забезпечити. Захист даних і безпека також є центральними для нашої пропозиції, тому ми дотримуємося найвищих стандартів безпеки підприємства, включаючи державну криптографію та більше.
DeepL недавно запустив свій перший внутрішній LLM. Як ця модель відрізняється від інших великих мовних моделей на ринку, і в якому контексті вона вважається кращою?
Наші наступні покоління моделей перекладу працюють на основі власної технології LLM, розробленої спеціально для перекладу та редагування, що відрізняє її від інших моделей на ринку та встановлює новий стандарт галузі для якості та продуктивності перекладу. На відміну від загальних моделей, які покладаються виключно на публічні дані Інтернету, LLM DeepL користується більш ніж сімома роками власних даних, відібраних спеціально для створення контенту та перекладу. Вона також використовує навчання моделі людьми, з тисячами відібраних експертів з мови, які треновані для вдосконалення та покращення якості перекладу моделі.
Через це ми пишаємося тим, що DeepL широко вважається найбільш надійним і бажаним рішенням Language AI для підприємств та професіоналів. У сліпих тестах професійні перекладачі виявили, що наша наступна генерація LLM вимагає значно менше редагувань, ніж інші платформи, з Google та ChatGPT, які вимагають у два-три рази більше редагувань, щоб досягти тієї ж якості.
Можете пояснити процес навчання LLM DeepL? Яка кількість людського вводу потрібна для підтримання точності та нюансів у перекладі, і як ви балансуєте це з обчислювальними аспектами розвитку штучного інтелекту?
Ми тренуємо наш LLM на поєднанні високоякісних лінгвістичних даних, а також експертизи тисяч відібраних експертів з мови. Цей двосторонній підхід, який поєднує обчислювальні аспекти з людською обратною зв’язкою, дозволяє нам підтримувати наших клієнтів у масштабі, одночасно забезпечуючи, що якість та нюанси наших перекладів залишаються на рівні. Людський ввід є справді важливим, головним чином у кураторстві даних, оцінці якості та наданні зворотної зв’язки для безперервного покращення. Якість перекладу DeepL просто не була б там, де вона є сьогодні, без цього аспекту.
DeepL недавно розширився до 165 нових ринків і додав підтримку трьох нових мов. Яка була стратегічна думка за цією ціллю на ці ринки та мови, і як розширення вплинуло на базу користувачів DeepL?
Мова є глобальною проблемою, яка торкається підприємств майже у кожній галузі – чи то вони стикаються з мовними бар’єрами всередині серед колег, чи зовні з клієнтами та на різноманітних ринках, де вони працюють. І як дослідницька компанія, все, що ми робимо, ґрунтується на нашій місії зруйнувати мовні бар’єри, а також на зворотній зв’язі, який ми отримуємо від клієнтів та підприємств. Наше рішення про розширення доступності наших продуктів – DeepL Pro тепер доступний на 228 глобальних ринках – і додання нових мовних можливостей, таких як недавній запуск традиційного китайського, ґрунтується на нашій місії зруйнувати ці бар’єри, керуючись зворотною зв’язкою клієнтів та ринковими дослідженнями.
Ми зараз находимося в цікавий момент у сфері штучного інтелекту, де прийняття не просто тренд, а необхідність. Компанії готові прийняти штучний інтелект, але шукають технології, яка забезпечує реальну цінність та ROI, і ми довели, що здатні забезпечити значний вплив – дослідження Forrester 2024 року показало, що використання DeepL забезпечило 345% ROI для глобальних компаній, скоротивши час перекладу на 90%, одночасно забезпечуючи скорочення робочого навантаження на 50%. Розширюючи нашу охоплення та можливості, ми можемо забезпечити ці реальні вигоди ще більшому числу ринків, людей та підприємств. Наприклад, традиційний китайський – це основна мова для понад 33 мільйонів людей у світі. Тому це справді стимулює масштаб нашого бізнесу та допомагає нам задовольняти зростаючий попит у світі. Сьогодні у нас є мережа з понад 100 000 підприємств-клієнтів, і вона росте швидко.
З понад 100 000 клієнтів, включаючи великі організації, такі як Deutsche Bahn і Zendesk, які є основними проблемами та можливостями, з якими ви зустрічаєтеся під час масштабування для задоволення потреб підприємств та урядів?
Коли ми перебуваємо в кімнаті з клієнтом, вони зрозумілі щодо цінності та ROI, які ми можемо забезпечити їм – навіть у США, де ви можете подумати, що англійська мова є єдиною мовою, більшість компаній працюють з багатомовними командами та орієнтуються у складностях глобального ринку. Багато людей забувають про це! Цінність та вплив наших спеціалізованих інструментів перекладу та письма на основі штучного інтелекту очевидні. Тому це не питання про те, чи повинні вони впровадити інструменти мови штучного інтелекту, а питання про те, чи вони повинні використовувати наші спеціалізовані рішення. Підприємства часто дотримуються конкретних брендових керівних принципів і вимагають рішень штучного інтелекту, які відображають їхню унікальну брендову голос та галузеву термінологію. Вони хочуть能够 спілкуватися послідовно, як всередині, так і зовні, у масштабі – незалежно від того, чи пишуть вони щось або перекладають документ, вони хочуть, щоб контент звучав так, як ніби вони самі його написали, у своєму конкретному стилі бренду. У DeepL ми розробили свої інструменти з урахуванням цього та пропонуємо ряд більш інтерактивних функцій налаштування, включаючи DeepL Glossary, який дозволяє підприємствам та фахівцям налаштовувати переклади для конкретних слів та фраз; а також такі функції, як налаштування тону та більше. Цей рівень тонкого налаштування та можливість зробити контент своїм є тим, що справді важливо для наших клієнтів.
Як DeepL розширюється і його моделі штучного інтелекту використовуються ширше, які з ключових етичних питань ви пріоритезуєте під час розробки мовних систем штучного інтелекту, особливо при роботі з конфіденційною або секретною інформацією?
Будь-яка організація, яка розглядає інструменти штучного інтелекту, повинна завжди ставити ці питання при оцінці моделей та компаній. Багато рішень штучного інтелекту не забезпечують адекватної безпеки, часто діляться даними користувачів з третіми сторонами та тренують свої моделі штучного інтелекту на тексті користувача, створюючи недовіру та роблячи багатьох користувачів неохочими використовувати ці інструменти з робочими документами. Як я вже згадував раніше, DeepL підходить до цього інакше – безпека є центральною для нашої місії та пропозиції продукту.
Наші клієнти походять з широкого спектра галузей, включаючи високорегульовані галузі, такі як фінансові послуги та юридична, і конфіденційність та безпека їхніх даних є життєво важливими. Це є центральним для нашої пропозиції продукту, що ми дотримуємося найвищих стандартів безпеки підприємства для захисту даних користувачів, включаючи державну криптографію, GDPR, ISO 27001 та Soc2 Type 2. Ми також не використовуємо жодного тексту від наших абонентів для покращення або навчання наших моделей штучного інтелекту, розуміючи, що багато наших користувачів перекладають конфіденційну інформацію.
Чого ми можемо очікувати далі від DeepL у плані розробки продукту? Чи є якісь великі функції чи інновації, про які ви особливо збуджені?
Ми є дослідницькою компанією штучного інтелекту, орієнтованою на інновації з метою, і нашою метою є вирішення мовної проблеми для людей та підприємств у всьому світі. Оглядаючи майбутнє, ми продовжимо включати зворотню зв’язку клієнтів у наш розвиток та зосередимося на розширенні можливостей нашої платформи Language AI, щоб зробити її ще більш комплексним рішенням для всіх мовних бізнес-потреб. Багато того, про що ми зараз чуємо від клієнтів, полягає в тому, що чим більше інтерактивності та персоналізації ми можемо забезпечити, тим краще. Тому розширення наших функцій та можливостей для задоволення цього є справді цікавою областю для нас, розглядаючи, як зробити досвід DeepL ще більш динамічним та привабливим для наших користувачів.
За наступні 5-10 років, де ви бачите технологію DeepL у більш широкому ландшафті штучного інтелекту, особливо коли штучний інтелект продовжує швидко розвиватися?
5 років – це справді довгий час для розвитку штучного інтелекту, тому мені справді важливо наступний рік! Ми працюємо над тим, щоб принести ту саму революцію та розрив, який ми зробили з написаною мовою, до інших багатомодальних можливостей, про які я справді збуджений.
Дякую за велике інтерв’ю, читачам, які бажають дізнатися більше, слід відвідати DeepL.












