Моделі та платформи ШІ

Розширення можливостей розробників за допомогою OpenAI: спрощення створення агентів штучного інтелекту

mm
Додайте Unite.AI до бажаних джерел у Google

OpenAI недавно випустила набір нових інструментів для розробників, спрямованих на спрощення створення агентів штучного інтелекту, які можуть виконувати складні завдання автономно. Про оновлення було оголошено на минулому тижні, і воно включає в себе Responses API, відкритий Agents SDK та вбудовані інструменти для веб-пошуку, пошуку файлів та контролю комп’ютера – все це розроблено для спрощення взаємодії систем штучного інтелекту з реальними даними та додатками.

OpenAI описує цих агентів як “системи, які незалежно виконують завдання від імені користувачів”, тобто вони можуть виконувати багатоступеневі процеси – наприклад, дослідження теми або оновлення бази даних – з мінімальною участю людини. Метою компанії є зниження бар’єрів для розробників та підприємств у розгортанні потужних помічників штучного інтелекту, тим самим розширюючи доступ до передових можливостей штучного інтелекту.

Responses API: спрощення взаємодії агентів

У центрі оголошення OpenAI знаходиться новий Responses API, який служить уніфікованим інтерфейсом для створення агентів штучного інтелекту. Цей API об’єднує розмовні можливості Chat Completions API з функціональністю використання інструментів попереднього Assistants API. У практичному сенсі це означає, що один виклик API тепер може обробляти складні багатоступеневі завдання, які можуть включати виклик різних інструментів або джерел знань.

OpenAI заявляє, що Responses API був розроблений для спрощення розробки агентів шляхом зменшення потреби у власному коді та налаштуванні запитів. “Responses API призначений для розробників, які хочуть легко поєднати моделі OpenAI та вбудовані інструменти у свої додатки, без складності інтеграції кількох API або зовнішніх постачальників,” – пояснила компанія у своєму блог-пості. Раніше розробникам часто доводилося координувати кілька викликів API та створювати складні запити, щоб агент міг зробити щось корисне, що було складним та часоємним. З новим API агент може, наприклад, вести розмову з користувачем, шукати інформацію через веб-пошук, а потім складати підсумок – все це у рамках однієї робочої потоку.

Відзначимо, що Responses API доступний усім розробникам без додаткової оплати, крім стандартних плат за використання. Він також є зворотно-компатибельним: OpenAI підтвердила, що продовжить підтримку свого популярного Chat Completions API для простих випадків використання, тоді як старий Assistants API буде виведений з експлуатації до середини 2026 року, оскільки його функції будуть інтегровані у Responses API.

Відкритий Agents SDK спрощує оркестрацію робочих потоків

У рамках запуску також було представлено Agents SDK – інструментарій для управління робочими потоками одного або навіть декількох взаємодіючих агентів штучного інтелекту. У помітному русі OpenAI зробила цей SDK відкритим, дозволяючи розробникам та підприємствам переглядати код та навіть інтегрувати не-OpenAI моделі у свої системи агентів. Ця гнучкість означає, що компанія може координувати агента, який використовує модель GPT-4 від OpenAI, поряд з іншим агентом, який працює на іншій моделі штучного інтелекту, все це у рамках однієї структури.

Agents SDK зосереджений на оркестрації робочих потоків – тобто, відстежуванні того, що робить агент і як він передає завдання. Він надає вбудовані механізми для таких речей, як:

  • Конфігуровані агенти: налаштування агентів штучного інтелекту з попередньо визначеними ролями або інструкціями для конкретних завдань.
  • Інтелектуальна передача завдань: передача завдань між кількома агентами або процесами на основі контексту (наприклад, один агент збирає дані, а інший агент аналізує їх).
  • Безпекові обмеження: забезпечення того, щоб агент залишався у певних межах, з інструментами валідації введення та модерації контенту для запобігання нежаданих виходів.
  • Відстеження та спостереження: інструменти для моніторингу та налагодження дій агента крок за кроком, що допомагає розробникам зрозуміти рішення та покращити продуктивність.

Відповідно до заяв OpenAI, цей інструментарій може спрощувати складні випадки використання, такі як боти підтримки клієнтів, багатоступеневі дослідницькі помічники, робочі потоки генерації контенту, агенти перевірки коду чи автоматизація продажів. Відкриваючи джерельний код SDK, OpenAI також заохочує спільні внески та прийняття у корпоративному середовищі, де прозорість та можливість самої установки компонентів часто важливі. Ранні приймаючі компанії, такі як Coinbase та Box, вже експериментували з Agents SDK для створення дослідницьких інструментів штучного інтелекту та інструментів витягування даних.

Вбудовані інструменти підвищують функціональність штучного інтелекту

Для того, щоб зробити агентів штучного інтелекту більш функціональними з коробки, Responses API від OpenAI поставляється з трьома вбудованими інструментами, які підключають штучний інтелект до зовнішніх даних та дій. Ці інструменти суттєво розширюють те, що може зробити агент, виходячи за рамки простої генерації тексту.

Вбудовані інструменти, доступні на момент запуску, включають:

  • Веб-пошук: дозволяє агенту штучного інтелекту виконувати реальні веб-пошуки та отримувати актуальну інформацію, повну з посиланнями на джерела. Це означає, що агент може відповідати на питання, використовуючи останні новини чи факти з інтернету, та надавати посилання для прозорості. Цей інструмент корисний для створення агентів, таких як дослідницькі помічники, покупці чи плани подорожей, які потребують актуальної інформації.
  • Пошук файлів: дозволяє агенту швидко шукати у великих колекціях документів або даних, наданих розробником, для знаходження відповідної інформації. Це по суті інструмент приватного запиту до бази знань – агент може використовувати його для відповіді на питання підтримки клієнтів, шукаючи політичні документи, або допомагати у юридичних дослідженнях, витягуючи пасажі з бібліотеки файлів. Цей інструмент можна розгорнути у сценаріях, таких як боти підтримки клієнтів чи внутрішні корпоративні помічники, які потребують доступу до власної інформації.
  • Контроль комп’ютера: нова можливість (на даний момент у стадії дослідження), яка дозволяє агенту штучного інтелекту виконувати дії на комп’ютері, як би це робила людина. Цей інструмент дозволяє автоматизувати завдання, які не мають простого API – наприклад, введення даних у систему спадщини, клікання через веб-додаток для тестування чи перевірку інформації на графічному інтерфейсі.

Інтегруючи ці інструменти, агенти штучного інтелекту можуть не тільки думати над проблемою, але й діяти – чи то шукати інформацію, витягувати конкретні дані чи маніпулювати цифровим середовищем. Це суттєво розширює функціональність агента та робить його набагато кориснішим для реальних застосувань.

OpenAI бачить, що розробники будуть комбінувати ці інструменти за необхідністю; наприклад, агент може використовувати веб-пошук для збору публічної інформації та пошук файлів для витягування внутрішніх даних, а потім використовувати цю об’єднану інформацію для складання звіту чи виконання завдання. Все це можна оркеструвати через Responses API у уніфікованій манері, без потреби у окремих сервісах або ручній інтеграції.

Ширші наслідки для прийняття та доступності штучного інтелекту

Аналітики вважають, що цей запуск може прискорити прийняття агентів штучного інтелекту у різних галузях, знижуючи технічні бар’єри. Для підприємств привабливістю цих нових інструментів є можливість автоматизувати та масштабувати процеси без суттєвої розробки.

Рутинні завдання, такі як пошук інформації, обробка форм чи вхід даних між додатками – які раніше могли потребувати суттєвого програмування чи кількох програмних систем – тепер потенційно можуть бути оброблені агентами штучного інтелекту, використовуючи будівельні блоки OpenAI. Вбудовані інструменти пошуку, наприклад, дозволяють компаніям підключити штучний інтелект до своїх баз знань чи інтернету майже миттєво, а інструмент контролю комп’ютера пропонує спосіб взаємодії з програмами, які не мають API. Тоді як відкритий характер Agents SDK дає підприємствам більше контролю, дозволяючи їм інтегрувати цих агентів штучного інтелекту у свою інфраструктуру та навіть використовувати різні моделі штучного інтелекту за необхідності.

Рух OpenAI є частиною більшої гонки за надання розробникам можливостей створення агентів. Конкурентні технологічні компанії та стартапи випускають свої власні платформи агентів штучного інтелекту, і комплексний інструментарій OpenAI може допомогти їй виділитися. Насправді, час випуску збігається з зростанням інтересу до автономних агентів штучного інтелекту у світі – наприклад, китайський стартап Monica недавно привернув увагу своїм агентом Manus, який, як стверджується, може перевершити прототип агента OpenAI у певних завданнях. Відкриваючи джерельний код ключових частин своєї платформи та надаючи вбудовані інструменти, OpenAI, здається, реагує на конкурентний тиск, одночасно сприяючи ширшому прийняттю штучного інтелекту.

З погляду доступності ці інструменти можуть демократизувати можливість створення агентів штучного інтелекту. Менші компанії та навіть окремі розробники тепер можуть знайти можливим створити агента штучного інтелекту чи робочий потік без потреби у великих дослідницьких командах. Інтегрований підхід (де один виклик API може обробляти кілька кроків) та наявність прикладів у документації OpenAI знижують бар’єр входу для новачків. OpenAI також надає інтерфейс спостереження для розробників, щоб відстежувати та інспектувати дії агента, що є важливим для налагодження та побудови довіри до виходів штучного інтелекту. Ця увага до зручності використання та безпеки (із обмеженнями та моніторингом) очікується заохотить більше підприємств експериментувати з агентами штучного інтелекту, знаючи, що вони мають контроль та нагляд.

Агенти штучного інтелекту можуть стати так само звичними та необхідними, як і наявність інтернет-присутності. Останні інструменти OpenAI, роблячи розробку агентів більш доступною, можуть допомогти втілити цю бачення у реальність, дозволяючи ширшій спільноті розробників та підприємств створювати自己的 агентів.

Alex очолює новинні операції Unite.AI, що працюють на базі ШІ, поєднуючи журналістику, дослідження та автоматизацію, щоб підтримувати своєчасне та масштабоване висвітлення штучного інтелекту. Його робота допомагає забезпечити ефективне виявлення нових розробок у сфері ШІ, зберігаючи редакційні стандарти видання.