Моделі та платформи ШІ

Microsoft представила Phi-3: потужні відкриті моделі AI, що забезпечують найвищу продуктивність при малих розмірах

mm
Додайте Unite.AI до бажаних джерел у Google

Microsoft (MSFT ) представила Phi-3, нову сім’ю маленьких мовних моделей (SLM), які мають забезпечувати високу продуктивність і ефективність витрат у застосуваннях AI. Ці моделі показали сильні результати по різних стандартах у розумінні мови, висновках, кодуванні та математиці у порівнянні з моделями подібного та більшого розміру. Випуск Phi-3 розширює варіанти, доступні розробникам та підприємствам, які бажають використовувати AI, збалансувавши ефективність та витрати.

Сім’я моделей Phi-3 і їх доступність

Першою моделлю у лінійці Phi-3 є Phi-3-mini, модель з 3,8 млрд параметрів, яка зараз доступна на Azure AI Studio, Hugging Face та Ollama. Phi-3-mini поставляється з інструкціями, що дозволяє використовувати її “з коробки” без довготривалого доопрацювання. Вона має контекстне вікно до 128 К токенів, найдовше у своєму класі, що дозволяє обробляти більші текстові вхідні дані без втрати продуктивності.

Для оптимізації продуктивності на різних апаратних конфігураціях Phi-3-mini була доопрацьована для ONNX Runtime та NVIDIA GPU. Microsoft планує розширити сім’ю моделей Phi-3 найближчим часом випуском Phi-3-small (7 млрд параметрів) та Phi-3-medium (14 млрд параметрів). Ці додаткові моделі забезпечать ширший спектр варіантів для задоволення різних потреб та бюджетів.

Зображення: Microsoft

Продуктивність та розвиток Phi-3

Microsoft повідомляє, що моделі Phi-3 показали суттєві покращення продуктивності порівняно з моделями такого ж та більшого розміру по різних стандартах. За даними компанії, Phi-3-mini перевершує моделі вдвічі більші за розміром у завданнях розуміння та генерації мови, тоді як Phi-3-small та Phi-3-medium перевершують значно більші моделі, такі як GPT-3.5T, у певних оцінках.

Microsoft заявляє, що розробка моделей Phi-3 здійснювалася згідно з принципами та стандартами відповідальної AI компанії, які підкреслюють відповідальність, прозорість, справедливість, надійність, безпеку, конфіденційність, безпеку та інклюзивність. Моделі пройшли навчання з безпеки, оцінки та червоних команд для забезпечення відповідальної практики розгортання AI.

Зображення: Microsoft

Потенційні застосування та можливості Phi-3

Сім’я моделей Phi-3 розроблена для успішної роботи у сценаріях, де обмежені ресурси, низька затримка є суттєвою, або ефективність витрат є пріоритетом. Ці моделі мають потенціал для реалізації висновків на пристрої, що дозволяє застосункам AI працювати ефективно на широкому спектрі пристроїв, включаючи ті, які мають обмежену обчислювальну потужність. Менший розмір моделей Phi-3 також може зробити доопрацювання та налаштування більш доступними для підприємств, дозволяючи їм адаптувати моделі до своїх конкретних випадків використання без високих витрат.

У випадках, коли швидкі часи відповіді є критичними, моделі Phi-3 пропонують перспективне рішення. Їх оптимізована архітектура та ефективна обробка можуть забезпечити швидке генерацію результатів, покращуючи досвід користувача та відкриваючи можливості для взаємодії з AI в реальному часі. Крім того, сильні можливості висновків та логіки Phi-3-mini роблять її добре придатною для аналітичних завдань, таких як аналіз даних та генерація інсайтів.

По мірі появи реальних застосунків моделей Phi-3, потенціал цих моделей для стимулювання інновацій та надання доступу до AI стає все більш очевидним. Сім’я моделей Phi-3 представляє собою етап у демократизації AI, наділяючи підприємства та розробників можливістю використовувати потужність моделей мови, зберігаючи при цьому ефективність та ефективність витрат.

З випуском Phi-3, Microsoft розширює межі того, що можливо з малими мовними моделями, прокладаючи шлях до майбутнього, де AI може бути безшовно інтегровано у широкий спектр застосунків та пристроїв.

Alex очолює новинний підрозділ Unite.AI, що працює на базі ШІ, поєднуючи журналістику, дослідження та автоматизацію для підтримки своєчасного та масштабованого висвітлення штучного інтелекту. Його робота допомагає забезпечити ефективне виявлення нових розробок ШІ, зберігаючи редакційні стандарти видання.