Моделі та платформи ШІ
Microsoft представила Phi-3: потужні відкриті моделі AI, що забезпечують найвищу продуктивність при малих розмірах
Microsoft (MSFT ) представила Phi-3, нову сім’ю маленьких мовних моделей (SLM), які мають забезпечувати високу продуктивність і ефективність витрат у застосуваннях AI. Ці моделі показали сильні результати по різних стандартах у розумінні мови, висновках, кодуванні та математиці у порівнянні з моделями подібного та більшого розміру. Випуск Phi-3 розширює варіанти, доступні розробникам та підприємствам, які бажають використовувати AI, збалансувавши ефективність та витрати.
Сім’я моделей Phi-3 і їх доступність
Першою моделлю у лінійці Phi-3 є Phi-3-mini, модель з 3,8 млрд параметрів, яка зараз доступна на Azure AI Studio, Hugging Face та Ollama. Phi-3-mini поставляється з інструкціями, що дозволяє використовувати її “з коробки” без довготривалого доопрацювання. Вона має контекстне вікно до 128 К токенів, найдовше у своєму класі, що дозволяє обробляти більші текстові вхідні дані без втрати продуктивності.
Для оптимізації продуктивності на різних апаратних конфігураціях Phi-3-mini була доопрацьована для ONNX Runtime та NVIDIA GPU. Microsoft планує розширити сім’ю моделей Phi-3 найближчим часом випуском Phi-3-small (7 млрд параметрів) та Phi-3-medium (14 млрд параметрів). Ці додаткові моделі забезпечать ширший спектр варіантів для задоволення різних потреб та бюджетів.

Зображення: Microsoft
Продуктивність та розвиток Phi-3
Microsoft повідомляє, що моделі Phi-3 показали суттєві покращення продуктивності порівняно з моделями такого ж та більшого розміру по різних стандартах. За даними компанії, Phi-3-mini перевершує моделі вдвічі більші за розміром у завданнях розуміння та генерації мови, тоді як Phi-3-small та Phi-3-medium перевершують значно більші моделі, такі як GPT-3.5T, у певних оцінках.
Microsoft заявляє, що розробка моделей Phi-3 здійснювалася згідно з принципами та стандартами відповідальної AI компанії, які підкреслюють відповідальність, прозорість, справедливість, надійність, безпеку, конфіденційність, безпеку та інклюзивність. Моделі пройшли навчання з безпеки, оцінки та червоних команд для забезпечення відповідальної практики розгортання AI.

Зображення: Microsoft
Потенційні застосування та можливості Phi-3
Сім’я моделей Phi-3 розроблена для успішної роботи у сценаріях, де обмежені ресурси, низька затримка є суттєвою, або ефективність витрат є пріоритетом. Ці моделі мають потенціал для реалізації висновків на пристрої, що дозволяє застосункам AI працювати ефективно на широкому спектрі пристроїв, включаючи ті, які мають обмежену обчислювальну потужність. Менший розмір моделей Phi-3 також може зробити доопрацювання та налаштування більш доступними для підприємств, дозволяючи їм адаптувати моделі до своїх конкретних випадків використання без високих витрат.
У випадках, коли швидкі часи відповіді є критичними, моделі Phi-3 пропонують перспективне рішення. Їх оптимізована архітектура та ефективна обробка можуть забезпечити швидке генерацію результатів, покращуючи досвід користувача та відкриваючи можливості для взаємодії з AI в реальному часі. Крім того, сильні можливості висновків та логіки Phi-3-mini роблять її добре придатною для аналітичних завдань, таких як аналіз даних та генерація інсайтів.












