AGI та майбутній ШІ
Інфлекція-2.5: Потужний LLM, який конкурує з GPT-4 і Gemini
Inflection AI зробила значний внесок у розвиток великих мовних моделей (LLM) з допомогою свого останнього відкриття – Інфлекції-2.5, моделі, яка конкурує з провідними LLM у світі, включаючи GPT-4 від OpenAI та Gemini від Google.
Швидкий розвиток Inflection AI ще більше прискорився завдяки масивному фінансовому раунду у розмірі $1,3 млрд, який очолили промислові гіганти, такі як Microsoft (MSFT ), NVIDIA (NVDA ), та відомі інвестори, серед яких Рейд Гоффман, Білл Гейтс та Ерік Шмідт. Цей значний інвестиційний раунд збільшує загальний фінансування компанії до $1,525 млрд.
У співпраці з партнерами CoreWeave (CRWV ) та NVIDIA, Inflection AI будує найбільший у світі кластер штучного інтелекту, який складається з безпрецедентних 22 000 графічних процесорів NVIDIA H100 Tensor Core. Ця колосальна обчислювальна потужність підтримуватиме навчання та розгортання нового покоління великомасштабних моделей штучного інтелекту, дозволяючи Inflection AI розширити межі того, що можливо у сфері персонального штучного інтелекту.
Проривні результати компанії вже дали плоди, оскільки кластер Inflection AI, який на даний момент складається з понад 3 500 графічних процесорів NVIDIA H100 Tensor Core, демонструє найвищу продуктивність на відкритому бенчмарку MLPerf. У спільній заявці з CoreWeave та NVIDIA кластер завершив завдання з посилання на великі мовні моделі за всього 11 хвилин, закріпивши свою позицію як найшвидший кластер на цьому бенчмарку.
Цей успіх слідує за відкриттям Інфлекції-1, внутрішньої великої мовної моделі (LLM) Inflection AI, яка була визнана найкращою моделлю у своєму класі обчислень. Перевершуючи промислових гігантів, таких як GPT-3.5, LLaMA, Chinchilla та PaLM-540B на широкому спектрі бенчмарків, що зазвичай використовуються для порівняння LLM, Інфлекція-1 дозволяє користувачам взаємодіяти з Pi, персональним штучним інтелектом Inflection AI, простим та природнім способом, отримуючи швидку, актуальну та корисну інформацію та поради.
Компанія Inflection AI продемонструвала свою приверженість прозорості та реплікованості, випустивши технічну записку, яка детально описує оцінку та продуктивність Інфлекції-1 на різних бенчмарках. У цій записці зазначено, що Інфлекція-1 перевершує моделі у тому ж класі обчислень, визначеному як моделі, навчені за допомогою не більшої кількості операцій з рухомою комою (FLOPs), ніж у PaLM-540B.
Успіх Інфлекції-1 та швидке розширення обчислювальної інфраструктури компанії, підтримане значним фінансовим раундом, підкреслюють непохитну відданість Inflection AI своєму завдання з створення персонального штучного інтелекту для кожної людини. З інтеграцією Інфлекції-1 до Pi користувачі тепер можуть досвідчувати силу персонального штучного інтелекту, користуючись його емпатичною особистістю, корисністю та стандартами безпеки.
Інфлекція-2.5
Інфлекція-2.5 тепер доступна всім користувачам Pi, персонального штучного інтелекту Inflection AI, на різних платформах, включаючи веб (pi.ai), iOS, Android та нову програму для робочого столу. Ця інтеграція позначає значний етап у місії Inflection AI з створення персонального штучного інтелекту для кожної людини, поєднуючи сурову потужність з емпатичною особистістю та стандартами безпеки.
Крок вперед у продуктивності Попередня модель Inflection AI, Інфлекція-1, використовувала приблизно 4% обчислювальних операцій GPT-4 та демонструвала середню продуктивність близько 72% порівняно з GPT-4 на різних завданнях, пов’язаних з інтелектом. З Інфлекцією-2.5 компанія Inflection AI досягла суттєвого підвищення інтелектуальних можливостей Pi, з особливим акцентом на програмуванні та математиці.
Продуктивність моделі на ключових промислових бенчмарках демонструє її потужність, показуючи понад 94% середньої продуктивності GPT-4 на різних завданнях, з особливим акцентом на успіх у галузях STEM. Це видатне досягнення є свідченням непохитної відданості Inflection AI технологічному прогресу, зберігаючи при цьому фокус на досвіді користувача та безпеці.
Програмування та математична потужність Інфлекція-2.5 виділяється у програмуванні та математиці, демонструючи понад 10% покращення порівняно з Інфлекцією-1 на бенчмарку BIG-Bench-Hard, підмножині складних завдань для великих мовних моделей. Два бенчмарки програмування, MBPP+ та HumanEval+, показують суттєве покращення порівняно з Інфлекцією-1, закріплюючи позицію Інфлекції-2.5 як серйозної сили у галузі програмування.
На бенчмарку MBPP+ Інфлекція-2.5 перевершує свою попередницю на суттєву міру, демонструючи рівень продуктивності, порівнянний з продуктивністю GPT-4, як повідомляє DeepSeek Coder. Аналогічно, на бенчмарку HumanEval+ Інфлекція-2.5 демонструє суттєвий прогрес, перевершуючи продуктивність Інфлекції-1 та наближаючись до рівня GPT-4, як повідомляється наEvalPlus-лидерборді.
Домінування у промислових бенчмарках
Інфлекція-2.5 виділяється на промислових бенчмарках, демонструючи суттєве покращення порівняно з Інфлекцією-1 на бенчмарках MMLU та GPQA Diamond, відомих своєю експертною складністю. Продуктивність моделі на цих бенчмарках підкреслює її здатність обробляти широкий спектр завдань, від шкільних завдань до професійних завдань.
Успіх у завданнях STEM Інфлекція-2.5 демонструє свій математичний талант, використовуючи надану few-shot-підказку та форматування, що дозволяє легко повторити результати.
У фізичному GRE, вступному іспиті з фізики, Інфлекція-2.5 досягає 85-го процентилу серед людей, що проходять іспит, у maj@8 (більшість голосів за 8), закріплюючи свою позицію як серйозної сили у галузі фізичних завдань. Крім того, модель наближається до максимального бала у maj@32, демонструючи свою здатність вирішувати складні фізичні завдання з видатною точністю.
Покращення досвіду користувача Інфлекція-2.5 не тільки зберігає емпатичну особистість та стандарти безпеки Pi, але й підвищує свій статус універсального та цінного персонального штучного інтелекту у різних темах. Від обговорення поточних подій до пошуку місцевих рекомендацій, вивчення для іспитів, програмування та навіть неформальних розмов, Pi з Інфлекцією-2.5 обіцяє збагачений досвід користувача.
З потужними можливостями Інфлекції-2.5 користувачі взаємодіють з Pi на широкому спектрі тем, ніж будь-коли раніше. Спроможність моделі обробляти складні завдання, поєднана з емпатичною особистістю та можливістю реального пошуку в інтернеті, забезпечує користувачам високоякісну, актуальну інформацію та поради.
Взаємодія користувачів та утримання користувачів Вплив інтеграції Інфлекції-2.5 до Pi вже очевидний у настроях користувачів, взаємодії та показниках утримання. Inflection AI стала свідком суттєвого прискорення органічного зростання користувачів, з одним мільйоном активних користувачів на добу та шістьма мільйонами активних користувачів на місяць, які обмінюються понад чотирма мільярдами повідомлень з Pi.
У середньому розмови з Pi тривають 33 хвилини, з однією з десяти тривають понад годину кожен день. Крім того, близько 60% людей, які взаємодіють з Pi протягом тижня, повертаються наступного тижня, демонструючи вищу щомісячну лояльність, ніж провідні конкуренти у галузі.
Технічні деталі та прозорість бенчмарків
У відповідності з підходом Inflection AI до прозорості та реплікованості, компанія надала повні технічні результати та деталі щодо продуктивності Інфлекції-2.5 на різних промислових бенчмарках.
Наприклад, на виправленій версії набору даних MT-Bench, який усуває проблеми з неправильними посиланнями та помилковими припущеннями у оригінальному наборі даних, Інфлекція-2.5 демонструє продуктивність, відповідну очікуванням на основі інших бенчмарків.
Inflection AI також оцінила Інфлекцію-2.5 на HellaSwag та ARC-C, бенчмарках звичайного відчуття та науки, які широко повідомляються багатьма моделями, і результати демонструють сильну продуктивність на цих насичених бенчмарках.
Важливо зазначити, що хоча оцінки, надані тут, представляють модель, яка живить Pi, досвід користувача може трохи відрізнятися через фактори, такі як вплив веб-пошуку (не використовується у бенчмарках), структуру few-shot-підказок та інші відмінності виробництва.
Висновок
Інфлекція-2.5 представляє суттєвий крок вперед у галузі великих мовних моделей, конкуруючи з можливостями лідерів галузі, таких як GPT-4 та Gemini, при використанні лише частини обчислювальних ресурсів. З її вражаючою продуктивністю на широкому спектрі бенчмарків, особливо у галузях STEM, програмуванні та математиці, Інфлекція-2.5 зайняла позицію серйозної сили у ландшафті штучного інтелекту.
Інтеграція Інфлекції-2.5 до Pi, персонального штучного інтелекту Inflection AI, обіцяє збагачений досвід користувача, поєднуючи сурову потужність з емпатичною особистістю та стандартами безпеки. Коли Inflection AI продовжує розширювати межі того, що можливо з великими мовними моделями, спільнота штучного інтелекту з нетерпінням очікує наступної хвилі інновацій та проривів від цієї піонерської компанії.














