Моделі та платформи ШІ
GPT-4o Mini представлено: Економічне, високопродуктивне альтернативу Claude Haiku, Gemini Flash і GPT 3.5 Turbo
OpenAI, лідер у сфері масштабування моделей Generative Pre-trained Transformer (GPT), представив GPT-4o Mini, перейшовши до більш компактних рішень штучного інтелекту. Цей крок адресує проблеми великомасштабного штучного інтелекту, включаючи високі витрати та енергозатратний процес навчання, і позиціонує OpenAI для конкуренції з такими суперниками, як Google (GOOGL ) і Claude. GPT-4o Mini пропонує більш ефективний і доступний підхід до багатомодального штучного інтелекту. У цій статті буде розглянуто, що відрізняє GPT-4o Mini від інших моделей, порівнюючи його з Claude Haiku, Gemini Flash і GPT-3.5 Turbo. Ми оцінимо ці моделі за шістьма ключовими факторами: підтримка модальності, продуктивність, вікно контексту, швидкість обробки, ціна та доступність, які є важливими для вибору правильної моделі штучного інтелекту для різних застосунків.
Представлення GPT-4o Mini:
GPT-4o Mini – це компактна багатомодальна модель штучного інтелекту з текстовими та візуальними можливостями. Хоча OpenAI не розкрив конкретних деталей про метод її розробки, GPT-4o Mini будується на основі серії GPT. Вона призначена для економічних і низьколітаційних застосунків. GPT-4o Mini корисна для завдань, які вимагають ланцюжків або паралельних викликів моделей, обробки великих об’ємів контексту та надання швидких, реальних текстових відповідей. Ці функції особливо важливі для побудови застосунків, таких як системи генерації з підтримкою пошукових запитів (RAG) і чат-ботів.
Ключові особливості GPT-4o Mini включають:
- Вікно контексту на 128К токенів
- Підтримка до 16К токенів виводу на запит
- Покращене оброблення неанглійського тексту
- Знання до жовтня 2023 року
GPT-4o Mini vs. Claude Haiku vs. Gemini Flash: Порівняння малих багатомодальних моделей штучного інтелекту
Цей розділ порівнює GPT-4o Mini з двома існуючими малими багатомодальними моделями штучного інтелекту: Claude Haiku і Gemini Flash. Claude Haiku, запущений компанією Anthropic у березні 2024 року, і Gemini Flash, представлений компанією Google у грудні 2023 року з оновленою версією 1.5, випущеною у травні 2024 року, є значними конкурентами.
- Підтримка модальності: GPT-4o Mini і Claude Haiku зараз підтримують текстові та візуальні можливості. OpenAI планує додати підтримку аудіо та відео в майбутньому. Натомість Gemini Flash вже підтримує текст, зображення, відео та аудіо.
- Продуктивність: Дослідники OpenAI провели бенчмарки GPT-4o Mini проти Gemini Flash і Claude Haiku за декількома ключовими метриками. GPT-4o Mini постійно перевершує своїх суперників. У завданнях, що включають текст і візуальні дані, GPT-4o Mini набрав 82,0% на MMLU, перевершивши Gemini Flash з 77,9% і Claude Haiku з 73,8%. GPT-4o Mini досяг 87,0% у математичних та кодових завданнях на MGSM, порівняно з Gemini Flash з 75,5% і Claude Haiku з 71,7%. На HumanEval, який вимірює продуктивність кодування, GPT-4o Mini набрав 87,2%, випередивши Gemini Flash з 71,5% і Claude Haiku з 75,9%. Крім того, GPT-4o Mini виділяється у багатомодальному розумінні, набравши 59,4% на MMMU, порівняно з 56,1% для Gemini Flash і 50,2% для Claude Haiku.
- Вікно контексту: Більше вікно контексту дозволяє моделі надавати повні та детальні відповіді над тривалими пасажами. GPT-4o Mini пропонує вікно контексту на 128К токенів і підтримує до 16К токенів виводу на запит. Claude Haiku має довше вікно контексту на 200К токенів, але повертає менше токенів на запит, з максимальним значенням 4096 токенів. Gemini Flash має значно більше вікно контексту на 1 мільйон токенів. Отже, Gemini Flash має перевагу над GPT-4o Mini щодо вікна контексту.
- Швидкість обробки: GPT-4o Mini швидше за інші моделі. Він обробляє 15 мільйонів токенів на хвилину, тоді як Claude Haiku обробляє 1,26 мільйона токенів на хвилину, а Gemini Flash обробляє 4 мільйони токенів на хвилину.
- Ціна: GPT-4o Mini є більш економічним, цінувався у 15 центів за мільйон вхідних токенів і 60 центів за мільйон токенів виводу. Claude Haiku коштує 25 центів за мільйон вхідних токенів і 1,25 долара за мільйон токенів відповіді. Gemini Flash коштує 35 центів за мільйон вхідних токенів і 1,05 долара за мільйон токенів виводу.
- Доступність: GPT-4o Mini можна отримати через Assistants API, Chat Completions API і Batch API. Claude Haiku доступна через підписку Claude Pro на claude.ai, її API, Amazon Bedrock і Google Cloud Vertex AI. Gemini Flash можна отримати на Google AI Studio і інтегрувати до застосунків через Google API, з додатковою доступністю на Google Cloud Vertex AI.
У цьому порівнянні GPT-4o Mini виділяється своєю збалансованою продуктивністю, економічністю та швидкістю, що робить його сильним претендентом у сфері малих багатомодальних моделей штучного інтелекту.
GPT-4o Mini vs. GPT-3.5 Turbo: Детальне порівняння
Цей розділ порівнює GPT-4o Mini з GPT-3.5 Turbo, широко використовуваною великою багатомодальною моделлю штучного інтелекту OpenAI.
- Розмір: Хоча OpenAI не розкрив точної кількості параметрів для GPT-4o Mini і GPT-3.5 Turbo, відомо, що GPT-3.5 Turbo класифікується як велика багатомодальна модель, тоді як GPT-4o Mini належить до категорії малих багатомодальних моделей. Це означає, що GPT-4o Mini вимагає значно менше обчислювальних ресурсів, ніж GPT-3.5 Turbo.
- Підтримка модальності: GPT-4o Mini і GPT-3.5 Turbo підтримують текстові та візуальні завдання.
- Продуктивність: GPT-4o Mini демонструє помітні покращення над GPT-3.5 Turbo у різних бенчмарках, таких як MMLU, GPQA, DROP, MGSM, MATH, HumanEval, MMMU і MathVista. Він працює краще у текстовому інтелекті та багатомодальному розумінні, постійно перевершуючи GPT-3.5 Turbo.
- Вікно контексту: GPT-4o Mini пропонує значно довше вікно контексту, ніж 16К токенів GPT-3.5 Turbo, що дозволяє йому обробляти більш об’ємний текст і надавати повні та детальні відповіді над тривалими пасажами.
- Швидкість обробки: GPT-4o Mini обробляє токени з вражаючою швидкістю 15 мільйонів токенів на хвилину, значно перевершуючи 4 650 токенів на хвилину GPT-3.5 Turbo.
- Ціна: GPT-4o Mini також є більш економічним, понад 60% дешевшим за GPT-3.5 Turbo. Він коштує 15 центів за мільйон вхідних токенів і 60 центів за мільйон токенів виводу, тоді як GPT-3.5 Turbo коштує 50 центів за мільйон вхідних токенів і 1,50 долара за мільйон токенів виводу.
- Додаткові можливості: OpenAI підкреслює, що GPT-4o Mini перевершує GPT-3.5 Turbo у викликах функцій, що дозволяє більш гладке інтегрування з зовнішніми системами. Крім того, його покращена продуктивність у довгому контексті робить його більш ефективним і універсальним інструментом для різних застосунків штучного інтелекту.
Висновок
Представлення GPT-4o Mini від OpenAI символізує стратегічний перехід до більш компактних та економічних рішень штучного інтелекту. Ця модель ефективно вирішує проблеми високих операційних витрат та енергоспоживання великомасштабних систем штучного інтелекту. GPT-4o Mini виділяється своєю продуктивністю, швидкістю обробки та економічністю порівняно з конкурентами, такими як Claude Haiku і Gemini Flash. Він також демонструє вищу продуктивність над GPT-3.5 Turbo, з помітними перевагами у обробці контексту та економічності. Покращена функціональність та універсальність GPT-4o Mini роблять його сильним вибором для розробників, які шукають високопродуктивний багатомодальний штучний інтелект.












