AIモデルとプラットフォーム

Gemma:AI言語モデルにおける新たな飛躍

mm
Unite.AI を Google の優先ソースに追加

Googleは最近、Gemmaを導入しました。これは、Googleの高度なAIであるGeminiと技術的基盤を共有するオープンソースの言語モデルです。「宝石」を意味するラテン語に由来するGemmaは、前身であるGemini 1.5に比べ、よりアクセスしやすい対象として設計されています。同時に、高性能と責任ある使用のバランスを維持しています。このオープンソースのジェネレーティブAIへの移行は、GoogleがAI技術を民主化することに尽力していることを示しています。記事では、Gemmaの独自の特徴と、オープンソースAIモデルのトップ2つであるMetaのLlama 2MistralのMistral 7Bとの違いについて説明しています。

Gemma:AI言語モデルの新たな飛躍

Gemmaは、2億と7億のパラメータ構成を備えた軽量なオープンソース言語モデルのファミリーです。さまざまな計算ニーズに合わせて利用できます。また、GPU、TPU、CPU、およびデバイスアプリケーションを含むさまざまなプラットフォームで展開できます。Gemmaのアーキテクチャは、特にトランスフォーマーアーキテクチャを利用しており、最近のAI開発の基盤となっています。
Gemmaが際立つのは、テキストベースのタスクにおける卓越したパフォーマンスです。11つの学術ベンチマークで競合他社を上回っています。言語理解、推論、質問回答、常識的な推論、数学、科学、コーディングなどの専門分野で優れています。このパフォーマンスは、言語モデルの進化におけるGemmaの重要な貢献を強調しています。

主要特徴

Gemmaは、さまざまなAI開発フレームワークやプロジェクトへのアクセスと統合を容易にするために、以下の特徴を導入しています:

  • クロスフレームワークの互換性:Gemmaは、JAXPyTorch、およびTensorFlowを介してネイティブのKeras 3.0を使用した、推論と教師ありのファインチューニングのツールチェーンを提供しています。開発者は、新しい環境に適応する障壁なく、好みのツールを利用できます。
  • 即時使用可能なリソースへのアクセス:Gemmaは、ColabおよびKaggleノートブックを即時使用可能な状態で提供し、Hugging FaceNVIDIA NeMoなどの人気プラットフォームとの統合も行っています。これらのリソースは、新規および経験豊富な開発者にとって、Gemmaの使用を開始するプロセスを簡素化することを目的としています。
  • 柔軟性と最適化された展開:Gemmaは、パーソナルデバイスからクラウドサービスおよびIoTデバイスまで、幅広いハードウェアで使用可能です。AIハードウェアの最適化により、デバイス全体で最高のパフォーマンスを実現します。また、Vertex AIGoogle Kubernetes Engine (GOOGL ) を含む、容易な展開オプションも提供しています。
  • 責任あるAIへの取り組み:安全で倫理的なAI開発を重視し、Gemmaは自動データフィルタリング、人間のフィードバックからの強化学習、および包括的なテストを組み込んで、信頼性と安全性の高い基準を維持しています。Googleは、開発者が責任あるAIの慣行を維持するためのツールキットとリソースも提供しています。
  • 好ましい条件によるイノベーションの促進:Gemmaの利用条件は、責任ある商業的応用とイノベーションを支援しています。研究および開発のための無料クレジット、Colabノートブックの無料プラン、Google Cloudクレジットを提供し、研究者と開発者がAIの新しいフロンティアを探求できるようにしています。

他のオープンソースモデルとの比較

  • Gemma vs Llama 2:GemmaとLlama 2は、それぞれGoogleとMetaによって開発されたオープンソース言語モデルであり、ユーザーのニーズと好みに応じた独自の強みを示しています。Gemmaは、コード生成や数学的問題解決などのSTEM分野のタスクに最適化されており、研究者や開発者にとって貴重なリソースとなります。一方、Llama 2は、テキスト要約や創作的な文章作成などの幅広い言語タスクを扱うことに適しています。GemmaのSTEM関連タスクへの特化は、より広範な現実世界のシナリオでの応用性を制限する可能性があります。一方、Llama 2の高い計算要求は、リソースが限られているユーザーにとってアクセスを妨げる可能性があります。これらの違いは、AI技術の多様な応用と潜在的な制限を浮き彫りにし、デジタル時代の進歩と課題に貢献する別々の道を示しています。
  • Gemma 7B vs Mistral 7B:Gemma 7BとMistral AIのMistral 7Bは、どちらも軽量なオープンソース言語モデルですが、異なる分野で優れています。Gemma 7Bはコード生成と数学的問題解決に優れていますが、Mistral 7Bは論理的推論スキルと現実世界の状況への対応で認められています。両モデルは、推論速度と待ち時間の面で類似したパフォーマンスを示しています。Mistral 7Bの完全にオープンソースな性質により、Gemma 7Bよりも簡単に改変できます。Googleは、Gemmaの使用に際して特定の条件に同意することを要求しており、安全性とプライバシーの基準を確保することを目的としています。一方、Mistral AIのアプローチは、これらの基準の適用に課題をもたらす可能性があります。

結論

GoogleのGemmaは、オープンソースのジェネレーティブAIにおける重要な一歩を表しています。高性能と責任ある使用を両立させた言語モデルを提供し、AI技術の民主化を促進しています。さまざまな計算ニーズに応じた構成と、容易なアクセス、クロスフレームワークの互換性、最適化された展開を可能にする機能を備えています。Gemmaは、MetaのLlama 2やMistral AIのMistral 7Bなどの競合他社と比較して、STEMタスクでの卓越したパフォーマンスを示しています。ただし、Gemmaの責任あるAI開発への取り組みと、好ましい条件によるイノベーションの促進は、GoogleがAI技術の進歩に倫理的かつアクセスしやすい方法で貢献していることを強調しています。

Dr. Tehseen ZiaはCOMSATS University Islamabadの正教授であり、オーストリアのVienna University of TechnologyでAIのPh.D.を取得しています。人工知能、機械学習、データサイエンス、コンピュータビジョンを専門とし、信頼性の高い科学雑誌に掲載された出版物で著しい貢献をしています。Dr. Tehseenは、主な調査員としてさまざまな産業プロジェクトを率い、AIコンサルタントとしても務めています。