AIモデルとプラットフォーム
キャッチアップ:Googleの最新開発から2023年デベロッパーコンファレンス

水曜日、Googleは年次デベロッパーコンファレンスを主催しました。このイベントは、通常の複数日のイベントとは異なり、1日の発表と展示会で構成されていました。2020年には欠席したこのカンファレンスは、人員削減ながらも、新しい開発の発表が豊富でした。
Googleのイベントは、Alphabet (GOOG ) (GOOGL ) CEOのSundar Pichaiの壮大なビジョンを紹介する場となりました。シリコンバレーのShoreline Amphitheaterから、Pichaiは、検索のようなコア製品を、ジェネレーティブAIで再構想するという会社の野心的なビジョンを紹介しました。この声明は、当日の発表と製品の紹介の基調となりました。
人工知能の分野では、Googleは第二世代Pathways Language Model(PaLM 2)を導入しました。この大規模言語モデルは、前回のバージョンの進化であり、多くのGoogle製品を動かしています。会社はAIシステムの開発を長年にわたって行っており、トランスフォーマーアーキテクチャは、チャットボットのような現代のAIシステムの中心にあります。
GoogleのAIでのキャッチアップ
この導入は、GoogleがOpenAIのようなライバルに追いつこうとしている時期に来ています。OpenAIのGPT-3、ChatGPT、GPT-4、DALL-Eモデルは、AI分野で大きな波紋を起こしています。Googleの対応はPaLM 2で、100以上の言語、科学データセット、コードで書き込み、コード作成、計算を行うことができます。PaLM 2は、Gecko、Otter、Bison、Unicornの4つのサイズで利用できます。また、医療とセキュリティアプリケーション用の専用バージョンもあり、Med-PaLM 2とsec-PaLMと呼ばれています。
特に注目すべきは、GoogleがPaLM 2を25の製品と機能に統合していることです。これらのうち、いくつかはSearch Labsを介して早期テストが可能です。1つの製品は、PaLM 2を動かすAIチャットボットのBardです。このチャットボットは、20のプログラミング言語で開発者を支援するように設計されており、すぐに提案の出典を引用できるようになります。Googleは、Bardを様々なGoogleアプリとサードパーティサービス、例えばAdobe FireflyやInstacartと統合する予定です。
Google検索へのジェネレーティブAIの統合
ジェネレーティブAIは、Google検索インターフェイスにも統合されています。複数のクエリを同時に処理し、1つのAI生成の推奨回答を提供することを目的としています。Googleは、画像検索システムに機能を追加して、ユーザーが画像の出典を理解し、最初にインデックスされた時期と、どこで見つけることができるかを知ることができるようにする予定です。この機能は、真正な写真とAI生成または操作された画像を区別するのに特に役立ちます。
Googleは、今年後半にリリースされる予定のDuet AI for Workspaceを開発しています。これは、PaLMのAI能力を備えたスイートで、Google SlidesのAI生成スライドイメージ、Google Sheetsの行と列の整理、Google Meetのユニークな背景、Google DocsのAIライティングアシスタンスなどを含みます。Google Cloudの顧客は、Duet AI for Google Cloudにアクセスできるようになります。これには、コードアシスタンス、チャットアシスタンス、Duet AI for AppSheetなどが含まれます。
新しいハードウェアの発表
ハードウェアに移ると、Googleは6.1インチのPixel 7aスマートフォンを展示しました。これは、大型カメラセンサーとAI計算チップのTensor G2を備えています。この電話には、Direct My Call、Call Screen、Hold for Me、Clear Calling(ノイズ削減)、Wait Times(保留時間推定)などの機能を備えたAIパワードのCall Assist機能もあります。
カンファレンスでは、長い間待ちに待ったPixel Foldも紹介されました。これは、7.6インチのタブレットに変形する折り畳みスマートフォンです。このデバイスは、異なる方向を向く2つのパネル間でリアルタイムで翻訳を行うような、ユニークな機能を実行できます。Pixel Foldの予約購入には、Pixel Watchが無料で付属します。
Pixel Foldは、GoogleのUniversal Translatorプロジェクトのデモンストレーションの中心でした。これは、Googleが何年にもわたって推進してきた、リアルタイム会話翻訳を容易にする概念です。また、会社は、Googleのホームオートメーションシステムに統合可能な11インチのPixelタブレットをリリースする予定であることもほのめかしました。
製品ラインナップ全体でのジェネレーティブAI
カンファレンスの1つの重要なテーマは、Googleの製品ラインナップ全体でのジェネレーティブAIの応用でした。例えば、Googleは、Android用のMagic Compose機能を発表しました。これは、ジェネレーティブAIを使用して、テキストメッセージへの返信を提案します。Gmailは、ユーザーのメールアドレスがダークウェブに表示されたときに、情報漏洩や悪意のあるアクターによる標的化を示す可能性がある場合に、アラートシステムを導入します。また、Google Photosは、複雑な画像編集を行うMagic Editorを受け取ります。
テキストの説明から音楽を生成する機能であるMusicLMも、注目すべき発表でした。Googleは、Android搭載の車が、YouTube、Waze、Zoom、Microsoft Teams、Cisco Webexなどの人気アプリを実行できるようになることも発表しました。
GoogleのProject Starlineは、3Dビデオ会議システムのプロトタイプ段階ですが、TVサイズのデバイスに縮小されています。もう1つの新しいイニシアチブは、Project Tailwindで、Google Driveから情報を取得し、考えを整理し、出典を引用できるチャットボットを備えたノートブックアプリです。
カンファレンスでの発表は、GoogleのAIへの取り組みを示しました。Sundar Pichaiは「AIは市場を牽引するものであり、プラットフォームの大きな変化でもある」と述べました。このビジョンは、当日発表されたAIパワードの製品や機能の多様性に明らかでした。GoogleがAIの能力を拡大し、革新を続けるにつれて、消費者と開発者は、デジタル体験をストリームライン化し、強化するための新しいツールの開発を期待できます。












