ソートリーダー
インテリジェントなワークフローがデータの貯蔵を変革する

「良い」データ管理の実践は、昔は「必要なものだけを保持する」という意味だった。しかし、AIの時代にあっては、その考え方は時代遅れのものとなり、すぐに時代錯誤となる。組織がデータを、生きている、進化する資産として扱い、キュレーションし、接続し、継続的に豊かにするとき、データは、単なる運用の副産物から、次のAIドリブンのイノベーションの原動力となる。
賭けは大きい。AIは、すでに、ライフサイエンス、政府、メディア、製造業など、さまざまな業界で、即時的な、高い影響力を持つ用途を見つけ、顧客が気づく(そして投資家が期待する)実測可能な利益をもたらしている。しかし、次のAIイノベーションの波では、さらに貴重なものが必要になる:正確で、独自のデータが必要である。組織がそのデータを今採用し、洗練することで、競争上の優位性を定義することができる。
データの混沌の隠れたコスト
データは、しばしば、シロに閉じ込められている。通常、断片的な配置が、断片的なシステム、不透明なクラウド、管理されていないアーカイブに散在し、時間の経過とともに、一時的な解決策から現状へと変化する。結果は、重複した労力、過負荷のネットワークインフラストラクチャ、隠れたコスト、孤立した価値である。
これが聞こえにくい場合は、それはあなたの組織がそれを経験しているからである。チームは、プロジェクトを完了するために、一時的なストレージまたはクラウドインスタンスをセットアップするが、プロジェクトが終了した後も、それらは残る。チーム、部門、さらには会社が統合され、ストレージシステムの混沌とデータの散在が、IT管理者、データマネージャー、AI研究者の仕事を無限に難しくし(そして生産性の低下を引き起こす)。これらの問題は、予算、パフォーマンス、コンプライアンスに影響を与えるまで、表面に現れないことが多い。
以下は、データストレージのアプローチが、理想的なワークフローを構築する能力を損なうことを示す最も一般的な警告信号である。
- ワンサイズフィットオールの思考。ベンダーが、すべての問題を解決する単一のソリューションを押し付けることに注意。各ワークフローまたはパイプラインのステップで必要な特性を提供する技術を、慎重に展開する。フラッシュ、オブジェクト、テープには、それぞれの長所がある。1つの技術にロックインすると、将来の柔軟性と選択肢が大幅に制限される。
- ダークまたはアイドルなクラウドリポジトリ。孤立したクラウドバケットまたは忘れられた共有は、ワークフロー外にあり、インデックス付けされず、管理されず、有用にすることができるツールから見えなくなっている。
- 「安い」コールドストレージが実際にはそうではない。アーカイブ層は、データをすばやく取り出す必要があるときに、予期せぬ回収およびエグレス料金に当たるまで、経済的であるように見える。
- 重要なアクセスポイントでのパフォーマンスボトルネック。遅いインジェストまたはコラボレーションのステップは、イノベーション、意思決定、収益を促進するワークフローを絞る。
- クラウドへの過度な依存。すべてをクラウドに保持すると、コストが上昇し、データが、パフォーマンスと制御が最も必要なオンプレミスおよびエッジワークフローから隔離される。最終的に、外向きのネットワークインフラストラクチャにさらに多くの圧力がかかる。
これらの落とし穴はすべて、時間、予算、柔軟性を奪う操作上の摩擦を生み出す。AIドリブンの組織が必要とするものとは、正反対である。しかし、最大の落とし穴は、データを静的なリソースとして扱うことである。新しいAIおよびデータドリブンの意思決定ワークフローに真正に備えられるためには、データは、迅速な使用を可能にし、時間の経過とともにデータを豊かにし、スケールを戦略的な優位性に変えることができる、柔軟で適応性のあるワークフローを通じて流れる必要がある。
静的なデータを生きているインテリジェンスに変える
AIの周りのストレージの会話は、主に、今日のAIモデルをトレーニングするための小さな例に焦点を当ててきた。しかし、継続的なデータの豊富化システムを開発することは、はるかに多くのことを意味する。データにアクセスするたびに、人間の入力、システム分析、AIドリブンのタグ付け、分類、発見を通じて、データを豊かにする機会が生まれる。
次に、AIモデルをトレーニングするたびに、アルゴリズムが改善される。各イテレーションは、モデルの精度を高め、予測を改善し、無関係なソース間の新しい関係を明らかにする。データは、時間のスナップショットではなく、継続的な学習のエンジンになる。
しかし、このような生きているインテリジェンスを解放するには、同等のダイナミックな基盤が必要である。データを最も新鮮な状態でキャプチャするためのインジェストのパフォーマンス、データを洞察に変えるためのGPUパワードトレーニングおよび推論、およびすべてを保持するための大量の経済的なストレージが必要である。次のサイクルの豊富化のために、すべてを準備する。スピードとスケールのバランスが、エンドツーエンドのワークフローを不可欠にする。
接続されたワークフローが解放するもの
接続されたワークフローでは、以前はあなたを遅くしていた同じ課題が、優位性の源となる。
- 選択の自由。フラッシュ、オブジェクト、テープの最良の組み合わせを展開することで、各ワークフローまたはパイプラインのステップで最大のパフォーマンスと最低のコストを実現する。各テクノロジーは、将来の柔軟性と選択肢を制限することなく、それぞれの長所を提供する。
- 継続的な豊富化。データにアクセス、使用、または分析するたびに、新しいコンテキストとメタデータが追加される。時間の経過とともに、情報ベースは、より賢く、豊かで、有用になる。
- 任意のスケールでの柔軟性。容量を追加したり、パフォーマンスを高めたり、リーチを拡大したりすることが、混乱や予期せぬコストなしに簡単に行えるシステム。
- どこでも即時的な洞察。データは、必要とする人やシステムに近く、クラウド、オンプレミス、エッジのどこにあっても、意思決定はリアルタイムで行える。
- 効果的な経済性。パフォーマンスと容量は、タスクに合わせて、実際のビジネスニーズに合わせて支出が行われる。
- 可視性によるセキュリティ。統一されたワークフローは、データを追跡可能、監査可能、コンプライアンスを保ち、漏洩、損失、または放棄のリスクを軽減する。
- AIの基盤。統合システム内で動き、学び、改善するデータは、真正の競争上の優位性となる。ライバルが簡単に複製または追いつくことができないものである。
負担からブレークスルーへ
効率的なワークフローと生きているデータは、別々のアイデアではない。不可分なものである。高パフォーマンスのワークフローは、データが進化し続けるために必要な構造、コンテキスト、循環を提供する。生きているデータは、ワークフローに目的を与える。継続的にモデル、ツール、洞察を豊かにし、組織の知性を定義する。
データの混沌の落とし穴、シロ、失われたリポジトリ、コストの暴走は、避けられないものではない。過去のシステムの構築物である。未来は、データをダイナミックな資産として扱い、ワークフローを構築する組織に属する。データは自由に流れ、継続的に学び、時間の経過とともに価値が増す。
今が、自分の基盤を評価するときである。データはどのように流れているか。次の世代のAIツールとビジネスドメインの理解にどれだけ準備ができているか。行動を起こす者、インテリジェントなデータ管理と接続されたワークフローを組み合わせる者は、次のAIイノベーションの波にただ耐えるだけでなく、リードする準備ができている。データの黄金時代が来る。組織がそれに備えられるかどうかが、疑問である。












