Interviews
Alex Yeh, Gründer und CEO von GMI Cloud – Interview-Serie

Alex Yeh ist der Gründer und CEO von GMI Cloud, einem von Risikokapitalgebern unterstützten digitalen Infrastrukturunternehmen mit der Mission, es jedem zu ermöglichen, AI mühelos zu nutzen und die Art und Weise, wie Unternehmen AI aufbauen, bereitstellen und skalieren, durch integrierte Hardware- und Softwarelösungen zu vereinfachen
Was hat Sie dazu inspiriert, GMI Cloud zu gründen, und wie hat Ihre Vergangenheit Ihre Herangehensweise an den Aufbau des Unternehmens beeinflusst?
GMI Cloud wurde 2021 gegründet und konzentrierte sich in den ersten zwei Jahren hauptsächlich auf den Bau und Betrieb von Rechenzentren, um Bitcoin-Computing-Node bereitzustellen. In dieser Zeit errichteten wir drei Rechenzentren in Arkansas und Texas.
Im Juni des letzten Jahres stellten wir fest, dass es eine starke Nachfrage von Investoren und Kunden nach GPU-Rechenleistung gab. Innerhalb eines Monats entschied ich mich, mich auf AI-Cloud-Infrastruktur zu konzentrieren. Die schnelle Entwicklung von KI und die Welle neuer Geschäftschancen, die sie mit sich bringt, sind entweder nicht vorhersehbar oder schwer zu beschreiben. Durch die Bereitstellung der notwendigen Infrastruktur zielt GMI Cloud darauf ab, eng mit den spannenden und oft unvorhersehbaren Chancen von KI verbunden zu bleiben.
Bevor ich GMI Cloud gründete, war ich Partner bei einer Risikokapitalfirma und arbeitete regelmäßig mit aufstrebenden Branchen zusammen. Ich sehe künstliche Intelligenz als den “Goldrausch” des 21. Jahrhunderts, bei dem GPUs und AI-Server als die “Spitzhacken” für die modernen “Goldsucher” dienen, was zu einem schnellen Wachstum von Cloud-Unternehmen führt, die sich auf die Vermietung von GPU-Rechenleistung spezialisieren.
Können Sie uns von GMI Clouds Mission erzählen, die AI-Infrastruktur zu vereinfachen, und warum diese Konzentration so wichtig ist auf dem heutigen Markt?
Die Vereinfachung der AI-Infrastruktur ist aufgrund der aktuellen Komplexität und Fragmentierung des AI-Stacks erforderlich, die die Zugänglichkeit und Effizienz für Unternehmen, die das Potenzial von KI nutzen möchten, einschränken kann. Heutige KI-Systeme umfassen oft mehrere nicht verbundene Schichten – von der Datenverarbeitung und Modellierung bis hin zur Bereitstellung und Skalierung -, die erhebliche Zeit, spezielle Fähigkeiten und Ressourcen erfordern, um sie effektiv zu verwalten. Viele Unternehmen verbringen Wochen und sogar Monate damit, die am besten geeigneten Schichten der KI-Infrastruktur zu identifizieren, ein Prozess, der sich auf Wochen oder sogar Monate ausdehnen kann und die Benutzererfahrung und Produktivität beeinträchtigt.
- Beschleunigung der Bereitstellung: Eine vereinfachte Infrastruktur ermöglicht eine schnellere Entwicklung und Bereitstellung von KI-Lösungen, sodass Unternehmen wettbewerbsfähig und anpassungsfähig an veränderte Marktanforderungen bleiben können.
- Kostenreduzierung und Ressourcenreduzierung: Durch die Minimierung des Bedarfs an spezieller Hardware und benutzerdefinierten Integrationen kann eine gestreamte KI-Stack die Kosten erheblich senken und KI für kleinere Unternehmen zugänglicher machen.
- Skalierbarkeit ermöglichen: Eine gut integrierte Infrastruktur ermöglicht eine effiziente Ressourcenverwaltung, die für die Skalierung von Anwendungen bei steigender Nachfrage unerlässlich ist und sicherstellt, dass KI-Lösungen bei größeren Skalen robust und reaktionsfähig bleiben.
- Zugänglichkeit verbessern: Eine vereinfachte Infrastruktur macht es einfacher für eine breitere Palette von Organisationen, KI ohne umfassende technische Expertise zu übernehmen, was die Demokratisierung von KI fördert und in mehr Branchen Wert schafft.
- Rapiden Innovation unterstützen: Da die KI-Technologie fortschreitet, ermöglicht eine weniger komplexe Infrastruktur die einfache Integration neuer Tools, Modelle und Methoden, sodass Organisationen agil bleiben und schnell innovieren können.
Die Mission von GMI Cloud, die KI-Infrastruktur zu vereinfachen, ist für die Unterstützung von Unternehmen und Start-ups unerlässlich, um die Vorteile von KI vollständig zu nutzen und sie zugänglich, kosteneffizient und skalierbar für Unternehmen aller Größen zu machen.
Sie haben kürzlich 82 Millionen US-Dollar in Series-A-Finanzierung gesichert. Wie wird das neue Kapital eingesetzt, und welche sind Ihre unmittelbaren Expansionsziele?
GMI Cloud wird die Finanzierung nutzen, um ein neues Rechenzentrum in Colorado zu eröffnen und hauptsächlich in H200-GPUs zu investieren, um einen zusätzlichen großen GPU-Cluster aufzubauen. GMI Cloud entwickelt auch aktiv seine eigene cloud-native Ressourcen-Management-Plattform, Cluster Engine, die nahtlos in unsere fortschrittliche Hardware integriert ist. Diese Plattform bietet unübertroffene Fähigkeiten in Virtualisierung, Containerisierung und Orchestrierung.
GMI Cloud bietet GPU-Zugriff mit doppelter Geschwindigkeit im Vergleich zu Wettbewerbern. Was sind die einzigartigen Ansätze oder Technologien, die dies ermöglichen?
Eine wichtige Facette des einzigartigen Ansatzes von GMI Cloud ist die Nutzung von NCP von NVIDIA (NVDA ), die GMI Cloud einen Prioritätszugriff auf GPUs und andere Spitzenressourcen bietet. Diese direkte Beschaffung von Herstellern, kombiniert mit starken Finanzierungsoptionen, gewährleistet Kosteneffizienz und einen hochsicheren Lieferketten.
Wie unterstützt die Infrastruktur von GMI Cloud mit NVIDIA H100-GPUs an fünf globalen Standorten die Bedürfnisse von KI-Kunden in den USA und Asien?
GMI Cloud hat eine globale Präsenz etabliert und bedient mehrere Länder und Regionen, darunter Taiwan, die Vereinigten Staaten und Thailand, mit einem Netzwerk von Internet-Rechenzentren auf der ganzen Welt. Derzeit betreibt GMI Cloud Tausende von NVIDIA-Hopper-basierten GPU-Karten und befindet sich auf einem Pfad des schnellen Ausbaus, mit Plänen, seine Ressourcen in den nächsten sechs Monaten zu vervielfachen. Diese geografische Verteilung ermöglicht es GMI Cloud, eine nahtlose, latenzarme Dienstleistung für Kunden in verschiedenen Regionen zu bieten, die Datenübertragungseffizienz zu optimieren und eine robuste Infrastrukturunterstützung für Unternehmen zu bieten, die ihre KI-Operationen weltweit ausbauen.
Zusätzlich ermöglicht die globale Kapazität von GMI Cloud es, unterschiedliche Marktnachfragen und regulatorische Anforderungen in verschiedenen Regionen zu verstehen und zu erfüllen, und bietet maßgeschneiderte Lösungen, die auf die einzigartigen Bedürfnisse jeder Region zugeschnitten sind. Mit einem wachsenden Pool an Rechenressourcen begegnet GMI Cloud der steigenden Nachfrage nach KI-Rechenleistung und bietet Kunden ausreichende Rechenkapazität, um die Modellierung zu beschleunigen, die Genauigkeit zu verbessern und die Modellleistung für eine breite Palette von KI-Projekten zu verbessern.
Als Führungskraft im Bereich KI-nativer Cloud-Dienste, auf welche Trends oder Kundenbedürfnisse konzentrieren Sie sich, um GMI voranzutreiben?
Von GPUs bis hin zu Anwendungen treibt GMI Cloud die intelligente Transformation für Kunden voran und erfüllt die Anforderungen der KI-Technologieentwicklung.
Hardware-Architektur:
- Physische Cluster-Architektur: Instanzen wie die 1250 H100 umfassen GPU-Racks, Leaf-Racks und Spine-Racks mit optimierten Konfigurationen von Servern und Netzwerkausrüstung, die Hochleistungsrechenleistung liefern.
- Netztopologie-Struktur: Entworfen mit effizienter IB-Stoff und Ethernet-Stoff, um eine reibungslose Datenübertragung und -kommunikation zu gewährleisten.
Software und Dienste:
- Cluster-Engine: Nutzung einer in-house entwickelten Engine zur Verwaltung von Ressourcen wie Bare-Metal, Kubernetes/Container und HPC-Slurm, um eine optimale Ressourcenzuweisung für Benutzer und Administratoren zu ermöglichen.
- Proprietäre Cloud-Plattform: Die CLUSTER-ENGINE ist ein proprietäres Cloud-Management-System, das die Ressourcenplanung optimiert und eine flexible und effiziente Cluster-Management-Lösung bietet
Abfrage-Engine-Roadmap:
- Kontinuierliches Rechnen, hohe SLA garantieren.
- Zeitanteil für Bruchteilszeitnutzung.
- Spot-Instanz
Beratung und maßgeschneiderte Dienste: Bietet Beratung, Datenberichterstattung und maßgeschneiderte Dienste wie Containerisierung, Modellierungsempfehlungen und auf maßgeschneiderte MLOps-Plattformen.
Robuste Sicherheits- und Überwachungsmerkmale: Umfasst rollenbasierte Zugriffssteuerung (RBAC), Benutzergruppenverwaltung, Echtzeit-Überwachung, historische Nachverfolgung und Warnbenachrichtigungen.
Welche sind Ihrer Meinung nach einige der größten Herausforderungen und Chancen für KI-Infrastruktur in den nächsten Jahren?
Herausforderungen:
- Skalierbarkeit und Kosten: Da Modelle komplexer werden, wird die Wahrung von Skalierbarkeit und Wirtschaftlichkeit zu einer Herausforderung, insbesondere für kleinere Unternehmen.
- Energie und Nachhaltigkeit: Der hohe Energieverbrauch erfordert umweltfreundlichere Lösungen, da die Nutzung von KI zunimmt.
- Sicherheit und Datenschutz: Der Schutz von Daten in gemeinsam genutzten Infrastrukturen erfordert eine Weiterentwicklung von Sicherheit und regulatorischer Konformität.
- Interoperabilität: Die fragmentierten Tools im KI-Stack erschweren eine nahtlose Bereitstellung und Integration. Wir können jetzt die Entwicklungszeit um 2x und die Anzahl der Mitarbeiter für ein KI-Projekt um 3x reduzieren.
Chancen:
- Edge-AI-Wachstum: Die KI-Verarbeitung in der Nähe der Datenquellen bietet eine Latenzreduzierung und Bandbreitenkonservierung.
- Automatisierte MLOps: Eine gestreamte Betrieb ermöglicht eine Verringerung der Komplexität bei der Bereitstellung und ermöglicht es Unternehmen, sich auf Anwendungen zu konzentrieren.
- Energieeffiziente Hardware: Innovationen können die Zugänglichkeit verbessern und den Umweltimpact verringern.
- Hybride Cloud: Eine Infrastruktur, die in Cloud- und On-Premises-Umgebungen funktioniert, ist ideal für die Flexibilität von Unternehmen geeignet.
- KI-gesteuerte Verwaltung: Die Verwendung von KI zur autonomen Optimierung der Infrastruktur verringert die Ausfallzeit und steigert die Effizienz.
Können Sie uns Ihre langfristige Vision für GMI Cloud mitteilen? Welche Rolle sehen Sie für GMI Cloud in der Evolution von KI und AGI?
Ich möchte das Internet der KI aufbauen. Ich möchte die Infrastruktur aufbauen, die die Zukunft auf der ganzen Welt antreibt.
Um eine zugängliche Plattform zu schaffen, ähnlich wie Squarespace oder Wix, aber für KI. Jeder sollte in der Lage sein, seine KI-Anwendung zu erstellen.
In den kommenden Jahren wird KI ein erhebliches Wachstum erleben, insbesondere bei generativen KI-Anwendungsfällen, da mehr Branchen diese Technologien integrieren, um Kreativität zu fördern, Prozesse zu automatisieren und Entscheidungen zu optimieren. Die Inferenz wird eine zentrale Rolle in dieser Zukunft spielen und ermöglichen, dass KI-Anwendungen in Echtzeit komplexe Aufgaben effizient und im großen Maßstab bewältigen können. Geschäft-zu-Geschäft-Anwendungsfälle (B2B) werden dominieren, da Unternehmen zunehmend darauf abzielen, KI zu nutzen, um die Produktivität zu steigern, Betriebe zu straffen und neuen Wert zu schaffen. Die langfristige Vision von GMI Cloud stimmt mit diesem Trend überein und zielt darauf ab, fortschrittliche, zuverlässige Infrastruktur bereitzustellen, die Unternehmen bei der Maximierung der Produktivität und des Einflusses von KI in ihren Organisationen unterstützt.
Wenn Sie mit dem neuen Rechenzentrum in Colorado den Betrieb ausbauen, welche strategischen Ziele oder Meilensteine möchten Sie in den nächsten zwölf Monaten erreichen?
Wenn wir mit dem neuen Rechenzentrum in Colorado den Betrieb ausbauen, konzentrieren wir uns auf mehrere strategische Ziele und Meilensteine in den nächsten zwölf Monaten. Die USA sind der größte Markt für KI und KI-Rechenleistung, was es für uns unerlässlich macht, in dieser Region eine starke Präsenz aufzubauen. Die strategische Lage von Colorado, kombiniert mit seinem robusten technologischen Ökosystem und seiner günstigen Geschäftsumgebung, ermöglicht es uns, einen wachsenden Kundenstamm besser zu bedienen und unsere Dienstleistungen zu verbessern.
Welchen Rat würden Sie Unternehmen oder Start-ups geben, die fortschrittliche KI-Infrastruktur übernehmen möchten?
Für Start-ups, die auf KI-getriebene Innovationen fokussieren, sollte die Priorität auf dem Aufbau und der Verfeinerung ihrer Produkte liegen und nicht auf der Verwaltung von Infrastruktur. Partner mit vertrauenswürdigen Technologieanbietern, die zuverlässige und skalierbare GPU-Lösungen anbieten, und vermeiden Sie Anbieter, die mit weiß beschrifteten Alternativen Kompromisse eingehen. Zuverlässigkeit und schnelle Bereitstellung sind entscheidend; in den Anfangsphasen ist Geschwindigkeit oft der einzige Wettbewerbsvorteil, den ein Start-up gegen etablierte Spieler hat. Wählen Sie cloud-basierte, flexible Optionen, die Wachstum unterstützen, und konzentrieren Sie sich auf Sicherheit und Konformität, ohne Agilität zu opfern. Durch diese Maßnahmen können Start-ups nahtlos integrieren, schnell iterieren und ihre Ressourcen in das konzentrieren, was wirklich zählt – die Lieferung eines herausragenden Produkts auf dem Markt.
Vielen Dank für das großartige Interview. Leser, die mehr erfahren möchten, sollten GMI Cloud besuchen,












