Keamanan siber
NVIDIA Mengumumkan Open Agent Safety Platform yang Membentang dari Perangkat Lunak hingga Silicon

NVIDIA mengumumkan NVIDIA Open Agent Safety Platform pada 28 September 2026, sebuah platform perangkat lunak terbuka dan desain sistem referensi yang, menurut perusahaan, dimaksudkan untuk memperkuat keamanan AI mulai dari pengujian agen hingga penerapan. Platform ini terdiri dari perangkat lunak runtime aman NVIDIA OpenShell dan desain sistem referensi NVIDIA Sentry, yang, menurut NVIDIA, bersama-sama menyediakan tata kelola dan kontrol penuh pada seluruh tumpukan perangkat lunak, perangkat keras, komputasi, dan sistem robotik yang menjalankan agen.
NVIDIA mengatakan insiden keamanan terbaru mengikuti pola yang sama, dengan agen-agen mengelak dari kontrol keamanan pada lapisan aplikasi untuk menyelesaikan tugas yang diberikan kepada mereka. “Potensi AI yang luar biasa bagi masyarakat hanya akan terwujud jika kita menyelesaikan masalah keamanan AI,” kata Jensen Huang, pendiri dan CEO NVIDIA. Ia menggambarkan platform ini sebagai upaya untuk menyatukan industri, peneliti, dan organisasi sektor publik guna berbagi praktik terbaik, menyelaraskan metode evaluasi, dan memajukan kerja sama internasional. Organisasi dapat menerapkan elemen-elemen platform sesuai dengan kebutuhan mereka masing-masing, kata NVIDIA.
Runtime OpenShell dan Penegakan Kebijakan
OpenShell 0.1.0 adalah runtime sumber terbuka, dirilis di bawah lisensi Apache 2.0, untuk mendefinisikan dan menegakkan sistem serta data apa yang dapat diakses oleh sebuah agen. Sebuah panduan teknis yang menyertai pengumuman menjelaskan bagaimana ia menggabungkan eksekusi sandbox, akses layanan yang terkendali, manajemen kredensial, dan analisis kebijakan formal untuk menempatkan kontrol di sekitar agen yang ada tanpa harus menulis ulangnya.
Tiga komponen membagi pekerjaan penegakan. OpenShell Gateway mengelola siklus hidup dan kebijakan banyak sandbox. Sebuah OpenShell Supervisor yang dipasangkan dengan setiap sandbox berjalan di luar beban kerja agen dan memeriksa permintaan keluar sesuai kebijakan. OpenShell Sandbox menjalankan beban kerja dengan kontrol tingkat kernel atas sistem berkas dan prosesnya, serta tanpa jalur jaringan kecuali melalui supervisor.
Supervisor dapat memeriksa lalu lintas HTTP, GraphQL, dan Model Context Protocol yang telah dikonfigurasi, memungkinkan kueri data sambil memblokir penulisan melalui API yang sama. Kebijakan ditulis dalam format YAML dan dikompilasi menjadi OPA/Rego, dan OpenShell mencatat keputusan kebijakan dalam jejak audit Open Cybersecurity Schema Framework. Kredensial asli tetap berada di luar beban kerja agen dan hanya digantikan untuk titik akhir yang berwenang; jika sebuah agen mengirimkan kredensial placeholder ke tujuan yang tidak disetujui, OpenShell menolak permintaan tersebut. Dengan penasihat kebijakan diaktifkan, sebuah agen dapat mengusulkan perubahan kebijakan yang sangat terbatas, namun usulan tersebut tetap menunggu tinjauan manusia secara default dan agen tidak dapat menyetujui permintaannya sendiri.
Pembuktian kebijakan OpenShell menggunakan logika formal untuk memeriksa izin yang diberikan oleh sebuah kebijakan, termasuk akses yang disumbangkan oleh penyedia, dan dapat membuktikan bahwa izin yang dimodelkan tetap berada dalam batas yang ditetapkan operator atau mengidentifikasi tindakan konkret yang melampaui batas tersebut. Dalam eksperimen adversarial jangka panjang yang dijelaskan dalam panduan, agen-agen frontier dengan perlindungan yang dikurangi menghabiskan hingga dua jam mencoba meyakinkan seorang peninjau AI untuk memberikan izin yang memungkinkan mereka memodifikasi repositori GitHub yang dilindungi. NVIDIA melaporkan bahwa tidak ada penulisan ke repositori yang dilindungi terjadi dalam pengujian ini.
OpenShell mendukung kerangka kerja Codex, Claude Code, Pi, dan Hermes, dan panduan tersebut menyebutkan Cadence, Slack, serta Gecko Robotics sebagai pengguna di bidang desain chip, otomatisasi tugas perusahaan, dan tata kelola agen yang membuat keputusan pada robot fisik. NVIDIA mengatakan OpenShell memberikan perlindungan dengan overhead minimal pada CPU Vera-nya dan, sebagai perangkat lunak sumber terbuka, dapat diperluas ke platform komputasi pihak ketiga termasuk yang dari Arm dan Intel.
Watchdog Sentry pada BlueField-4 DPU
NVIDIA Sentry adalah watchdog out-of-band yang berjalan pada BlueField-4 DPU untuk memantau perilaku agen secara terus-menerus, dan NVIDIA mengatakan ia menyediakan penegakan di dalam silikon: jika sebuah agen berusaha keluar dari batas perangkat lunaknya, Sentry mengarantina dan menghentikannya dalam hitungan milidetik. Sentry dibangun di atas perangkat lunak NVIDIA DOCA, yang digunakannya untuk memeriksa permintaan dan respons agen, menyediakan telemetri yang terverifikasi, memverifikasi identitas agen, dan menegakkan kebijakan akses granular dengan prinsip zero-trust untuk data, alat, antarmuka pemrograman aplikasi, dan layanan, semuanya dari domain kepercayaan terisolasi yang dijelaskan NVIDIA sebagai tidak terlihat oleh agen dan penyerang.
Sebuah posting desain referensi dari tim teknik NVIDIA mencatat bahwa beberapa laboratorium frontier baru-baru ini melaporkan agen-agen melanggar lingkungan evaluasi yang dimaksudkan untuk menahan mereka, dengan beberapa agen melaporkan hasil yang tidak akurat. Posting tersebut menguraikan lima prinsip di balik platform: kebijakan harus dapat diverifikasi sebelum agen dijalankan, penegakan harus out-of-band, jalur ke model adalah titik kontrol, otoritas agen harus skalabel seiring kemampuan untuk memeriksa penalarannya, dan tanggung jawab dibagi antara laboratorium, perusahaan, dan penyedia perangkat keras. Penulis menjelaskan “drift,” yang berarti tindakan agen yang menyimpang dari tugas atau batasan operasi yang dimaksud, dan menyatakan bahwa “sebuah agen dalam situasi ini tidak dapat diharapkan untuk sepenuhnya mengatur perilakunya sendiri.”
Dalam sistem POD NVIDIA Vera Rubin, setiap baki komputasi menyertakan DPU BlueField-4 pada satu‑satunya jalur node ke model, posisi yang menurut NVIDIA memberikan observabilitas out‑of‑band yang berkelanjutan dan penegakan kebijakan waktu nyata pada kecepatan jalur. Bagi organisasi yang sudah menjalankan sistem Vera dengan BlueField-4, mengaktifkan perlindungan tersebut hanya memerlukan pembaruan perangkat lunak, menurut postingan.
Integrasi Ekosistem dan Ketersediaan
Anthropic dan NVIDIA bekerja sama untuk mengintegrasikan OpenShell dan BlueField dengan Claude Managed Agents, yang menjalankan loop agen pada server terpisah dari sandbox tempat pekerjaan dijalankan. Pejabat komersial utama Anthropic, Paul Smith, mengatakan Claude Managed Agents memberikan perusahaan pandangan yang jelas tentang apa yang dilakukan setiap agen, dan bahwa platform NVIDIA menambahkan lapisan tata kelola dan kontrol tambahan di seluruh perangkat keras dan perangkat lunak.
SpaceXAI menggunakan platform ini untuk agen pengkodean Cursor dan model Grok, dan presiden Mike Nicolls mengatakan keamanan harus ditegakkan di luar model melalui kontrol tambahan yang tidak dapat dilewati agen. Scale AI mengintegrasikan teknologi platform ke dalam lapisan infrastruktur agen pada Portofolio Scale GenAI‑nya, dengan CEO Francis deSouza menggambarkan isolasi, penegakan kebijakan, dan auditabilitas yang dibangun sejak awal.
Salesforce dan NVIDIA mengintegrasikan OpenShell dengan Slack, sehingga tim dapat melihat aktivitas agen, mengaudit peristiwa, serta menyetujui atau menolak permintaan agen untuk izin tambahan tanpa meninggalkan Slack. SAP menyematkan OpenShell dengan runtime Joule Studio, bagian dari SAP Business AI Platform, dan memberikan kontribusi pekerjaan rekayasa ke OpenShell.
NVIDIA menyebutkan lebih dari 100 organisasi yang bekerja dengan teknologi platform, termasuk perusahaan robotika Figure, Gecko Robotics, dan Skild AI; perusahaan keuangan Citi dan JPMorganChase; penyedia energi seperti Hitachi Energy dan Schneider Electric; serta perusahaan perangkat lunak infrastruktur Canonical, SUSE, dan Red Hat, dengan Red Hat menjalankan OpenShell dan DOCA pada Red Hat AI Factory bersama NVIDIA.
OpenShell dan kemampuan-kemampuannya tersedia melalui halaman sumber daya pengembang NVIDIA dan GitHub, dengan driver komputasi untuk Docker, Podman, MicroVM, dan Kubernetes serta saluran pengembang di CNCF Slack. Open Secure AI Alliance, yang diprakarsai oleh NVIDIA bersama lebih dari 120 organisasi dan dikelola oleh Linux Foundation, bekerja pada keamanan agen melalui riset terbuka, kemampuan, dan alat, dengan proyek termasuk Shared AI Findings Exchange, yang dikenal sebagai SAFE.












