Ulasan buku

Ulasan Buku: Large Language Models oleh Stephan Raaijmakers

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

Sebagai seseorang yang memiliki lebih dari lima belas volume dari seri Pengetahuan Esensial MIT Press, saya mendekati setiap rilis baru dengan minat dan kehati-hatian: seri ini sering memberikan ikhtisar yang berpikir dan dapat diakses — tetapi tidak selalu dengan gaya atau kedalaman yang saya harapkan.

Dalam kasus Large Language Models oleh Stephan Raaijmakers, bagaimanapun, penulis mencapai sesuatu yang langka: sebuah buku yang tajam, kaya, dan seimbang yang memperoleh tempat di antara buku AI yang paling saya rekomendasikan.

Bahasa yang Dikonsepsikan Kembali: Dari Seni Manusia ke Komputasi

Salah satu kekuatan paling mencolok dari Large Language Models adalah bagaimana buku ini membingkai kembali “bahasa.” Daripada hanya berfokus pada perspektif filosofis atau sastra, buku ini memperlakukan bahasa sebagai fenomena komputasi — sebuah sistem struktur, pola statistik, dan potensi generatif yang dapat dieksploitasi oleh arsitektur neural modern. Pembingkaian kembali ini tidak sia-sia: Raaijmakers membimbing pembaca melalui cara kerja jaringan neural skala besar dalam mengkode, menganalisis, dan menghasilkan teks berdasarkan reguleritas statistik dalam dataset teks besar — pergeseran halus tetapi kuat dalam cara pembaca memahami sistem ini. Buku ini membuatnya mudah untuk memahami bahwa bahasa, ketika dilihat melalui lensa komputasi, menjadi sesuatu yang dapat dimodelkan oleh mesin daripada sesuatu yang misterius atau tidak jelas.

Pembingkaian kembali ini mendemistifikasi apa yang dilakukan LLM. Daripada menggambarkan mereka sebagai “pemaham” mistis dari makna, Raaijmakers menunjukkan bagaimana mereka mengapproximasi bahasa: memprediksi token berikutnya, memodelkan sintaksis dan semantik secara statistik, dan merekreasikan output bahasa yang masuk akal berdasarkan distribusi yang dipelajari. Dengan kata lain — mereka tidak “berpikir” dalam arti manusia; mereka menghitung, secara statistik. Bagi banyak pembaca — terutama mereka yang tidak memiliki latar belakang matematika atau ilmu kognitif yang dalam — ini adalah pandangan yang menjernihkan dan sehat. Buku ini kemudian mengubah mistik yang luas seputar LLM menjadi sesuatu yang lebih berbasis, lebih dapat dipahami.

Dari Data ke Perilaku: Bagaimana LLM Belajar — dan Bagaimana Mereka Diselaraskan

Setelah membangun apa itu bahasa (secara komputasi), buku ini melanjutkan ke bagaimana model belajar. Raaijmakers menjelaskan dalam istilah yang dapat diakses bagaimana LLM kontemporer dibangun (jaringan neural dalam, mekanisme perhatian, arsitektur transformer) dan bagaimana mereka berkembang dari mesin pemecahan pola menjadi alat yang lebih terarah dan dapat digunakan.

Bagian kritis dari evolusi tersebut adalah penggunaan umpan balik manusia dengan menggunakan pembelajaran penguatan dari umpan balik manusia (RLHF) — sebuah teknik di mana output LLM dievaluasi atau diberi peringkat oleh manusia, dan model diperbarui untuk lebih memilih output yang dianggap lebih berguna, lebih aman, atau selaras dengan nilai-nilai manusia. Buku ini menggambar perbedaan (secara implisit dan eksplisit) antara fase dasar — pra-pelatihan pada volume besar teks untuk mempelajari reguleritas statistik — dan fase penyelarasan, di mana penilaian manusia membentuk perilaku model. Perbedaan ini sangat penting: pra-pelatihan memberikan LLM kelancaran dan pengetahuan umum; RLHF (atau pembaruan berbasis umpan balik) membimbingnya menuju perilaku yang diinginkan.

Dengan melakukan hal ini, Raaijmakers tidak mengabaikan kompleksitas atau risiko. Ia mengakui bahwa umpan balik manusia dan penyelarasan berbasis hadiah tidak sempurna: bias dalam umpan balik, penilaian manusia yang tidak merata, overfitting ke model hadiah, dan perilaku yang tidak terduga dalam konteks baru — semua keterbatasan yang sah. Dengan menolak untuk mengidealakan RLHF, buku ini mempertahankan kredibilitas.

Apa yang Dapat Dilakukan LLM dan Apa yang Tidak Dapat Dilakukan

Raaijmakers sangat baik dalam menguraikan kekuatan dan keterbatasan LLM. Di sisi positif: LLM modern sangat serbaguna. Mereka dapat menerjemahkan bahasa, meringkas teks, menghasilkan kode, menghasilkan tulisan kreatif, mengarang esai, menjawab pertanyaan, dan membantu dalam banyak domain — secara esensial, setiap tugas yang dapat direduksi menjadi “input teks → output teks.” Dengan skala dan data yang cukup, kelancaran generatif mereka sering mengesankan, terkadang tidak terduga.

Pada saat yang sama, buku ini tidak menghindari keterbatasan fundamental mereka. LLM tetaplah pemecahan pola statistik, bukan pemikir sejati: mereka dapat menghasilkan informasi palsu, menghasilkan output yang masuk akal tetapi salah, mereplikasi bias dan stereotip yang ada dalam dataset pelatihan, dan gagal dalam konteks yang memerlukan pemahaman dunia nyata, penalaran umum, atau kohesi jangka panjang. Penanganan Raaijmakers terhadap kegagalan ini adalah tenang — tidak alarmis, tetapi realistis — memperkuat bahwa meskipun LLM kuat, mereka bukanlah sihir.

Pendekatan seimbang ini sangat berharga — itu menghindari dua perangkap hype dan pesimisme. Pembaca pergi dengan pemahaman yang jelas tentang apa yang dapat dilakukan LLM dan apa yang tidak dapat mereka lakukan.

Kesempatan dan Tanggung Jawab: Janji Sosial dan Bahaya

Di mana banyak primer teknis berhenti pada arsitektur atau kasus penggunaan, Large Language Models melanjutkan lebih jauh — ke dampak sosial, politik, dan etis dari teknologi ini. Dalam bab seperti “Kesempatan Praktis” dan “Risiko dan Kekhawatiran Sosial”, Raaijmakers mengundang pembaca untuk mempertimbangkan bagaimana LLM dapat mengubah kreativitas, produktivitas, komunikasi manusia, media, dan lembaga.

Di sisi kesempatan: potensi sangat besar. LLM dapat mendemokratisasikan akses ke penulisan, terjemahan, pemrograman. Mereka dapat mempercepat penelitian, pendidikan, dan ekspresi kreatif. Mereka dapat membantu mereka yang berjuang dengan bahasa atau menulis. Mereka dapat menggeser bagaimana media diproduksi dan dikonsumsi. Dalam dunia yang menghadapi beban informasi yang substansial, LLM mungkin membantu menjembatani kesenjangan — jika digunakan dengan bijak.

Tetapi Raaijmakers tidak menghindari sisi gelap. Ia menaikkan peringatan: tentang informasi yang salah dan “kebenaran yang dihalusinasi”, tentang bias yang tertanam, tentang erosi penilaian manusia, tentang ketergantungan yang berlebihan pada model yang rusak — semua risiko yang sudah didokumentasikan dalam diskusi etika AI yang lebih luas.

Kunci, lensa sosial ini membuat buku ini berharga tidak hanya untuk insinyur dan peneliti tetapi juga untuk pembuat kebijakan, pendidik, dan setiap warga negara yang berpikir. Ini mengakar LLM dalam konteks dunia nyata, bukan hanya hype abstrak.

Apa yang Datang Selanjutnya — dan Seruan untuk Kewaspadaan

Bab terakhir, “Apa yang Datang Selanjutnya?”, tidak berpura-pura bahwa LLM saat ini adalah kata terakhir. Sebaliknya, Raaijmakers mendorong perspektif yang berorientasi ke depan: bagaimana LLM dapat berkembang? Bagaimana kita dapat memperbaiki penyelarasan, transparansi, keadilan? Apa prinsip desain, regulasi, dan tata kelola yang akan melindungi masyarakat ketika model ini berkembang?

Bagi saya — sebagai seseorang yang sangat berinvestasi dalam katalog Pengetahuan Esensial, menyadari bahwa beberapa volume tidak memuaskan — buku ini layak untuk dianggap sebagai salah satu yang terbaik. Klaritas, keseimbangan, landasan teknis, dan kesadaran sosial membuatnya menonjol. Ini mencapai keseimbangan yang langka antara penjelasan yang dapat diakses dan kritik yang serius.

Oleh karena itu, saya mendesak semua orang yang membangun, menerapkan, atau berinteraksi dengan LLM — pengembang, organisasi, pembuat kebijakan, dan pengguna sehari-hari — untuk menjaga mata yang waspada, kritis, dan terinformasi. Tuntut transparansi. Dorong data pelatihan yang beragam dan representatif. Insistensi pada evaluasi yang ketat. Tanyakan output. Jangan perlakukan LLM sebagai orakel, tetapi sebagai alat kuat — alat yang kekuatannya harus diimbangi dengan perawatan, tanggung jawab, dan penilaian manusia.

Putusan Akhir

Large Language Models bukan hanya primer teknis lain — ini adalah panduan yang tepat waktu, tajam, dan sangat dipertimbangkan untuk salah satu teknologi paling konsekuensial di zaman kita. Ini menggabungkan penjelasan yang dapat diakses dengan refleksi yang tenang; detail teknis yang jelas dengan kesadaran sosial yang luas; pengaguman potensi dengan realisme yang hati-hati tentang risiko.

Bagi siapa pun — insinyur, peneliti, siswa, pembuat kebijakan, warga negara yang ingin tahu — yang mencari untuk memahami apa itu LLM, apa yang dapat dan tidak dapat mereka lakukan, dan apa yang mungkin mereka maksudkan untuk masa depan kita — buku Large Language Models oleh Stephan Raaijmakers adalah bacaan yang esensial.

Antoine adalah seorang pemimpin visioner dan rekan pendiri Unite.AI, yang dipandu oleh semangat tak tergoyahkan untuk membentuk dan mempromosikan masa depan AI dan robotika. Sebagai seorang wirausaha serial, ia percaya bahwa AI akan menjadi sangat mengganggu masyarakat seperti listrik, dan sering tertangkap berbicara tentang potensi teknologi disruptif dan AGI.

Sebagai seorang futuris, ia berdedikasi untuk mengeksplorasi bagaimana inovasi ini akan membentuk dunia kita. Selain itu, ia adalah pendiri Securities.io, sebuah platform yang berfokus pada investasi di teknologi-teknologi canggih yang mendefinisikan kembali masa depan dan membentuk kembali seluruh sektor.