Large language model, dijelaskan
Large language model, sering disingkat LLM, berada di balik banyak alat AI untuk menulis, menjawab pertanyaan, dan percakapan. Model ini mengubah teks menjadi token dan bekerja dengan hubungan antar token tersebut.
Large language model adalah model deep learning yang dilatih pada data dalam jumlah besar sehingga dapat memahami prompt dan menghasilkan bahasa alami dan konten lainnya.
LLM memprediksi token berikutnya
LLM tidak menyiapkan jawaban lengkap sebelum mulai menulis. Model ini memprediksi satu token, menambahkan token tersebut ke urutan, dan mengulangi prosesnya.
Prediksi tersebut menggunakan pola yang dipelajari selama pelatihan dan materi dalam prompt saat ini. Proses ini dapat menghasilkan jawaban yang lancar tanpa menjamin bahwa setiap pernyataan benar.
Aplikasi di sekitarnya menambahkan kontrol
Model hanyalah satu bagian dari aplikasi AI. Aplikasi dapat menambahkan instruksi, menyediakan dokumen bisnis, membatasi tindakan yang tersedia, atau meminta seseorang untuk menyetujui hasil.
Kontrol tersebut mengubah informasi apa yang diterima model dan apa yang dapat terjadi setelah model merespons. Kontrol ini tidak mengubah proses dasar token-berikutnya di dalam model.
Istilah large language model
- Token
- Unit teks, seperti kata, bagian dari kata, atau tanda baca, yang diproses oleh model.
- Transformer
- Desain jaringan saraf yang membantu model melacak hubungan di seluruh urutan teks.
- Inference
- Proses menggunakan model yang telah dilatih untuk menghasilkan jawaban dari prompt baru.
Apa yang membentuk respons LLM
Prompt
Instruksi dan konteks saat ini memberi tahu model respons apa yang harus dihasilkan.
Pelatihan
Pola yang dipelajari dari data pelatihan membentuk kata-kata yang diprediksi model.
Batas konteks
Model hanya dapat mempertimbangkan materi yang muat dalam jendela konteksnya.
Pertanyaan tentang large language model
Model ini memproses prompt dan menghasilkan urutan token. Ini mendukung tugas seperti membuat draf, meringkas, mengklasifikasikan teks, dan menjawab pertanyaan.
LLM menggunakan hubungan statistik yang dipelajari dari data. Bahasa yang lancar tidak membuktikan pemahaman manusia atau pengetahuan faktual.
Model ini memprediksi teks yang mungkin daripada memeriksa setiap klaim terhadap sumber. Aplikasi dapat menambahkan informasi terpercaya dan langkah peninjauan untuk mengurangi risiko tersebut.
Istilah glosarium terkait
Manfaatkan bahasa yang jelas
Aplikasi Caffeine berjalan di Internet Computer, jaringan publik yang dibangun untuk ini.