Apa itu Token dalam AI?

Apa itu Token dalam AI? [Video dan Kuis]

Jawaban singkat: Token adalah potongan kecil teks atau data yang diubah oleh model AI menjadi angka dan diproses. Token memengaruhi biaya, kecepatan, memori, dan panjang keluaran. Ketika sebuah perintah melebihi jendela konteks, konten penting dapat dipotong, diringkas, atau dihilangkan.

Poin-poin penting:

Tokenisasi: Kata, tanda baca, spasi, dan kode dapat dibagi dengan berbagai cara.

Konteks: Pertahankan informasi penting dalam jendela token yang tersedia pada model.

Biaya: Mengurangi instruksi berulang dan teks yang tidak perlu dalam alur kerja AI bervolume tinggi.

Kejelasan: Nyatakan tugas utama sejak awal dan susun persyaratan dengan label yang jelas.

Efisiensi: Bagi dokumen berukuran besar menjadi bagian-bagian logis sebelum menggabungkan temuannya.

Apa itu token dalam AI? Infografis

Artikel-artikel yang mungkin ingin Anda baca setelah ini:

🔗 Apa saja jenis-jenis AI?
Pahami kategori AI berdasarkan kemampuan, fungsi, gaya pelatihan, dan penggunaan praktisnya.

🔗 Apa itu kacamata AI?
Jelajahi fitur kacamata pintar, penggunaan tanpa tangan, privasi, dan keterbatasan praktisnya.

🔗 Apa itu AI TV?
Pelajari bagaimana AI meningkatkan kualitas gambar, suara, pencarian, rekomendasi, dan aksesibilitas.

🔗 Apa itu AI slop?
Kenali konten AI berkualitas rendah dan tingkatkan akurasi, orisinalitas, dan tujuan.


1. Apa itu Token dalam AI? Jawaban Sederhananya

Dalam AI, token adalah unit teks yang digunakan model untuk memahami dan menghasilkan bahasa .

Sebagai contoh, kalimat:

Saya suka pizza.

Mungkin dapat dipecah menjadi token seperti:

  • SAYA

  • Cinta

  • pizza

  • .

Cukup sederhana.

Namun, tidak selalu sesederhana itu. Kata yang lebih panjang atau tidak biasa mungkin dipecah menjadi bagian-bagian yang lebih kecil. Misalnya:

sulit dipercaya

Bisa jadi seperti ini:

  • tidak

  • percaya

  • mampu

Sistem AI yang berbeda menggunakan tokenizer yang berbeda, sehingga pembagian pastinya dapat bervariasi. Itulah mengapa token terasa agak sulit dipahami. Token bukanlah kata-kata yang tepat, bukan huruf yang tepat, dan tidak selalu suku kata.

Cara yang lebih baik untuk memikirkannya adalah sebagai berikut:

Token adalah potongan-potongan bahasa berukuran kecil yang dapat dicerna oleh model AI. 🍽️

Saat Anda mengajukan pertanyaan kepada chatbot, sistem tidak menyerap kalimat Anda sebagai satu kesatuan pikiran manusia. Sistem memecah input menjadi token, mengubahnya menjadi angka, memproses hubungannya, dan kemudian memprediksi token berikutnya yang paling mungkin, berulang kali, hingga membentuk sebuah jawaban.

Jadi, ketika orang bertanya, Apa itu Token dalam AI?,jawabannya bukan hanya "sepotong teks." Token adalah unit kerja dasar yang memungkinkan AI bahasa.


2. Mengapa Token Lebih Penting dari yang Diperkirakan Orang

Token itu penting karena memengaruhi hampir semua hal tentang cara kerja alat AI.

Mereka memengaruhi:

  • Seberapa banyak teks yang dapat ditangani AI sekaligus

  • Berapa biaya sebuah permintaan dalam banyak sistem AI?

  • Seberapa cepat model merespons

  • Seberapa detail model tersebut dapat mengingat informasi yang ada

  • Seberapa akurat model tersebut memahami perintah Anda

  • Seberapa panjang jawabannya?

Di sinilah letak kepraktisannya yang mengejutkan.

Ketika sebuah alat AI mengatakan bahwa ia memiliki "jendela konteks," itu biasanya berarti jumlah maksimum token yang dapat dipertimbangkannya dalam satu waktu. Perintah Anda, riwayat percakapan, teks yang diunggah, instruksi sistem, dan jawaban model semuanya menggunakan token.

Jadi, jika Anda menempelkan dokumen yang sangat besar ke dalam asisten AI dan kemudian bertanya, "Ringkas ini," model tersebut harus menyesuaikan teks tersebut ke dalam batas tokennya. Jika konten terlalu panjang, sebagian mungkin akan terpotong, dikompresi, atau diabaikan tergantung pada bagaimana alat tersebut dirancang.

Token bukan sekadar informasi teknis yang sepele. Token adalah ruang kerja AI. Terlalu banyak kertas di meja, dan barang-barang akan mulai tergeser ke tepi meja 📄.


3. Token Tidak Sama dengan Kata

Ini mungkin kesalahpahaman terbesar.

Token tidak selalu berupa satu kata.

Terkadang satu kata sama dengan satu token. Terkadang satu kata menjadi beberapa token. Terkadang tanda baca atau spasi dihitung sebagai token tersendiri. Mengganggu? Sedikit. Penting? Sangat penting.

Berikut contoh sederhananya:

Contoh Teks Kemungkinan Pembagian Token Apa Artinya Itu
kucing kucing Satu kata sederhana, kemungkinan satu simbol
kucing kucing atau kucing + s Tergantung pada tokenizernya
internasionalisasi internasionalisasi atau bagian yang lebih kecil Kata-kata panjang sering dipisahkan
Didukung oleh AI AI + - + didukung Tanda baca mungkin penting
Hai!!! Hai + ! + ! + ! Ya, tanda baca juga bisa memakan token
superkalifragilistik beberapa potongan, mungkin Model itu menghela napas dalam hati, kurasa 😅

Tidak ada aturan universal yang berlaku sempurna untuk setiap model.

Perkiraan kasar yang umum adalah bahwa satu token sering kali mewakili beberapa karakter atau bagian dari sebuah kata. Tetapi itu hanyalah aturan umum, bukan kebenaran mutlak. Teks bahasa Inggris biasanya di-tokenisasi lebih efisien daripada beberapa bahasa lain, dan kode dapat berperilaku berbeda lagi.

Inilah mengapa kalimat yang tampak pendek mungkin menggunakan lebih banyak token daripada yang diperkirakan. Dan paragraf panjang yang berisi kata-kata umum mungkin akan dipecah menjadi token dengan lebih lancar daripada paragraf yang penuh dengan istilah teknis, simbol, atau format yang tidak biasa.


4. Bagaimana AI Menggunakan Token untuk Menghasilkan Teks

Inilah bagian yang sedikit ajaib - meskipun ini hanyalah matematika yang mengenakan topi penyihir 🧙.

Saat Anda mengetikkan perintah, sistem AI akan melakukan hal seperti ini:

  1. Memisahkan teks Anda menjadi token

  2. Mengubah setiap token menjadi angka atau representasi numerik

  3. Menganalisis pola dan hubungan token

  4. Memprediksi token berikutnya yang kemungkinan besar akan muncul

  5. Mengulangi proses prediksi tersebut

  6. Mengubah token yang dihasilkan kembali menjadi teks yang dapat dibaca

Jadi jika Anda mengetik:

Langit adalah

Model tersebut mungkin memprediksi:

biru

Namun, hal itu juga dapat memprediksi:

berawan,
hujan,
bukan batasnya
, penuh bintang

Output yang dipilih bergantung pada model, perintah, konteks, dan pengaturan yang mengontrol keacakan atau kreativitas.

Inilah mengapa tulisan AI terkadang terasa lancar dan terkadang melenceng ke hal-hal yang tidak penting. AI memprediksi setiap kalimat berdasarkan pola yang dipelajari, bukan mengambil kalimat jadi dari lemari arsip.

Itu bukan berarti model tersebut "hanya sekadar pelengkap otomatis" dalam arti yang membosankan. Model AI besar mempelajari hubungan yang sangat kompleks antara konsep, bahasa, struktur, nada, logika, dan konteks. Tetapi pada tingkat keluaran, mesin tetap menghasilkan teks satu token pada satu waktu.

Langkah-langkah kecil. Ilusi besar. Tangga yang sangat mewah.


5. Tabel Perbandingan: Jenis-Jenis Token dalam AI

Token dapat muncul dalam berbagai bentuk tergantung pada model, tokenizer, dan tipe konten. Berikut perbandingan praktisnya.

Jenis Token Contoh Di Mana Itu Muncul Mengapa Ini Penting
Token kata apel Petunjuk teks sederhana Mudah dipahami, rapi dan teratur
Token subkata bermain + ing Kata-kata yang lebih panjang atau dimodifikasi Membantu AI menangani kata-kata yang tidak dikenal
Token karakter a, b, c Beberapa sistem tokenisasi Fleksibel, tetapi bisa jadi tidak efisien
Token tanda baca ., ?, ! Segala jenis tulisan, sungguh menjengkelkan Memengaruhi nada dan jumlah token
Token spasi putih spasi, pemisah baris Teks dan kode yang diformat Pemformatan itu tidak gratis, sayangnya
Kode token fungsi, {, == Perintah pemrograman Kode tersebut dapat membakar token dengan cepat
Token khusus penanda awal/akhir Di belakang layar Membantu input struktur model
Potongan yang tidak diketahui atau langka fragmen yang tidak biasa Nama, bahasa gaul, kesalahan ketik Bisa sedikit memengaruhi akurasi

Tidak semua model AI menggunakan semua ini dengan cara yang sama. Beberapa sistem sangat bergantung pada tokenisasi subkata karena menyeimbangkan efisiensi dengan fleksibilitas. Hal ini memungkinkan model untuk menangani kata-kata yang belum pernah dilihatnya secara persis sebelumnya dengan memecahnya menjadi bagian-bagian yang dikenalinya.

Sebagai contoh, jika model tersebut memahami mikro, bio, dan logi, ia memiliki peluang lebih baik untuk menangani kata-kata ilmiah yang kompleks bahkan ketika kata-kata tersebut tidak umum.

Tidak sempurna. Tapi cukup cerdas. 🧩


6. Apa itu Token dalam AI? Mengapa Hal Itu Mempengaruhi Biaya?

Banyak alat AI mengukur penggunaan dalam token.

Artinya, baik input Anda maupun output AI dapat dihitung sebagai penggunaan token. Jika Anda mengirimkan perintah yang panjang, itu akan menggunakan lebih banyak token. Jika model menulis jawaban yang panjang, itu juga akan menggunakan lebih banyak token.

Pertanyaan singkat seperti:

Jelaskan gravitasi.

Menggunakan relatif sedikit token masukan.

Namun, perintah ini:

Jelaskan gravitasi secara detail dan mudah dipahami oleh pemula, sertakan contoh, bandingkan dengan magnetisme, tambahkan tabel, tulis ulang untuk anak-anak, lalu ubah menjadi pidato.

Menggunakan lebih banyak token input, dan juga meminta output yang lebih panjang.

Jadi, biaya token seringkali berasal dari kedua belah pihak:

  • Token input - apa yang Anda kirim ke model.

  • Token keluaran - apa yang dihasilkan oleh model.

  • Token konteks - percakapan atau dokumen sebelumnya disertakan

  • Token sistem - instruksi tersembunyi yang memandu perilaku.

Inilah mengapa obrolan yang sangat panjang bisa terasa lebih lambat atau lebih terbatas. AI mungkin membawa bagian-bagian awal percakapan dalam konteksnya. Seperti ransel yang penuh dengan batu bata. Batu bata yang berharga, tetapi tetap saja batu bata.

Bagi bisnis yang menggunakan AI melalui API, efisiensi token dapat menjadi masalah anggaran. Sebuah perintah yang berbelit-belit dan diulang ribuan kali dapat membuang banyak uang. Perintah yang lebih sederhana tidak hanya lebih menarik, tetapi juga bisa lebih murah.


7. Batasan Token dan Jendela Konteks AI

Jendela konteks adalah salah satu ide terpenting yang terkait dengan token.

Ini mengacu pada berapa banyak token yang dapat diproses oleh model AI sekaligus. Ini termasuk perintah Anda, pesan sebelumnya, dokumen yang disalin, instruksi, dan respons yang sedang dihasilkan.

Bayangkan AI memiliki papan tulis. Semua hal yang perlu dipertimbangkan harus muat di papan tulis itu. Setelah papan tulis penuh, sesuatu harus dikorbankan.

Hal itu dapat menyebabkan beberapa situasi:

  • Model tersebut mungkin lupa bagian-bagian awal dari percakapan panjang

  • Suatu dokumen mungkin perlu diringkas sebelum dianalisis

  • Pertanyaan yang panjang mungkin menyisakan sedikit ruang untuk jawaban yang panjang

  • Konteks yang berulang dapat mengesampingkan detail-detail penting

  • Model tersebut mungkin akan lebih fokus pada informasi terkini

Inilah mengapa desain yang cepat sangat penting.

Sebuah perintah seperti:

Bacalah semua ini dan beri tahu saya apa yang penting.

Bisa berhasil, tetapi mungkin bukan pilihan ideal.

Sebuah pertanyaan yang lebih baik mungkin berbunyi:

Ringkaslah argumen utama, sebutkan risiko-risikonya, identifikasi kontradiksi, dan berikan lima poin tindakan utama.

Hal itu memberikan tugas yang lebih jelas kepada model dan membantunya menggunakan token untuk pekerjaan yang berharga daripada menebak maksud Anda.

Token bukan hanya batasan teknis. Token membentuk cara Anda berkomunikasi dengan AI.


8. Mengapa Tokenisasi Membantu AI Menangani Bahasa yang Sulit Diatur

Bahasa manusia itu sulit diatur. Sulit diatur secara agresif.

Orang-orang menggunakan bahasa gaul, kesalahan ketik, emoji, singkatan, peralihan kode, nama merek, tagar, kata-kata yang diciptakan sendiri, dan fragmen kalimat yang tampak seperti jatuh dari tangga.

Tokenisasi membantu AI mengatasi kerumitan tersebut.

Alih-alih perlu menghafal setiap kata yang mungkin, model ini dapat membagi teks yang tidak dikenal menjadi bagian-bagian yang lebih kecil dan sudah dikenal. Hal ini membantu dalam hal:

  • Kesalahan ejaan

  • Istilah baru

  • Kata majemuk

  • Kosakata teknis

  • Nama-nama

  • Bahasa gaul internet

  • Emoji dan simbol

  • Sintaks pemrograman

Sebagai contoh, sebuah kata seperti:

ultrapersonalisasi

Mungkin tidak diperlakukan sebagai satu kata yang familiar. Tetapi AI mungkin mengenali bagian-bagian seperti:

  • ultra

  • pribadi

  • isasi

Itu memberinya peluang untuk menang.

Inilah juga mengapa tokenisasi berharga di berbagai bahasa. Beberapa bahasa memiliki spasi yang jelas antar kata. Bahasa lain tidak menggunakan spasi dengan cara yang sama. Beberapa memiliki bentuk kata yang kaya. Beberapa menggabungkan ide menjadi kata majemuk yang panjang. Sistem token membantu menstandarisasi semua itu menjadi unit yang dapat diproses.

Memang tidak terlihat anggun. Lebih mirip memotong sayuran dengan kalkulator. Tapi berhasil 🥕.


9. Token dalam Teks, Gambar, Audio, dan AI Multimodal

Istilah token dalam AI biasanya muncul dalam model teks, tetapi gagasan yang lebih luas dapat diterapkan di luar teks juga.

Dalam AI multimodal, sistem dapat memproses gambar, audio, video, atau data terstruktur menggunakan unit-unit seperti token. Detailnya berbeda, tetapi ide intinya serupa: membagi informasi kompleks menjadi bagian-bagian yang lebih kecil yang dapat diproses oleh model.

Misalnya:

  • Teks dapat dipisahkan menjadi token kata atau subkata

  • Gambar dapat dibagi menjadi bagian-bagian atau representasi visual.

  • Audio dapat dipecah menjadi segmen berdasarkan waktu atau unit yang dikodekan

  • Kode dapat dipecah menjadi token yang terkait dengan sintaksis

  • Tabel dapat diubah menjadi rangkaian token terstruktur

Hal ini penting karena AI modern semakin bukan hanya sekadar "obrolan". AI dapat menginterpretasikan tangkapan layar, mendeskripsikan gambar, menganalisis grafik, mentranskripsikan audio, bernalar di atas kode, dan merespons dalam berbagai format.

Namun prinsip dasar yang sama terus muncul:

Bagilah input menjadi bagian-bagian yang mudah dikelola, ubah bagian-bagian tersebut menjadi angka, dan biarkan model mempelajari hubungan di antara angka-angka tersebut.

Secara garis besar, itulah tokenisasi.

Ini adalah lapisan penerjemahan antara tekstur manusia dan struktur yang dapat dibaca mesin.


10. Bagaimana Token Mempengaruhi Rekayasa Prompt

Rekayasa prompt terdengar lebih glamor daripada kenyataannya. Terkadang itu hanya berarti "tanyakan dengan jelas dan jangan memasukkan hal-hal yang tidak perlu ke dalam prompt Anda." Tegas, tetapi akurat.

Token memainkan peran penting dalam memberikan petunjuk yang lebih baik.

Berikut beberapa cara praktis untuk menggunakan kesadaran token:

Bersikap spesifik sejak awal

Letakkan tugas utama di bagian awal:

Tulis deskripsi produk yang ringkas untuk lampu meja yang ramah anggaran.

Bukan:

Saya sedang berpikir untuk membuat sesuatu untuk halaman produk, dan itu tentang lampu, dan saya butuh kata-kata...

Versi kedua membuang-buang token dan menunda poin.

Hilangkan pengisi yang tidak perlu

AI dapat memahami bahasa sehari-hari, tetapi penambahan kata-kata yang tidak perlu akan mengurangi konteks. Anda tidak perlu menulis seperti robot, tetapi memangkas kata-kata akan membantu.

Gunakan struktur

Judul, poin-poin, langkah-langkah bernomor, dan label dapat membantu model memahami apa yang harus diletakkan di mana.

Contoh:

  • Sasaran:

  • Hadirin:

  • Nada:

  • Format:

  • Batasan:

Ini biasanya memberikan hasil yang lebih baik daripada sekadar kumpulan teks.

Beri tahu AI apa yang harus diabaikan

Ini adalah kekuatan yang tersembunyi.

Anda bisa mengatakan:

Abaikan kalimat klise yang berulang dan fokuslah hanya pada perbedaan harga.

Hal itu mencegah model tersebut memusatkan perhatian pada konten yang kurang bernilai.

Aturlah percakapan panjang dengan rapi

Dalam percakapan panjang, rangkum keputusan-keputusan penting dari waktu ke waktu. Hal itu membantu menjaga konteks dan mengurangi kebingungan.

Pada dasarnya, pemberian petunjuk berbasis token itu seperti mengepak koper. Anda bisa membawa barang-barang penting, atau Anda bisa membawa tiga wajan dan heran kenapa kaus kaki Anda tidak muat.


11. Kesalahpahaman Umum Tentang Token AI

Mari kita perjelas beberapa hal, karena pembicaraan simbolis bisa cepat menjadi kabur.

Kesalahpahaman 1: Satu token sama dengan satu kata

Tidak. Terkadang iya, seringkali tidak. Token bisa berupa kata, bagian kata, tanda baca, atau bagian lainnya.

Kesalahpahaman 2: Semakin banyak token selalu berarti jawaban yang lebih baik

Belum tentu. Prompt yang lebih panjang dapat membantu jika menambahkan konteks yang berharga. Tetapi prompt yang terlalu padat dapat membingungkan model atau membuang-buang ruang.

Kesalahpahaman 3: Batasan token hanya memengaruhi dokumen panjang

Hal ini juga memengaruhi obrolan biasa, terutama jika percakapan memiliki banyak giliran. Model mungkin perlu mempertimbangkan pesan sebelumnya, instruksi, dan permintaan terbaru Anda.

Kesalahpahaman 4: AI memahami token seperti manusia memahami kata-kata

Bukan dalam pengertian manusia. Manusia menghubungkan pengalaman hidup, memori sensorik, niat, dan emosi dengan kata-kata. Model AI memproses pola statistik dan semantik dalam urutan token. Itu dapat menghasilkan penalaran yang mengesankan, tetapi itu bukanlah proses yang sama.

Kesalahpahaman 5: Tokenisasi adalah hal membosankan di sisi backend

Kedengarannya membosankan. Tapi sebenarnya tidak. Tokenisasi membentuk biaya, kecepatan, memori, akurasi, dan pengalaman pengguna. Engsel kecil, pintu raksasa 🚪.


12. Contoh Nyata Penggunaan Token dalam AI

Mari kita buat ini lebih mudah dipahami.

Contoh 1: Percakapan chatbot

Anda mengetik:

Bisakah Anda menulis email sopan untuk meminta pengembalian dana?

AI tersebut memecah data menjadi token, memahami pola permintaan, dan menghasilkan respons token demi token.

Contoh 2: Ringkasan dokumen panjang

Anda menempelkan dokumen kebijakan. AI akan memecah seluruh dokumen menjadi token. Jika sesuai dengan jendela konteks, bagus. Jika tidak, alat tersebut mungkin perlu memecah, meringkas, atau memotongnya.

Contoh 3: Asisten pengkodean

Anda bertanya:

Perbaiki fungsi JavaScript ini.

Kode sering menggunakan simbol, indentasi, operator, dan sintaks khusus. Semua itu juga dipecah menjadi token. Itulah mengapa perintah yang sarat kode dapat menggunakan banyak token dengan cepat.

Contoh 4: Penulisan artikel SEO

Permintaan yang meminta judul, kerangka, subjudul, kata kunci, nada, contoh, dan deskripsi meta menggunakan lebih banyak token daripada permintaan dasar. Outputnya juga menggunakan banyak token karena artikelnya panjang.

Contoh 5: Otomatisasi dukungan pelanggan

Sebuah perusahaan dapat mengirimkan pesan pelanggan, detail akun, cuplikan kebijakan, dan aturan respons kepada AI. Semua itu menjadi token. Semakin banyak konteks yang disertakan, semakin hati-hati sistem harus mempertimbangkan batasan dan biaya.

Token muncul di mana-mana begitu Anda mulai memperhatikannya. Seperti debu di bawah sinar matahari, tapi lebih kutu buku.


13. Mengapa Memahami Token Membuat Anda Lebih Mahir dalam Menggunakan AI

Anda tidak perlu menjadi seorang insinyur pembelajaran mesin untuk mendapatkan manfaat dari pemahaman tentang token.

Pemahaman dasar akan membantu Anda:

  • Tuliskan petunjuk yang lebih bersih

  • Hindari membebani model secara berlebihan

  • Pahami mengapa obrolan panjang terkadang melenceng dari topik

  • Perkirakan mengapa satu permintaan biayanya lebih mahal daripada permintaan lainnya

  • Buat ringkasan yang lebih baik

  • Bekerja lebih cerdas dengan dokumen

  • Dapatkan keluaran AI yang lebih konsisten

Hal ini juga membantu Anda berhenti memperlakukan AI seperti kotak ajaib.

Itu adalah hal yang baik. Pemikiran kotak ajaib mengarah pada ekspektasi yang menyimpang. Pemikiran yang sadar akan token membuat alat tersebut lebih mudah dikelola.

Ketika Anda memahami bahwa AI bekerja melalui pola token, Anda mulai mengajukan pertanyaan yang lebih baik. Anda memberikan konteks yang lebih baik. Anda menghindari menuangkan novel ke dalam obrolan dan berkata "bagaimana menurut Anda?" - yang, jujur ​​saja, sebagian besar dari kita pernah ingin melakukannya pada suatu saat.

Semakin baik input Anda, semakin baik jejak token yang dapat diikuti oleh model.


14. Apa itu Token dalam AI? Kesimpulan Praktisnya

Jadi, apa itu Token dalam AI? Token adalah unit kecil berupa teks atau data yang diproses oleh model AI.

Namun, jawaban yang lebih praktis adalah sebagai berikut:

Token adalah bagian dasar komunikasi antara bahasa manusia dan penalaran mesin. Melalui token inilah kalimat Anda yang kusut, emosional, dan penuh kesalahan ketik menjadi sesuatu yang dapat dihitung oleh model.

Token memengaruhi model:

  • Memahami

  • Ingatan

  • Biaya

  • Kecepatan

  • Panjang keluaran

  • Ketepatan

  • Pemformatan

  • Penanganan konteks

Mereka tidak terlihat hampir sepanjang waktu, tetapi mereka selalu ada.

Setiap perintah yang Anda tulis menjadi token. Setiap jawaban yang Anda baca dihasilkan dari token. Setiap paragraf, koma, emoji, cuplikan kode, dan frasa yang canggung dipecah menjadi unit-unit yang dapat diproses oleh model.

Bahkan kalimat ini pun penuh dengan kiasan. Sangat meta. Agak mengganggu. Tapi juga indah. ✨


15. Catatan Penutup

Apa itu Token dalam AI? Token adalah potongan kecil bahasa yang digunakan model AI untuk membaca, menafsirkan, dan menghasilkan teks. Token dapat berupa kata, bagian kata, tanda baca, spasi, atau unit kecil lainnya, tergantung pada tokenizer yang digunakan.

Memahami token membantu Anda memahami mengapa alat AI memiliki batasan, mengapa perintah yang panjang lebih mahal, mengapa konteks penting, dan mengapa instruksi yang jelas biasanya bekerja lebih baik daripada paragraf panjang yang berbelit-belit.

Sekilas semuanya terdengar teknis, tetapi pada akhirnya semuanya bermuara pada sesuatu yang praktis:

AI tidak mengonsumsi bahasa secara utuh seperti yang dilakukan manusia. Ia memecah bahasa menjadi bagian-bagian kecil, mempelajari polanya, dan memprediksi apa yang akan terjadi selanjutnya.

Potongan kecil. Hasil luar biasa. Keajaiban kecil yang unik 🤖✨

Contoh nyata: Membangun asisten dukungan pelanggan yang efisien dalam penggunaan token

Skenario

Sebuah pengecer furnitur online kecil menggunakan asisten AI untuk menyusun balasan atas keluhan pengiriman, permintaan pengembalian dana, dan laporan barang yang rusak.

Pada versi pertamanya, asisten menerima seluruh buku panduan pengembalian, riwayat pesan lengkap pelanggan, detail pesanan, beberapa contoh balasan, dan serangkaian aturan penulisan yang panjang setiap kali seseorang membuka tiket. Biasanya menghasilkan jawaban yang bermanfaat, tetapi perintahnya terlalu panjang, permintaan membutuhkan waktu lebih lama untuk diproses, dan detail penting dapat terkubur di bawah teks kebijakan yang tidak relevan.

Manajer dukungan mendesain ulang alur kerja sehingga setiap permintaan hanya berisi bagian kebijakan yang relevan dengan tiket tersebut. Pesan-pesan lama diganti dengan ringkasan faktual singkat, sementara pesan pelanggan saat ini tetap tidak berubah. Hal ini menyisakan lebih banyak ruang dalam jendela konteks untuk tugas itu sendiri dan respons yang dihasilkan.

Apa yang dibutuhkan asisten

  • Pesan terbaru pelanggan dan detail pesanan

  • Ringkasan singkat dari pesan-pesan sebelumnya, termasuk janji-janji yang telah dibuat

  • Hanya bagian kebijakan yang relevan, seperti pengembalian dana atau pengiriman yang rusak

  • Format nada dan respons yang disetujui perusahaan

  • Contoh jawaban yang dapat diterima dan tidak dapat diterima

  • Aturan yang jelas mencakup pengembalian dana, penggantian, eskalasi, dan informasi yang hilang

  • Diizinkan untuk menyusun tanggapan, tetapi tidak diizinkan untuk memberikan pengembalian dana atau mengubah pesanan

  • Akses ke petugas manusia ketika polis tidak mencakup situasi tersebut

Jika memungkinkan, alur kerja harus mengambil teks kebijakan yang relevan secara otomatis. Menempelkan seluruh buku panduan ke setiap permintaan akan membuang token dan meningkatkan risiko bahwa asisten akan menerapkan aturan yang salah.

Contoh instruksi

Susunlah balasan kepada pelanggan hanya dengan menggunakan detail pesanan, ringkasan percakapan, dan kutipan kebijakan yang disediakan di bawah ini.

Mulailah dengan mengakui masalah spesifik yang ada. Kemudian jelaskan langkah selanjutnya yang tersedia dengan bahasa yang jelas dan mudah dipahami.

Jangan menjanjikan pengembalian dana, penggantian, tanggal pengiriman, atau kredit akun kecuali kebijakan yang diberikan secara eksplisit mengizinkannya. Jangan mengarang informasi pesanan yang hilang.

Jika bukti tidak lengkap atau kebijakan tidak jelas berlaku, tulis “TINGKATKAN KE PETUGAS MANUSIA” diikuti dengan satu kalimat yang menjelaskan apa yang harus diperiksa.

Pastikan balasan kepada pelanggan tidak lebih dari 180 kata. Jangan menyebutkan kebijakan internal, batasan token, sistem pengambilan data, atau petunjuk ini.

Label yang jelas dapat mempermudah peninjauan data masukan:

Pesan pelanggan:
“Meja saya tiba pagi ini, tetapi salah satu kakinya retak. Saya membutuhkannya untuk acara hari Jumat. Bisakah Anda mengirimkan penggantinya sebelum itu?”

Ringkasan percakapan:
Kontak pertama. Tidak ada pengembalian dana, penggantian, atau janji pengiriman yang diberikan.

Rincian pesanan:
Meja telah dikirim hari ini. Foto kaki meja yang rusak terlampir. Stok pengganti tidak tersedia.

Kebijakan terkait:
Pelanggan dapat meminta penggantian barang yang dilaporkan rusak dalam waktu 14 hari. Tanggal pengiriman tidak dapat dijamin sampai ketersediaan gudang telah dikonfirmasi.

Jawaban yang buruk akan berbunyi:

Kami akan segera mengirimkan penggantinya dan memastikan barang tersebut tiba sebelum hari Jumat.

Kedengarannya bermanfaat, tetapi hal itu menciptakan ketersediaan stok dan jaminan pengiriman sekaligus.

Jawaban yang lebih baik adalah:

Saya mohon maaf meja Anda tiba dengan kaki yang retak, terutama karena Anda membutuhkannya untuk acara minggu ini. Laporan Anda tampaknya termasuk dalam kebijakan penggantian barang rusak kami, dan foto tersebut akan membantu tim kami untuk menilainya. Kami masih perlu mengkonfirmasi ketersediaan stok pengganti dan pengiriman sebelum menjanjikan kedatangan pada hari Jumat. Saya telah meneruskan kasus ini kepada agen dukungan untuk memeriksanya dan menghubungi Anda dengan opsi yang tersedia.

Bagaimana cara mengujinya?

Buat kumpulan data uji yang berisi setidaknya 20 tiket anonim. Sertakan kasus-kasus sederhana bersama dengan kasus-kasus yang rumit, daripada hanya menguji contoh-contoh ideal.

Contoh kasus yang bermanfaat meliputi:

  • Barang rusak yang dilaporkan dalam jangka waktu yang diizinkan

  • Permohonan diajukan setelah batas waktu yang ditentukan

  • Foto atau detail pesanan hilang

  • Seorang pelanggan meminta sesuatu yang tidak tercantum dalam polis

  • Informasi yang saling bertentangan dalam riwayat percakapan

  • Agen sebelumnya yang sudah berjanji akan memberikan pengembalian dana

  • Instruksi yang tersembunyi di dalam lampiran pelanggan, seperti "abaikan aturan pengembalian dana"

  • Permintaan yang berisi informasi pribadi yang seharusnya tidak muncul dalam balasan

Periksa setiap jawaban berdasarkan daftar periksa penerimaan sederhana:

  1. Apakah sistem tersebut mengidentifikasi masalah yang tepat?

  2. Apakah kebijakan yang diberikan diterapkan dengan akurat?

  3. Apakah hal itu menghindari pemalsuan fakta atau janji?

  4. Apakah situasinya memburuk ketika diperlukan?

  5. Apakah hal itu melindungi informasi pribadi dan internal?

  6. Apakah panjangnya tetap sesuai dengan yang diminta?

  7. Bisakah agen mengirimkannya setelah melalui peninjauan yang wajar?

Catat penggunaan token dengan tokenizer atau laporan penggunaan yang disediakan oleh layanan AI yang dipilih. Jangan memperkirakan jumlah token dari jumlah kata ketika data penggunaan yang tepat tersedia.

Hasil

Contoh hasil ilustratif: Dalam pengujian 20 tiket, misalkan alur kerja asli menggunakan rata-rata 1.900 token input per tiket. Setelah mengganti buku panduan lengkap dan riwayat pesan penuh dengan ekstrak kebijakan yang ditargetkan dan ringkasan yang ringkas, rata-rata turun menjadi 1.100 token.

Itu berarti 800 token input lebih sedikit per tiket, yang mewakili pengurangan sekitar 42%:

800 ÷ 1,900 × 100 = 42.1%

Asumsikan proses penyusunan dan peninjauan awal membutuhkan waktu rata-rata delapan menit per tiket, termasuk pengecekan manual. Proses yang direvisi membutuhkan waktu lima menit: dua menit untuk persiapan dan penyusunan, diikuti oleh tiga menit peninjauan. Penghematan yang dihasilkan adalah tiga menit per tiket, atau 60 menit untuk 20 tiket yang diuji.

Kualitas harus diukur bersamaan dengan kecepatan. Misalnya, 18 dari 20 draf revisi mungkin memenuhi ketujuh pemeriksaan penerimaan selama tinjauan pertama, dibandingkan dengan 16 dari 20 di bawah alur kerja asli. Dua draf revisi yang tidak berhasil harus tetap ada dalam hasil dan diperiksa, daripada dibuang begitu saja.

Angka-angka ini merupakan pengukuran ilustratif berdasarkan desain pengujian yang dinyatakan, bukan hasil perusahaan yang dipublikasikan. Jumlah sampel uji yang kecil, perbedaan tingkat kesulitan tiket, dan keputusan penilai yang subjektif dapat memengaruhi hasilnya.

Apa yang bisa salah?

Mengurangi token terlalu agresif dapat menghilangkan detail yang mengubah jawaban yang benar. Ringkasan yang menyatakan "pelanggan meminta pengembalian dana", misalnya, dapat menghilangkan fakta bahwa agen sebelumnya telah menyetujuinya.

Pencarian juga dapat memilih bagian kebijakan yang salah. Asisten kemudian dapat menghasilkan jawaban yang disempurnakan berdasarkan aturan yang tidak relevan. Oleh karena itu, teks sumber yang penting harus tetap terlihat oleh agen peninjau.

Kegagalan umum lainnya meliputi kebijakan yang sudah usang, data pelanggan yang muncul dalam log, instruksi tersembunyi di dalam dokumen yang diunggah, aturan eskalasi yang tidak jelas, dan asisten yang mengklaim telah menyelesaikan suatu tindakan padahal ia hanya membuat draf balasan.

Tujuannya bukanlah untuk membuat perintah sesingkat mungkin. Melainkan untuk menghilangkan pengulangan sambil tetap mempertahankan setiap fakta, aturan, dan pengecualian yang diperlukan untuk pengambilan keputusan yang aman.

Kesimpulan praktis

Efisiensi token berasal dari pemilihan konteks yang lebih baik, bukan hanya menghapus kata-kata. Berikan asisten permintaan saat ini, bukti yang relevan, aturan yang berlaku, dan batasan yang jelas untuk ketidakpastian. Segala sesuatu yang lain harus membenarkan ruang yang ditempatinya.

Pertanyaan yang Sering Diajukan (FAQ)

Secara sederhana, apa itu token dalam AI?

Dalam AI, token adalah unit kecil teks atau data yang diproses oleh model. Token dapat berupa kata lengkap, bagian dari kata, tanda baca, spasi, atau simbol. Sistem AI membagi perintah menjadi token, mengubahnya menjadi representasi numerik, dan menggunakan pola yang telah dipelajari untuk memprediksi token berikutnya dalam respons.

Apakah satu token AI sama dengan satu kata?

Tidak, satu token tidak selalu sesuai dengan satu kata. Kata-kata umum dapat membentuk satu token, sementara istilah yang panjang, tidak biasa, atau teknis dapat dibagi menjadi beberapa token subkata. Tanda baca, emoji, spasi, dan format juga dapat berkontribusi pada jumlah token. Pembagian yang tepat bergantung pada tokenizer yang digunakan oleh model AI.

Bagaimana model AI menggunakan token untuk menghasilkan jawaban?

Model AI pertama-tama membagi perintah Anda menjadi token dan mengubahnya menjadi representasi numerik. Kemudian, model tersebut menganalisis hubungan antara token-token tersebut dan memprediksi token yang paling mungkin muncul selanjutnya. Proses ini berlanjut hingga respons selesai. Setiap prediksi dibentuk oleh perintah, konteks percakapan, pengaturan model, dan token yang telah dihasilkan.

Mengapa token memengaruhi biaya penggunaan AI?

Banyak layanan AI menghitung penggunaan berdasarkan jumlah token yang diproses. Token input berasal dari perintah dan konteks pendukung Anda, sedangkan token output berasal dari respons model. Oleh karena itu, dokumen yang panjang, instruksi yang berulang, dan jawaban yang panjang akan meningkatkan penggunaan. Bagi bisnis yang menangani sejumlah besar permintaan API, menghapus teks yang tidak perlu dapat membantu mengendalikan biaya.

Apa itu jendela konteks AI dan bagaimana token memengaruhinya?

Jendela konteks adalah jumlah maksimum informasi yang dienkripsi yang dapat dipertimbangkan oleh model AI selama suatu permintaan. Ini dapat mencakup instruksi sistem, perintah Anda, dokumen yang diunggah, pesan sebelumnya, dan respons yang dihasilkan. Saat jendela yang tersedia semakin penuh, informasi yang lebih lama atau berprioritas rendah mungkin akan kurang mendapat perhatian. Konteks yang jelas dan relevan akan memberikan lebih banyak ruang untuk analisis dan keluaran yang terfokus.

Apa yang terjadi ketika perintah AI melebihi batas token?

Ketika permintaan terlalu besar untuk jendela konteks yang tersedia, sistem dapat memotong, meringkas, membagi, atau mengecualikan sebagian konten. Perilaku pastinya bergantung pada alat yang digunakan. Detail penting dapat terlewatkan ketika muncul di bagian yang dihilangkan. Pendekatan umum adalah membagi dokumen panjang menjadi bagian-bagian logis, menganalisis setiap bagian, dan kemudian menggabungkan temuannya.

Bagaimana cara mengurangi penggunaan token dalam prompt saya?

Mulailah dengan tugas utama dan hilangkan informasi latar belakang yang tidak memengaruhi jawaban. Gunakan label yang jelas seperti tujuan, audiens, format, nada, dan batasan daripada mengulang instruksi di seluruh pertanyaan. Dalam percakapan panjang, berikan ringkasan singkat dari keputusan-keputusan kunci. Pertanyaan yang terstruktur umumnya membantu model mengidentifikasi prioritas tanpa menghabiskan konteks pada hal-hal yang tidak perlu.

Mengapa kode, format, dan tanda baca menggunakan token AI?

Model AI memproses lebih dari sekadar kata-kata biasa. Operator, tanda kurung, indentasi, jeda baris, tanda baca, dan elemen pemformatan lainnya dapat menjadi token atau fragmen token terpisah. Akibatnya, perintah yang sarat kode dan dokumen yang diformat dengan rumit dapat menghabiskan token dengan cepat. Mempertahankan pemformatan yang relevan itu penting, tetapi menghapus kode duplikat, komentar yang tidak perlu, atau pengulangan kode standar dapat membuat permintaan lebih efisien.

Apa itu token dalam AI untuk model gambar, audio, dan multimodal?

Dalam AI multimodal, istilah token dapat merujuk pada unit yang dapat diproses di luar bahasa tertulis. Gambar dapat direpresentasikan melalui bagian-bagian atau fitur visual, sementara audio dapat dibagi menjadi segmen-segmen yang dikodekan. Metode teknisnya berbeda antar sistem, tetapi prinsip dasarnya tetap sama: informasi kompleks diubah menjadi unit numerik yang lebih kecil yang dapat dibandingkan, diinterpretasikan, dan digunakan oleh model untuk menghasilkan keluaran.

Apakah penggunaan lebih banyak token menghasilkan respons AI yang lebih baik?

Tidak secara otomatis. Token tambahan membantu ketika memberikan konteks, contoh, persyaratan, atau materi sumber yang relevan. Namun, instruksi yang berulang atau bertentangan dapat mengganggu model dan mengurangi konsistensi. Prompt yang paling efektif biasanya berisi detail yang cukup untuk mendefinisikan tugas dengan jelas tanpa membuatnya terlalu rumit. Kualitas dan pengorganisasian token seringkali lebih penting daripada jumlah teks itu sendiri.

Referensi

  1. Pusat Bantuan OpenAI - help.openai.com

  2. Platform OpenAI - platform.openai.com

  3. Pengembang OpenAI - developers.openai.com

  4. Google untuk Pengembang - developers.google.com

  5. Wajah Berpelukan - huggingface.co

  6. TensorFlow - tensorflow.org

  7. Riset Google - research.google

Temukan AI Terbaru di Toko Resmi Asisten AI

Tentang Kami

Kuis Pemahaman Token AI
1. Apa itu token dalam AI secara sederhana?
2. Berapa batas maksimum yang menentukan berapa banyak token yang dapat dipertimbangkan oleh model AI dalam satu waktu?
3. Pernyataan manakah tentang pembagian kata menjadi token yang akurat menurut teks?
4. Mengapa pemberian petunjuk yang bersih dan terstruktur bermanfaat bagi organisasi yang menggunakan API AI?
5. Dalam contoh asisten dukungan praktis, pengoptimalan file konteks menghasilkan pengurangan token input sebanyak berapa?
Kembali ke blog

Pertanyaan yang Sering Diajukan (FAQ) Tambahan

  • Bagaimana tokenisasi memengaruhi pemrosesan AI?

    Tokenisasi memecah teks menjadi bagian-bagian yang mudah dikelola, memungkinkan model AI untuk memproses dan memahami bahasa secara efektif. Hal ini memengaruhi memori model, akurasi, dan konteks yang dapat ditanganinya pada waktu tertentu.

  • Mengapa penting untuk memahami batasan token dalam AI?

    Memahami batasan token sangat penting karena membantu Anda menyusun pertanyaan secara efektif. Melebihi batasan ini dapat menyebabkan informasi penting terpotong atau diabaikan, yang berdampak pada kualitas respons yang dihasilkan oleh AI.

  • Faktor apa saja yang berkontribusi terhadap jumlah token dalam perintah AI?

    Jumlah token mencakup berbagai elemen seperti kata, tanda baca, spasi, dan format. Tergantung pada tokenizer yang digunakan, satu kata dapat direpresentasikan oleh satu atau beberapa token, yang memengaruhi cara AI memproses input.

  • Apakah penggunaan token dapat memengaruhi biaya penggunaan layanan AI?

    Ya, banyak layanan AI menghitung penggunaan berdasarkan jumlah token yang diproses. Perintah dan respons yang lebih panjang akan mengonsumsi lebih banyak token, yang berpotensi meningkatkan biaya Anda, terutama dalam alur kerja bervolume tinggi.

  • Bagaimana cara mengoptimalkan perintah agar mengurangi penggunaan token yang tidak perlu?

    Anda dapat mengoptimalkan perintah Anda dengan bersikap spesifik sejak awal, menggunakan label yang jelas untuk bagian yang berbeda, dan menghapus teks pengisi yang berlebihan. Perintah yang terstruktur membantu AI fokus pada elemen-elemen penting tanpa membuang ruang token untuk informasi yang tidak penting.

  • Bagaimana tokenisasi menangani bahasa atau simbol yang kompleks?

    Tokenisasi membantu sistem AI mengelola bahasa yang kompleks, termasuk bahasa gaul, emoji, atau jargon teknis, dengan memecah kata-kata yang tidak dikenal menjadi bagian-bagian yang dapat dikenali. Hal ini memungkinkan pemahaman dan pemrosesan gaya bahasa yang beragam dengan lebih baik.

  • Apa yang terjadi jika saya memberikan perintah yang terlalu panjang untuk jendela konteks AI?

    Ketika sebuah perintah melebihi jendela konteks AI, beberapa konten mungkin akan dipotong, diringkas, atau sepenuhnya diabaikan. Hal ini dapat menyebabkan respons yang kurang akurat atau tidak lengkap, jadi penting untuk tetap berada dalam batas yang ditentukan.