Buat berkas llms.txt yang memberi tahu asisten AI halaman mana di situs Anda yang benar-benar penting.
llms.txt adalah berkas markdown yang dipublikasikan di root sebuah situs — /llms.txt — yang menyerahkan peta konten Anda yang terkurasi kepada model bahasa besar alih-alih membiarkan mereka menebak. Proposal ini, yang diterbitkan di llmstxt.org oleh Jeremy Howard pada September 2024, menetapkan kerangka yang sengaja kaku agar bisa diurai tanpa ambiguitas: sebuah H1 berisi nama situs atau proyek, sebuah blockquote opsional berisi ringkasan satu paragraf, lalu bagian-bagian H2 yang isinya berupa daftar butir tautan markdown, masing-masing boleh diikuti titik dua dan deskripsi singkat. Bagian bernama "Optional" punya arti khusus: tautan di dalamnya boleh dilewati ketika jendela konteks sedang sempit.
Generator ini membangun persis struktur tersebut. Anda mengisi nama, ringkasan, dan sebanyak apa pun bagian yang Anda perlukan, dengan satu baris per tautan; keluarannya dirakit sebagai markdown yang valid dengan blockquote diterapkan baris demi baris, kurung siku di dalam judul di-escape agar tidak merusak sintaks tautan, spasi berlebih dirapatkan agar setiap entri tetap satu baris, serta domain polos dipromosikan menjadi https:// sementara jalur relatif yang diawali / dibiarkan apa adanya. Bagian kosong dan tautan tanpa URL dilewati alih-alih ditulis sebagai markdown yang rusak, dan berkas jadinya diunduh sebagai llms.txt yang siap diunggah.
Layakkah dipublikasikan? Jawaban jujurnya: llms.txt adalah proposal komunitas, bukan standar yang secara terbuka dijanjikan akan dibaca oleh vendor AI mana pun, dan ia tidak dengan sendirinya membuat Anda dikutip dalam jawaban AI. Yang ia lakukan itu murah dan berisiko rendah — satu berkas kecil, yang sudah diadopsi makin banyak situs dokumentasi — dan ia memaksa latihan yang berguna: memutuskan dua puluh halaman mana yang sebenarnya menjelaskan produk Anda. Perlakukan ia sebagai pendamping robots.txt (yang mengatur penjelajahan) dan sitemap.xml (yang mendaftar setiap URL untuk mesin pencari), bukan pengganti keduanya. Berkasnya dibuat di browser Anda dan tidak pernah dikirim ke mana pun.
# Nama situs → > ringkasan satu paragraf → ## Bagian → - [Judul tautan](https://url): deskripsi singkat. Bagian bernama "Optional" boleh dilewati oleh alat dengan jendela konteks terbatas.
Ia memberi asisten AI daftar singkat dan terkurasi berisi halaman-halaman yang paling baik menjelaskan situs Anda, dalam markdown yang bisa mereka baca langsung, alih-alih membiarkan mereka menjelajah dan menebak dari HTML yang padat navigasi.
Di root domain, disajikan sebagai teks polos di https://situsanda.com/llms.txt, tempat yang sama dengan robots.txt.
Belum ada penyedia AI yang secara terbuka memastikan bahwa mereka membacanya. llms.txt adalah proposal terbuka dengan adopsi nyata di kalangan situs dokumentasi, dan menerbitkannya memang murah, tetapi curigailah klaim apa pun yang menjanjikan trafik AI.
sitemap.xml mendaftar setiap URL untuk mesin pencari, robots.txt menyatakan apa yang boleh dijelajahi, dan llms.txt mengurasi segelintir halaman yang paling layak dibaca lebih dulu, dengan deskripsi yang ditulis untuk sebuah model, bukan untuk crawler.
Itu konvensi pendamping yang menyisipkan seluruh isi markdown halaman-halaman yang didaftar ke dalam satu berkas besar, alih-alih menautkannya. Alat ini membuat berkas indeksnya, yaitu llms.txt.
Tidak. Markdown-nya dirakit di perangkat Anda oleh JavaScript, dan unduhannya dihasilkan secara lokal.
Vai.la mengubah URL apa pun menjadi tautan pendek dengan statistik klik, QR Code, dan biolink Anda sendiri.
Vai.la tidak bertanggung jawab atas cara alat-alat ini digunakan maupun atas keputusan yang diambil berdasarkan hasilnya.