Glossary menengah
Entity (Entitas)
Mesin pencari berhenti mencocokkan kata dan mulai mencocokkan hal sejak Knowledge Graph (2012). Sistem AI melangkah lebih jauh: mereka merangkum siapa mengatakan apa tentang apa. Di kedua dunia itu, kejelasan entitas adalah prasyarat, bukan taktik.
Entity (entitas) adalah sesuatu yang bisa diidentifikasi secara unik dan dibedakan dari yang lain: orang, organisasi, tempat, produk, karya, konsep, atau peristiwa. Google menyebutnya "a thing or concept that is singular, unique, well-defined and distinguishable". Mesin pencari modern memahami halaman sebagai kumpulan entitas dan hubungan di antaranya, bukan hanya rangkaian kata.
Kata vs entitas
"Jaguar" adalah satu kata dan minimal tiga entitas: hewan, merek mobil, dan sistem operasi lama Apple. "Canonical" adalah satu kata dan dua entitas yang relevan di sini: tag HTML dan perusahaan di balik Ubuntu. Sistem yang bekerja dengan entitas memakai konteks (kata di sekitar, halaman lain yang menautkan, structured data) untuk memutuskan entitas mana yang dimaksud, lalu menghubungkannya dengan yang sudah diketahui.
Knowledge Graph
Google menyimpan entitas dan hubungannya dalam Knowledge Graph, diperkenalkan 2012, yang menjadi sumber knowledge panel di SERP dan sebagian jawaban langsung. Entitas di dalamnya punya pengenal unik (ID) dan atribut. Situs kecil jarang masuk sebagai entitas sendiri, tapi cara Google memahami halaman tetap berbasis entitas: halaman tentang "URL Inspection" dipahami sebagai halaman tentang fitur tertentu dari produk tertentu milik organisasi tertentu.
Cara mesin mengenali entitas di halaman
| Sinyal | Contoh | Kendali kita |
|---|---|---|
| Nama yang ditulis lengkap dan konsisten | "Google Search Console", bukan "GSC" saja, bukan "console" saja | Penuh |
| Konteks di sekitar nama | "laporan Page indexing di Search Console" menjelaskan hubungan | Penuh |
| Structured data | Person dengan @id yang sama di semua halaman; Organization; sameAs ke profil yang benar | Penuh |
| Link ke sumber kanonik entitas | Tautan ke dokumentasi resmi, ke Wikipedia, ke situs resmi organisasi | Penuh |
| Konsistensi lintas web | Nama, deskripsi, dan alamat yang sama di situs sendiri, profil sosial, direktori, media | Sebagian |
| Sebutan oleh pihak lain | Media, dokumentasi, komunitas menyebut entitas dengan nama yang sama | Kecil |
Kenapa penting untuk AI Search
LLM yang menjawab dengan retrieval menyusun jawaban dari potongan halaman, dan potongan yang berisi kata ganti ("alat ini", "mereka", "fitur tersebut") kehilangan makna ketika dipisahkan dari konteksnya. Potongan yang menyebut entitas dengan nama ("URL Inspection di Search Console menampilkan canonical yang dipilih Google") tetap bermakna sendiri. Ini hipotesis industri untuk mekanisme sitasinya, tapi terdokumentasi untuk cara retrieval berbasis potongan bekerja secara umum, dan tidak ada ruginya menulis begitu untuk pembaca manusia.
Untuk entitas situs sendiri (nama publikasi, nama penulis), konsistensi menentukan apakah sistem bisa mengaitkan semua halaman dengan satu sumber. Di situs ini: satu nama penulis dengan @id yang sama di semua artikel, satu halaman profil, satu deskripsi. Tidak ada klaim tentang entitas itu yang tidak bisa diverifikasi, karena klaim yang tidak konsisten dengan sumber lain justru melemahkan pengenalan.
Yang bukan "entity SEO"
- Menjejalkan nama entitas berulang-ulang. Konsistensi bukan frekuensi.
- Mengklaim
sameAske profil yang tidak ada atau bukan milik kita. - Membuat Organization palsu di structured data supaya "terlihat lebih besar".
- Membeli "entity building" yang isinya membuat profil di puluhan direktori. Kalau pihak yang dipercaya tidak menyebut kita, direktori tidak menggantikannya.
Rujukan
- Introducing the Knowledge Graph: things, not strings Google, 2012
- Enterprise Knowledge Graph API: entity Google Cloud
- Profile page structured data Google Search Central