29 vocabulary entries in this category
Mekanisme dalam model neural network yang memungkinkan model fokus pada bagian-bagian tertentu dari input data yang dini...
Bidirectional Encoder Representations from Transformers; model representasi bahasa pra-latih besutan Google yang membaca...
Embedding adalah teknik dalam machine learning, khususnya NLP, untuk merepresentasikan data kategori (seperti kata atau ...
Arsitektur Encoder-Decoder adalah kerangka kerja neural network yang terdiri dari dua bagian: Encoder memproses input me...
GPT adalah serangkaian model bahasa besar (LLM) yang dikembangkan oleh OpenAI. "Generative" berarti bisa membuat teks ba...
Information Retrieval (IR) adalah ilmu mencari materi (biasanya dokumen) yang bersifat tidak terstruktur dari koleksi be...
Keyword Extraction (Ekstraksi Kata Kunci) adalah teknik analisis teks (NLP) untuk secara otomatis mengidentifikasi istil...
Large Language Model (LLM) adalah model deep learning berskala masif yang dilatih pada sejumlah besar data teks untuk me...
LSTM adalah jenis Recurrent Neural Network (RNN) khusus yang mampu mempelajari ketergantungan jangka panjang. LSTM diran...
Rantai Markov adalah model stokastik yang menggambarkan urutan peristiwa yang mungkin, di mana probabilitas setiap peris...
N-gram adalah urutan N item yang berdekatan dari sampel teks atau ucapan tertentu. Item tersebut bisa berupa fonem, suku...
Naive Bayes adalah keluarga algoritma klasifikasi probabilistik sederhana yang didasarkan pada penerapan Teorema Bayes d...
Named Entity Recognition (NER) adalah subtugas ekstraksi informasi yang berusaha menemukan dan mengklasifikasikan entita...
Natural Language Processing (Pemrosesan Bahasa Alami) adalah cabang AI yang memberikan mesin kemampuan untuk membaca, me...
Parsing (Penguraian Sintaksis) adalah proses menganalisis rangkaian simbol (seperti kode program atau kalimat bahasa ala...
Perplexity adalah metrik pengukuran umum untuk mengevaluasi seberapa baik model bahasa (Language Model) memprediksi samp...
Pre-training adalah fase awal pelatihan model machine learning (biasanya model besar seperti LLM) pada dataset raksasa s...
Prompt Engineering adalah seni dan ilmu menyusun input (instruksi) yang optimal untuk diberikan kepada model AI Generati...
RNN adalah jenis jaringan saraf tiruan yang dirancang untuk memproses data berurutan (sequential data) seperti teks, dat...
Self-Attention adalah mekanisme utama dalam arsitektur Transformer yang memungkinkan model untuk menimbang pentingnya ka...
Analisis Sentimen adalah penggunaan NLP untuk mengidentifikasi dan mengekstrak informasi subjektif dari teks. Tujuannya ...
Seq2Seq adalah arsitektur model neural network yang mentransformasikan satu urutan elemen (misal kata-kata) menjadi urut...
Temperature adalah hyperparameter yang mengontrol keacakan (randomness) output model bahasa generatif. Nilai rendah (men...
Tokenisasi adalah proses memecah teks menjadi unit-unit kecil yang disebut token (bisa berupa kata, sub-kata, atau karak...
Transformer adalah arsitektur deep learning yang diperkenalkan oleh Google pada tahun 2017 (makalah "Attention Is All Yo...
Context Window adalah batasan jumlah token (teks) yang dapat diproses oleh model bahasa sekaligus (sebagai input prompt ...
Word Embedding adalah representasi kata-kata dalam bentuk vektor angka real (list of numbers) di mana kata-kata dengan m...
Word2Vec adalah teknik untuk pembelajaran representasi vektor kata yang diperkenalkan oleh Google pada tahun 2013. Tekni...
Zero-Shot Learning adalah kemampuan model machine learning untuk mengenali atau mengklasifikasikan objek yang BELUM pern...