NVIDIA baru rilis Nemotron 3 Embed, model AI yang jadi juara di RTEB. Penasaran kenapa? Baca selengkapnya di sini!
Jadi, NVIDIA baru aja ngeluncurin model AI terbaru mereka, Nemotron 3 Embed. Rilisnya pada 15 dan 16 Juli 2026, langsung bikin heboh di kalangan penggiat teknologi. Yang menarik, model ini punya tiga checkpoint terbuka, yaitu Nemotron-3-Embed-8B-BF16, Nemotron-3-Embed-1B-BF16, dan Nemotron-3-Embed-1B-NVFP4. Dan tebak apa? Checkpoint 8B-nya berhasil meraih peringkat #1 di RTEB dengan nilai rata-rata NDCG@10 sebesar 78,46. Gila, kan?
Nah, apa sih sebenarnya Nemotron 3 Embed ini? Model ini dirancang buat ngurusin pengambilan informasi yang lebih canggih. Cocok banget buat produksi skala besar, retrieval yang lebih pintar, dan bahkan buat mengingat informasi dari agen. Jadi, kamu bisa bayangkan seberapa powerful-nya teknologi ini. Semua checkpoint ini dilatih dengan attention masking dua arah, yang bikin setiap token bisa saling lihat satu sama lain. Panjang urutan maksimumnya mencapai 32.768 token, loh!
Kalau kita lihat lebih dalam, model 8B ini dibangun dengan dasar dari Ministral-3-8B-Instruct-2512. Sedangkan dua varian 1B-nya menggunakan Ministral-3-3B-Instruct-2512. Yang bikin menarik, performa Nemotron-3-Embed-8B-BF16 ini bener-bener mendominasi di RTEB, mencakup 16 tugas publik. Setiap angka yang ditampilkan adalah rata-rata NDCG@10 dengan panjang urutan model 4096. Jadi, bisa dibilang, ini adalah model yang bener-bener siap tempur!
Advertisement
Slot in-article yang tampil setelah paragraf ketiga.
Tapi, gimana sih cara kerja model ini? Pertama, kamu pilih checkpoint dan query. Setelah itu, model ini bakal mengolah data lewat lima tahap yang bikin proses retrieval jadi lebih efektif. Dari prefixing, encoding dengan attention dua arah, sampai scoring yang bikin hasilnya akurat. Semua proses ini dirancang buat ngasih hasil yang optimal dan efisien.
Satu hal yang menarik, model 1B ini bukan hasil pelatihan yang lebih kecil, tapi hasil dari proses kompresi yang canggih. Jadi, meskipun ukurannya lebih kecil, performanya tetap bisa diandalkan. Proses ini melibatkan prunning dan distillation, yang bikin model ini tetap bisa bersaing dengan yang lebih besar. Jadi, jangan remehkan ukuran, ya!
Terakhir, NVIDIA juga ngebahas tentang NVFP4, yang bisa memberikan throughput dua kali lipat dibanding BF16. Dengan akurasi yang tetap terjaga, NVFP4 ini jadi pilihan menarik buat banyak aplikasi, terutama yang butuh kecepatan tinggi. Jadi, kalau kamu lagi nyari teknologi AI yang canggih, Nemotron 3 Embed ini bisa jadi jawaban yang kamu cari!
AI Updates lagi bergerak cepat, jadi jangan cuma lihat headline.
MarkTechPost
Catatan redaksi
Kalau lo cuma ambil satu hal dari artikel ini
AI Updates update dari MarkTechPost.
Sumber asli
Artikel ini merupakan rewrite editorial dari laporan MarkTechPost.
Baca artikel asli di MarkTechPost→