ldraw-nova: AI agent'lar LEGO modellerini Python koduyla tasarlıyor
ldraw-nova'da modeller ham koordinat yerine bir plan ve Python generator yazıyor; ama fiziği ya da dengeyi hiçbir şey test etmiyor.
Nemotron 3 Diarization düşük latency'de neredeyse hiç doğruluk kaybetmiyor, ama dörtten fazla konuşmacıda hata kabaca üçe katlanıyor.

Her toplantı transkript aracı aynı duvara çarpar: kim ne dedi.
NVIDIA dün Nemotron 3 Diarization'ı Hugging Face'te yayınladı. Açık ağırlıklar, 100M parametre, sekiz konuşmacıya kadar, ticari kullanıma izin var.
Demo, aynı anda konuşan sekiz sesi gösteriyor. Model kartında ise daha işe yarar bir sayı var.
DIHARD III benchmark'ında input buffer'ı 30 saniyeden saniyenin üçte birine indirmek bir puandan az hata ekliyor. Dört konuşmacıdan beş veya daha fazlasına çıkmak ise hatayı kabaca üçe katlıyor, yaklaşık %9'dan yaklaşık %28'e.
Bir ürüne bağlamadan önce:
Latency ucuzladı. Kalabalık odalar ucuzlamadı.
Bu yazı İngilizce aslından Türkçeye çevrilmiştir.