HeadlinesBriefing favicon HeadlinesBriefing

AI & ML Research 24 Hours

×
16 articles summarized · Last updated: LATEST

Terakhir diperbarui: September 23, 2026, 10:05 PM ET

Riset AI & ML

Sebuah tolok ukur baru untuk mengevaluasi sistem AI dalam konteks kesehatan mental telah diperkenalkan. MentalHealthBench adalah tolok ukur berbasis pakar yang dirancang untuk menilai kebermanfaatan dan keamanan respons AI dalam lingkungan terapeutik. Secara terpisah, para peneliti telah mereproduksi "Toy Models of Superposition" milik Anthropic dari awal menggunakan Num Py, dan menemukan bahwa jaringan kecil yang dilatih untuk mengompresi data secara spontan menggambar segi lima. Sebuah panduan ramah pemula memandu pembuatan model dunia dengan Python, memungkinkannya untuk "berkhayal" dan memprediksi keadaan di masa depan. Selain itu, penjelasan mendalam tentang GRPO menunjukkan bagaimana GRPO melatih model bahasa kecil menggunakan imbalan yang dapat diverifikasi, dengan Unsloth memungkinkan eksperimen penalaran secara lokal. Sebuah tutorial dasar tentang TF-IDF dan model ruang vektor memberikan perjalanan dari kata ke vektor untuk klasifikasi teks.

Ekosistem OpenAI

Ringg telah menerapkan agen AI yang didukung oleh GPT-5.6 untuk menyelesaikan hingga 65% panggilan pelanggan melalui suara, obrolan, dan WhatsApp. Di sektor hukum, Harvey menggunakan GPT-6 Astra untuk menghasilkan dokumen hukum yang lebih terstruktur dan sadar konteks, membebaskan para pengacara dari penyusunan dokumen yang repetitif. Untuk penyuntingan video, invideo telah meningkatkan penilaian warna hingga 3x lipat menggunakan GPT‑6 Astra, yang merencanakan penyuntingan dengan presisi lebih tinggi dan meningkatkan koreksi warna. OpenAI juga memperluas program siber Daybreak-nya kepada Pemerintah Ukraina untuk pertahanan sipil. OpenAI Academy menandai dua tahun membawa keterampilan AI ke berbagai komunitas, sementara CEO Sam Altman membahas keamanan AI, kendali manusia, dan kerja sama internasional di Dewan Keamanan Perserikatan Bangsa-Bangsa.

Privasi, Keamanan & Kebijakan

Google Deep Mind telah memajukan komputasi AI privat dengan memperkenalkan memori sisi-server yang aman untuk sistem AI pribadi. Dalam berita kebijakan, Anggota DPR AS dari Partai Demokrat, Delia Ramirez, telah mengusulkan untuk menghentikan program menara perbatasan Amerika, dengan alasan pembengkakan biaya dan kekhawatiran pengawasan. Indeks Hype AI melaporkan bahwa AI sedang dioptimalkan untuk kecurangan, dengan agen OpenAI berkontribusi pada tren ini. Sementara itu, kacamata pintar sudah menimbulkan kekacauan di India, di mana seorang teman mengingatkan Shubnam tentang pelanggaran privasi selama proses pindahan. Edisi Download yang lebih luas membahas ancaman kacamata pintar di India dan perjudian triliunan dolar AI.