HeadlinesBriefing favicon HeadlinesBriefing

AI & ML Research 24 Hours

×
8 articles summarized · Last updated: LATEST

Terakhir diperbarui: September 25, 2026, 10:31 PM ET

AI & Rekayasa Perangkat

Proaction meningkatkan penjualan sebesar 60% dan merebut kembali lebih dari 75 jam waktu rekayasa dengan mengintegrasikan Codex, GPT-Live-1, dan GPT-6 Astra langsung ke dalam tumpukan operasional mereka. Perusahaan kini membangun, mengoperasikan, dan menjual model pembelajaran mesin menggunakan alat-alat ini sebagai infrastruktur inti, bukan sebagai pembantu periferal.

Arsitektur RAG & Agen

Arsitektur baru memisahkan pengambilan dari tindakan dengan secara eksplisit membangun lapisan antara sistem RAG dan agen otonom. Penulis berpendapat bahwa menggabungkan pengambilan dan tindakan menyebabkan sistem yang rapuh, dan mendemonstrasikan desain modular di mana pengambilan memberi makan lapisan pengambilan keputusan yang memicu penggunaan alat hanya jika diperlukan.

Evaluasi & Ketidakpastian

Metrik MSE tradisional menyesatkan pengembang ketika model dievaluasi melalui peluncuran autoregresif. Bagian kedua dari seri ini memperkenalkan teknik propagasi ketidakpastian untuk lebih mengukur kepercayaan prediksi di seluruh titik keputusan berurutan, memperingatkan bahwa metrik kesalahan naif mengabaikan varian yang menguatkan dalam sistem iteratif.

Tolok Ukur Pengambilan Keputusan

Model Jev dari Type Safe AI diuji pada 3.080 tugas klasifikasi untuk mengukur pergeserannya dari kinerja generatif ke pengambilan keputusan. Hasil menunjukkan Jev mengungguli LLM standar pada klasifikasi terstruktur sebesar 22% dalam presisi, terutama pada kasus tepi di mana ambang kepercayaan lebih penting daripada keragaman keluaran mentah.

Kefasihan Teknologi yang Lebih Luas

Di luar penyesuaian model, para praktisi mempelajari teknologi yang berdekatan — termasuk sistem terdistribusi, observabilitas, dan etika rekayasa prompt — untuk membangun sistem AI kelas produksi. Penulis mendaftarkan sepuluh kompetensi yang membedakan peneliti ML dari insinyur AI yang dapat diterapkan.

Pertahanan & Penelitian Bio

Pentagon mengalokasikan $30,3 juta selama lima tahun untuk mengembangkan pendeteksi kebohongan bertenaga AI, menimbulkan pertanyaan tentang keadilan algoritmik dan etika pengawasan. Secara terpisah, sebuah studi menantang hipotesis peremajaan "organ muda", menemukan tidak ada pemrograman ulang epigenetik yang signifikan pada penerima transplantasi organ muda — meruntuhkan pilar kunci dari teori "air mancur awet muda".