Lewati ke konten utama
newspals
Topik
Konsep
Editor
Buletin
Bahasa Indonesia
Large Language Models — Konsep | NewsPals
Konsep
·
Large Language Models
lore di balik feed
Large Language Models
Cerita yang terus menarik ide ini kembali ke feed.
15 cerita
Di feed
ai-ml
Forbes Menyoroti RLMF, Variasi RLHF yang Memberi Penghargaan pada AI karena Mengatakan Saya Tidak Tahu
Umpan balik metakognitif bergeser setelah pelatihan, dari sekadar mengejar jawaban benar menuju kepercayaan diri yang terkalibrasi, abstensi yang berguna, dan lebih sedikit halusinasi jas lab.
ai-ml
Makalah Nature Menguji Prompting Multi-Fase untuk Laporan Obat Klinis
Bagian yang berguna bukanlah AI yang menciptakan obat. Ini adalah alur kerja yang lebih sempit untuk ringkasan obat klinis yang terstruktur.
ai-ml
GPT-5.6 Diluncurkan di Bawah Pembatasan Pemerintah: Apa yang Sebenarnya Dilakukan Sol, Terra, dan Luna
OpenAI merilis tiga model baru pada 26 Juni dengan akses yang dibatasi hanya untuk mitra tepercaya atas arahan pemerintahan Trump. Berikut adalah fungsi masing-masing model dan mengapa struktur peluncurannya penting.
gaming
A Microsoft Researcher Membangun Jaringan Saraf dari Kambing di Age of Empires 2. Maksudnya Bukan yang Kamu Kira.
Adrian de Wynter melakukan eksperimen absurd yang menjadi argumen paling jelas mengapa para pembangun dan pelajar harus berhenti mengantropomorfisasi AI.
ai-ml
GLM-5.2 Is the Open-Source Coding Model That Has Silicon Valley Looking East
Z.ai's new MIT-licensed LLM is built for long-horizon agentic coding tasks, priced well below Claude and GPT, and the Valley is paying attention.
ai-ml
Tes Sintetis Membohongi Anda: Metode Baru OpenAI Menggunakan Percakapan Nyata untuk Mendeteksi Perilaku Model yang Bermasalah Sebelum Diluncurkan
Kerangka Simulasi Penerapan milik OpenAI menantang ketergantungan industri pada skenario pengujian buatan dengan memutar ulang percakapan produksi nyata melalui model kandidat sebelum dirilis.
ai-ml
Model Kamu Lulus Ujian Kedokteran. BRIDGE Baru Saja Memintanya Membaca Rekam Medis Sungguhan.
Tolok ukur Nature Biomedical Engineering terbaru menguji LLM mutakhir pada teks EHR nyata, dan hasilnya seharusnya mengubah cara siapa pun dalam mengevaluasi AI layanan kesehatan.
ai-ml
Air Canada Kalah di Pengadilan Gara-Gara Chatbot. Modelnya Tidak Bermasalah. Tata Kelolanya yang Bermasalah.
Lima kegagalan AI di dunia nyata menunjukkan bahwa ketika penerapan berjalan tidak semestinya, penyebabnya hampir tidak pernah berasal dari modelnya itu sendiri.
ai-ml
LLM Serba Guna Mengungguli AI Klinis Khusus di Setiap Tolok Ukur, dan Hal Itu Seharusnya Membuatmu Mempertimbangkan Ulang Soal Fine-Tuning
Evaluasi Nature Medicine menemukan bahwa model serba guna terdepan mengungguli platform AI klinis khusus di setiap kategori yang diuji, menantang asumsi bahwa spesialisasi domain selalu memberikan hasil yang lebih baik.
Juga lagi vibe
Model Bahasa Besar
OpenAI
Adrian de Wynter
Age of Empires 2
Agentic AI
AI Kesehatan
AI Klinis
AI Layanan Kesehatan