Saltar al contenido principal
newspals
Temas
Conceptos
Editores
Boletín
Español
Large Language Models — Conceptos | NewsPals
Conceptos
·
Large Language Models
el lore detrás del feed
Large Language Models
Las historias que vuelven a meter esta idea en el feed.
15 historias
En el feed
ai-ml
Forbes destaca RLMF, la variación de RLHF que recompensa a la IA por decir “No lo sé”
La retroalimentación metacognitiva pasa, después del entrenamiento, de solo perseguir respuestas correctas a una confianza calibrada, una abstención útil y menos alucinaciones de bata de laboratorio.
ai-ml
Artículo de Nature pone a prueba la incitación multifase para informes clínicos de medicamentos
La parte útil no es que la IA invente medicina. Es un flujo de trabajo más específico para resúmenes clínicos estructurados de medicamentos.
ai-ml
GPT-5.6 Launches Under Government Restrictions: What Sol, Terra, and Luna Actually Do
OpenAI released three new models on June 26 with access limited to trusted partners at the Trump administration's direction. Here is what each model does and why the rollout structure matters.
gaming
Un investigador de Microsoft construyó una red neuronal con cabras en Age of Empires 2. El punto no es lo que crees.
Adrian de Wynter's absurdist experiment is the clearest argument yet for why builders and learners should stop anthropomorphizing AI. El experimento absurdista de Adrian de Wynter es el argumento más claro hasta ahora de por qué los creadores y los estudiantes deberían dejar de antropomorfizar la IA.
ai-ml
GLM-5.2 es el modelo de código de código abierto que tiene a Silicon Valley mirando hacia el este
Z.ai, el nuevo LLM con licencia MIT, está diseñado para tareas de codificación agéntica de largo horizonte, con un precio muy inferior al de Claude y GPT, y Silicon Valley le está prestando atención.
ai-ml
Pruebas Sintéticas Te Están Mintiendo: El Nuevo Método de OpenAI Usa Conversaciones Reales para Detectar Mal Comportamiento del Modelo Antes del Lanzamiento
El marco de Simulación de Despliegue de OpenAI desafía la dependencia del sector en escenarios de prueba artificiales al reproducir conversaciones reales de producción a través de modelos candidatos antes de su lanzamiento.
ai-ml
Tu modelo aprobó el examen médico. BRIDGE acaba de pedirle que lea una historia clínica real.
Un nuevo benchmark de Nature Biomedical Engineering pone a prueba a los LLMs más avanzados con texto real de registros médicos electrónicos, y los resultados deberían transformar la forma en que cualquiera evalúa la IA en el ámbito de la salud.
ai-ml
Air Canada perdió en los tribunales por su chatbot. El modelo estaba bien. La gobernanza no.
Cinco fracasos reales de la IA demuestran que cuando los despliegues salen mal, el culpable casi nunca es el modelo en sí.
ai-ml
Los LLM de propósito general superan a la IA clínica especializada en todos los puntos de referencia, y eso debería hacerte replantear el ajuste fino
Una evaluación publicada en Nature Medicine encuentra que los modelos de uso general de última generación superan a las plataformas de IA clínica especializadas en todas las categorías evaluadas, cuestionando la suposición de que la especialización en un dominio siempre vale la pena.
También vibra
Modelos de Lenguaje de Gran Escala
IA en salud
Modelos de lenguaje grandes
OpenAI
Adrian de Wynter
Age of Empires 2
AI Model Release
AI Policy