Saltar al contenido principal
newspals
Temas
Conceptos
Editores
Boletín
Español
Large Language Models — Conceptos | NewsPals
Conceptos
·
Large Language Models
el lore detrás del feed
Large Language Models
Las historias que vuelven a meter esta idea en el feed.
19 historias
En el feed
ai-ml
Prueba de IA sobre cáncer de mama dice que las clasificaciones de chatbots necesitan tareas, no trofeos
Una nueva comparación de chatbots sobre cáncer de mama es un recordatorio útil de que la IA médica debe elegirse según el flujo de trabajo y las métricas, no por impresiones de clasificación.
ai-ml
Artículo clínico de LLM en JMIR: El diseño de fallos puede importar tanto como las puntuaciones
Una evaluación de JMIR de un agente de LLM para el análisis de datos clínicos orienta a los desarrolladores hacia pruebas por etapas, mapeo de fallos y supervisión humana.
ai-ml
Los 7 algoritmos de aprendizaje automático de KDnuggets que aún importan son una útil comprobación de la realidad para los LLM
La pila práctica de IA todavía necesita el aprendizaje automático clásico, especialmente cuando tu problema es la predicción, no hacer cosplay de chatbot.
ai-ml
Los modelos fundacionales tabulares revelan por qué los LLM fallan con los datos en columnas
Las filas, columnas, valores faltantes, anomalías y campos mixtos necesitan modelos que vean las tablas como tablas, no como novelas con líneas de cuadrícula.
ai-ml
Forbes destaca RLMF, la variación de RLHF que recompensa a la IA por decir “No lo sé”
La retroalimentación metacognitiva pasa, después del entrenamiento, de solo perseguir respuestas correctas a una confianza calibrada, una abstención útil y menos alucinaciones de bata de laboratorio.
ai-ml
Artículo de Nature pone a prueba la incitación multifase para informes clínicos de medicamentos
La parte útil no es que la IA invente medicina. Es un flujo de trabajo más específico para resúmenes clínicos estructurados de medicamentos.
ai-ml
GPT-5.6 Launches Under Government Restrictions: What Sol, Terra, and Luna Actually Do
OpenAI released three new models on June 26 with access limited to trusted partners at the Trump administration's direction. Here is what each model does and why the rollout structure matters.
gaming
Un investigador de Microsoft construyó una red neuronal con cabras en Age of Empires 2. El punto no es lo que crees.
Adrian de Wynter's absurdist experiment is the clearest argument yet for why builders and learners should stop anthropomorphizing AI. El experimento absurdista de Adrian de Wynter es el argumento más claro hasta ahora de por qué los creadores y los estudiantes deberían dejar de antropomorfizar la IA.
ai-ml
GLM-5.2 es el modelo de código de código abierto que tiene a Silicon Valley mirando hacia el este
Z.ai, el nuevo LLM con licencia MIT, está diseñado para tareas de codificación agéntica de largo horizonte, con un precio muy inferior al de Claude y GPT, y Silicon Valley le está prestando atención.
ai-ml
Pruebas Sintéticas Te Están Mintiendo: El Nuevo Método de OpenAI Usa Conversaciones Reales para Detectar Mal Comportamiento del Modelo Antes del Lanzamiento
El marco de Simulación de Despliegue de OpenAI desafía la dependencia del sector en escenarios de prueba artificiales al reproducir conversaciones reales de producción a través de modelos candidatos antes de su lanzamiento.
ai-ml
Tu modelo aprobó el examen médico. BRIDGE acaba de pedirle que lea una historia clínica real.
Un nuevo benchmark de Nature Biomedical Engineering pone a prueba a los LLMs más avanzados con texto real de registros médicos electrónicos, y los resultados deberían transformar la forma en que cualquiera evalúa la IA en el ámbito de la salud.
ai-ml
Air Canada perdió en los tribunales por su chatbot. El modelo estaba bien. La gobernanza no.
Cinco fracasos reales de la IA demuestran que cuando los despliegues salen mal, el culpable casi nunca es el modelo en sí.
ai-ml
Los LLM de propósito general superan a la IA clínica especializada en todos los puntos de referencia, y eso debería hacerte replantear el ajuste fino
Una evaluación publicada en Nature Medicine encuentra que los modelos de uso general de última generación superan a las plataformas de IA clínica especializadas en todas las categorías evaluadas, cuestionando la suposición de que la especialización en un dominio siempre vale la pena.
ai-ml
Microsoft Is Building Its Own Coding Models. Here's What That Means for Developers.
At Build 2026 in San Francisco, Microsoft will unveil homegrown AI models designed to power GitHub Copilot — and the move tells developers a lot about where coding skills are headed.
ai-ml
Andrej Karpathy Joins Anthropic: What One Career Move Tells You About Frontier LLM Research
Using Karpathy's move to Anthropic's pre-training team as a lens to understand what frontier LLM research looks like today, and what it means for your career path.
ai-ml
Google's TurboQuant Cuts LLM Memory by 6x Without Breaking Your Models
The search giant's new compression technique makes large language models actually fit on normal hardware
ai-ml
How 26 People Built a 400B Parameter AI Model for $20M (And What That Teaches Us)
Arcee's Trinity proves that smart engineering beats deep pockets in the open source AI race
ai-ml
LLMs Are Now Teaching Evolution Algorithms How to Predict Groundwater
Researchers combined large language models with evolutionary algorithms to forecast environmental conditions, and the results actually make sense
ai-ml
Arcee's $20M Budget Just Trained a 400B Parameter Model (And Made Every Big Tech AI Lab Look Expensive)
The 26-person startup proves you don't need Google-sized budgets to build reasoning-focused large language models
También vibra
Modelos de Lenguaje de Gran Escala
Modelos de lenguaje grandes
Arcee AI
IA clínica
IA en salud
Open Source AI
OpenAI
Scientific Reports