Chain of News AI & LLM

AI & LLM

Últimas noticias

3913 contenidos totales

Partner recomendado

Patrocinado
ArXiv cs.AI

ReclamaciónRecibo: Verificando la Suficiencia y la Cobertura de la Evidencia en Evaluaciones de Agentes

Las evaluaciones de agentes enfrentan dos preguntas probatorias distintas: si una afirmación reportada es recomputable a partir de la evidencia retenida (suficiencia) y si los registros retenidos cubren el conjunto de experimentos comprometido (cobertura). Los registros genéricos y las transcripciones vinculadas por hash no responden a ninguna de las dos de manera fiable. Presentamos ClaimReceipt, una especificación de recibo relativa a la afirmación y un verificador selectivo que vincula evidencia de transacciones tipadas a un manifiesto de experimento firmado y devuelve PASS, INVALID o INCONCLUSIVE por cada afirmación.

03/09/2026
ArXiv cs.AI

EvalDetectBench: Un benchmark para medir la conciencia de evaluación en modelos de lenguaje de frontera

Los grandes modelos de lenguaje de Frontier a menudo pueden reconocer cuando están siendo evaluados, una capacidad conocida como conciencia de evaluación. Si los modelos se comportan de manera diferente en las evaluaciones que en el despliegue, esto socava la validez de los resultados de la evaluación, que son un componente crucial de los marcos actuales de seguridad de IA.

03/09/2026
ArXiv cs.AI

¿Cuándo puede una máquina confiar en un estatuto? Un certificado de supervivencia para la lógica legal extraída por máquinas

Los estatutos son cada vez más analizados por máquinas antes de que las personas los lean, y los analizadores no están de acuerdo: en los estatutos de Missouri, dos extractores escritos de forma independiente divergen en la presencia de umbrales numéricos con una tasa de falsos negativos de 0.43. Nos preguntamos qué lógica formal sobrevive a ese ruido.

03/09/2026
ArXiv cs.AI

SSAKG 2.0: Un paquete de código abierto para la memoria secuencial asociativa estructural y la recuperación basada en contexto.

Este artículo presenta SSAKG 2.0, un paquete de software de código abierto para construir y operar Grafos de Conocimiento Asociativo Secuencial Estructural (SSAKGs). Un SSAKG representa objetos como vértices del grafo y secuencias ordenadas como patrones estructurales de conexiones del grafo. El grafo disperso resultante se utiliza como una memoria asociativa en la que secuencias completas pueden reconstruirse a partir de un contexto parcial y desordenado.

03/09/2026
ArXiv cs.AI

Arquitectura de Sistemas de Datos Conversacionales para APIs LLM sin estado: el patrón Proxy de Hidratación

A medida que las plataformas empresariales pasan a interfaces de razonamiento conversacional, la naturaleza sin estado de las API de LLM crea una brecha arquitectónica. Aunque la falta de estado permite la escalabilidad horizontal para los proveedores de IA, obliga a las aplicaciones cliente a gestionar toda la carga del estado conversacional y la memoria semántica. El trabajo identifica el Patrón de Proxy de Hidratación, una arquitectura que desacopla la persistencia de la sesión del motor de razonamiento.

03/09/2026
Hugging Face Blog

Entrenando un modelo de codificación para pintar acuarelas con TRL y OpenEnv

Entrenando un modelo de codificación para pintar acuarelas con TRL y OpenEnv

03/09/2026
The Verge AI

Google dice que su nuevo modelo Gemini 3.8 Flash “trabaja más duro”, pero podría costar más.

Google lanzó Gemini 3.8 Flash, llegando solo unas semanas después de su predecesor. La empresa afirma que el nuevo modelo "trabaja más duro" que Gemini 3.7 Flash al realizar más pasos de razonamiento en tareas complejas y "llamar a herramientas de forma iterativa". Tiene el mismo precio introductorio que 3.7 Flash, $0.75 por millón de tokens de entrada y $3.75 por millón […]

02/09/2026
The Verge AI

El asistente de IA de Amazon ahora puede detectar correos electrónicos falsos de la empresa.

Amazon está intentando combatir las estafas de suplantación de identidad con una nueva función que le permite usar su asistente de IA para determinar si un correo electrónico, mensaje de texto o llamada telefónica provino realmente de la empresa. Con la actualización, puede pedirle a Alexa que investigue un mensaje que recibió, y ella usará IA para comparar […]

02/09/2026
HF Daily Papers

Escalado de Bloques UE5M3 FP4 para el Preentrenamiento Estable de Modelos de Lenguaje

El preentrenamiento estable de punto flotante de 4 bits (FP4) es difícil porque la carga útil E2M1 representa solo un rango estrecho de magnitudes. La receta \nv{} de Transformer Engine de NVIDIA aborda esto con escalado de tensores actuales, una transformación de Hadamard aleatoria (RHT) y capas finales bfloat16 (BF16), añadiendo trabajo fuera de las multiplicaciones de matrices FP4. En su lugar, emparejamos las cargas útiles E2M1 con escalas de bloque sin signo E5M3 (\ue{}).

02/09/2026
The Verge AI

Los investigadores temen un desastre de seguridad antes del lanzamiento de Astra de OpenAI.

OpenAI está a punto de lanzar su modelo de IA más potente hasta ahora, Astra, tras semanas de retrasos para reforzar los protocolos de seguridad después de que sus agentes atacaran objetivos reales durante las pruebas. A medida que se van filtrando detalles sobre el modelo, los investigadores advierten que "puede ser el peor desarrollo único para la seguridad/seguridad de la IA hasta la fecha". Poco después de […]

02/09/2026
HF Daily Papers

frb100-40 Después de dos décadas: un certificado de optimalidad y un estudio de búsqueda preregistrado

Durante más de 20 años, el benchmark Model‑RB frb100‑40 siguió siendo un desafío abierto; desde 2014, su registro público se había mantenido en 99 de 100 variables. Proporcionamos un conjunto independiente de 100 vértices verificable para su grafo de 4 000 vértices. Junto con una partición verificada en 100 cliques de tamaño 40, el testigo demuestra que el tamaño máximo del conjunto independiente es 100 y el tamaño mínimo de la cubierta de vértices es 3 900. La ejecución estocástica que encontró el testigo se mantiene separada de esta prueba.

02/09/2026
The Verge AI

La administración Trump está apoyando a OpenAI en la demanda de derechos de autor del NYT.

La administración Trump ha intervenido en la demanda por derechos de autor del The New York Times contra OpenAI, presentando un argumento a favor del laboratorio de IA. La demanda histórica, presentada en diciembre de 2023, alega que OpenAI entrenó ilegalmente sus sistemas de IA con artículos del The New York Times y busca recuperar "miles de millones de dólares" en daños de […]

02/09/2026
HF Daily Papers

¿Los Modelos Fundamentales Tabulares Conocen la Física? Contaminación, Unidades y el Límite Determinista

Los modelos de fundación tabulares (TFMs) aprenden a completar tablas de la misma manera que los modelos de lenguaje completan texto, y las tablas son, sin duda, el formato en el que llega la mayor parte de la medición física. ¿Aprendieron alguna física en el proceso? Son bayesianos por construcción, así que la cuestión es qué contiene su priori. Lo investigamos directamente, evaluando cuatro de ellos (TabPFN-3, TabICLv2, TabDPT y Real-TabPFN-2.5) contra seis líneas base en conjuntos de datos muestreados de 316 ecuaciones físicas, dentro y fuera del dominio.

02/09/2026
The Verge AI

Google está enviando a MrBeast al desierto, armado con IA

MrBeast presentará Gemini, Google Health y el Fitbit Air en próximos videos como parte de una asociación plurianual con Google. El acuerdo comenzará con un video en el que Jimmy "MrBeast" Donaldson recurrirá a Gemini para obtener consejos de supervivencia en la naturaleza: el primero, el 5 de septiembre, será un nuevo video de MrBeast que seguirá a Jimmy y a su equipo.

02/09/2026
HF Daily Papers

SPADE: Detección de ataques SPaT desde la perspectiva del vehículo conectado

Los mensajes de Señal de Fase y Tiempo (SPaT) son una piedra angular de la seguridad de los vehículos conectados (CV), ya que permiten a los CV percibir y responder al estado de la intersección mediante la comunicación Vehículo-a-Infraestructura (V2I) y Vehículo-a-Vehículo (V2V). La integridad de estos mensajes está amenazada por una variedad de ataques a nivel de aplicación que pueden eludir la autenticación convencional cuando una unidad de carretera o un vehículo vecino está comprometido.

02/09/2026
HF Daily Papers

LoRA-TSD: Descenso Espectral en el Espacio Tangente para LoRA mediante Actualizaciones Muon-Style

La adaptación de bajo rango (LoRA) es la forma estándar de ajustar finamente modelos grandes, sin embargo, cuando sus dos factores se entrenan de manera independiente, la actualización ignora la geometría del cambio de peso de bajo rango que induce. Introducimos LoRA‑TSD, un optimizador que trata cada paso de LoRA como un vector tangente de la variedad de matrices de rango fijo y toma el paso de descenso más pronunciado con norma espectral de Muon dentro de ese espacio tangente, mapeando el resultado de vuelta a los factores mediante una retracción nativa de la parametrización de LoRA.

02/09/2026
Google AI Blog

Defensa cibernética proactiva para gobiernos y empresas

Presentando el Programa Fairwind

02/09/2026
AI News

Motional y MIT AI explican las decisiones del coche autónomo.

Motional y los investigadores del MIT han creado un sistema que permite a los autos autónomos explicar sus decisiones en tiempo real, abordando el problema de la caja negra en la IA de vehículos autónomos. El trabajo, publicado en Nature, proviene de un equipo de Motional que incluye a la directora ejecutiva Laura Major, trabajando junto a investigadores del Laboratorio de Ciencias de la Computación e Inteligencia Artificial del MIT. Su método propuesto, […] La publicación Motional y MIT IA explica decisiones de autos autónomos apareció primero en AI News.

02/09/2026
Hugging Face Blog

Inteligencia en tiempo real con IBM Time Series Models en Confluent

Inteligencia en tiempo real con IBM Time Series Models en Confluent

02/09/2026
OpenAI Blog

ATV Big Air Tour convirtió 3 días de trabajo en 3 horas con ChatGPT

ATV Big Air Tour usa ChatGPT Work para acelerar el marketing, la comercialización y más. Incluso convirtió fotos de mercancía en un sitio web de inventario en 15 minutos.

02/09/2026
Apple ML Research

REFACTOR-VLA: Aprendizaje no supervisado de bibliotecas de programas motrices tipados

La mayoría de los modelos actuales de visión‑lenguaje‑acción (VLA), como OpenVLA, π0, RT-2 y RDT-1B, son “monolíticos”. Esto significa que generan comandos motores crudos o secuencias muy cortas de acciones, sin organizar los comportamientos en abstracciones reutilizables y bien definidas. Como resultado, estos modelos rinden mal en tareas de horizonte largo (multietapa) y es difícil interpretar lo que han aprendido.

02/09/2026
Hugging Face Blog

BenchMIRT: ¿Qué están midiendo realmente los benchmarks de LLM?

BenchMIRT: ¿Qué están midiendo realmente los benchmarks de LLM?

01/09/2026
Google AI Blog

Las últimas noticias de IA que anunciamos en agosto de 2026

Transición de tarjetas: 1. Texto "Gemini 3.7 Flash" junto al ícono del logo de Gemini; 2. una foto de un teléfono pixel; 3. logo de Google Gemini encima del texto "Reclama tu plan estudiantil por 1 año sin costo".

01/09/2026
OpenAI Blog

Cómo las empresas nativas de IA convierten los flujos de trabajo en capacidad operativa

Basis, Clay y Exa Labs utilizan agentes de IA para mejorar la incorporación, la gestión de cuentas y las integraciones de desarrolladores. Vea qué pueden aplicar los líderes empresariales.

01/09/2026
AI News

ChatGPT Ads supera una tasa de ejecución de $1 mil millones en 200 días

ChatGPT Ads ha alcanzado mil millones de dólares en tasa de ingresos anualizada en menos de 200 días, y OpenAI está ampliando los anuncios de autoservicio a nuevas regiones. Decenas de miles de anunciantes ya utilizan la plataforma y el acceso de autoservicio a través de Ads Manager se lanza hoy en India, Europa, Oriente Medio y el norte de África. Según OpenAI, la gente […] La publicación ChatGPT Ads supera el ritmo de mil millones en 200 días apareció primero en AI News.

01/09/2026
Google AI Blog

Prueba Google Pics: creación y edición de imágenes fácil en Google Workspace

Collage de imágenes creado por Google Pics, con el texto "Say hello to Google Pics" en la parte superior.

01/09/2026
OpenAI Blog

Camino a Astra: capacidades críticas y salvaguardas de frontera

Astra es el primer modelo de OpenAI en cumplir el umbral de capacidad de ciberseguridad Critical bajo el Preparedness Framework, con salvaguardas más fuertes para su lanzamiento.

01/09/2026
OpenAI Blog

Las organizaciones de salud ahora pueden conectar EHR y datos adicionales de la industria a ChatGPT

ChatGPT ahora puede conectarse a datos de salud confiables, ayudando a los clínicos a acceder de forma segura al contexto del paciente, la investigación médica y más.

01/09/2026
OpenAI Blog

¿Cómo la firma de abogados Gilbert + Tobin gobierna y escala la IA con OpenAI?

Vea cómo Gilbert + Tobin combina el compromiso liderado por el CEO, una gobernanza rigurosa y la responsabilidad humana para escalar ChatGPT Enterprise y Codex en toda la firma.

01/09/2026
Hugging Face Blog

Presentamos @huggingface/kernels: más de 200 kernels WebGPU para IA local.

Presentamos @huggingface/kernels: más de 200 kernels WebGPU para IA local.

01/09/2026