Chain of News AI & LLM

AI & LLM

Ultime notizie

3913 contenuti totali

Partner consigliato

Sponsorizzato
ArXiv cs.AI

Ricevuta della Richiesta: Verifica della Sufficientza delle Prove e della Copertura nelle Valutazioni degli Agenti

Le valutazioni degli agenti affrontano due distinte questioni probatorie: se un'affermazione segnalata sia ricomputabile dalle prove conservate (sufficienza) e se i registri conservati coprano l'insieme di esperimenti impegnati (copertura). I log generici e le trascrizioni collegate tramite hash non rispondono in modo affidabile a nessuna delle due. Introduciamo ClaimReceipt, una specifica di ricevuta relativa alle affermazioni e un verificatore selettivo che lega le prove di transazione tipizzate a un manifesto di esperimento firmato e restituisce PASS, INVALID o INCONCLUSIVE per ogni affermazione.

03/09/2026
ArXiv cs.AI

EvalDetectBench: un benchmark per misurare la consapevolezza della valutazione nei modelli linguistici di frontiera

I modelli di linguaggio di ultima generazione possono spesso riconoscere quando vengono valutati, una capacità nota come consapevolezza della valutazione. Se i modelli si comportano in modo diverso durante le valutazioni rispetto al loro impiego reale, ciò compromette la validità dei risultati delle valutazioni, che sono un componente cruciale dei quadri attuali di sicurezza dell'IA.

03/09/2026
ArXiv cs.AI

Quando può una macchina fidarsi di uno statuto? Un certificato di sopravvivenza per la logica legale estratta da macchine.

Gli statuti vengono sempre più analizzati da macchine prima che le persone li leggano, e i parser non sono d'accordo: sugli statuti del Missouri, due estrattori scritti indipendentemente divergono sulla presenza di soglie numeriche con un tasso di falsi negativi dello 0,43. Ci chiediamo quale logica formale sopravviva a tale rumore.

03/09/2026
ArXiv cs.AI

SSAKG 2.0: Un pacchetto open-source per la memoria sequenziale associativa strutturale e il recupero basato sul contesto

Questo articolo presenta SSAKG 2.0, un pacchetto software open-source per la costruzione e l'utilizzo di Structural Sequential Associative Knowledge Graphs (SSAKGs). Un SSAKG rappresenta gli oggetti come vertici del grafo e le sequenze ordinate come pattern strutturali delle connessioni del grafo. Il grafo sparso risultante è usato come memoria associativa in cui le sequenze complete possono essere ricostruite da un contesto parziale e non ordinato.

03/09/2026
ArXiv cs.AI

Progettare sistemi di dati conversazionali per API LLM senza stato: il modello di proxy di idratazione

Mentre le piattaforme aziendali passano a interfacce di ragionamento conversazionale, la natura senza stato delle API LLM crea un divario architetturale. Sebbene la mancanza di stato consenta la scalabilità orizzontale per i fornitori di IA, costringe le applicazioni client a gestire l’intero onere dello stato conversazionale e della memoria semantica. Il lavoro individua il **Hydration Proxy Pattern**, un’architettura che separa la persistenza della sessione dal motore di ragionamento.

03/09/2026
Hugging Face Blog

Addestrare un modello di programmazione per dipingere acquerelli con TRL e OpenEnv

Addestrare un modello di programmazione per dipingere acquerelli con TRL e OpenEnv

03/09/2026
The Verge AI

Google afferma che il suo nuovo modello Gemini 3.8 Flash “lavora di più”, ma potrebbe costare di più.

Google ha lanciato Gemini 3.8 Flash, arrivato solo poche settimane dopo il suo predecessore. L'azienda afferma che il nuovo modello "lavora di più" rispetto a Gemini 3.7 Flash, eseguendo più passaggi di ragionamento su compiti complessi e "richiamando gli strumenti in modo iterativo". Ha lo stesso prezzo introduttivo di 3.7 Flash, 0,75 $ per milione di token di input e 3,75 $ per milione di […]

02/09/2026
The Verge AI

L'assistente AI di Amazon può ora individuare le email false provenienti dall'azienda.

Amazon sta cercando di combattere le truffe di impersonificazione con una nuova funzionalità che consente di utilizzare il suo assistente AI per determinare se un'email, un messaggio di testo o una chiamata telefonica provengono effettivamente dall'azienda. Con l'aggiornamento, è possibile chiedere ad Alexa per Shopping informazioni su un messaggio ricevuto, e l'assistente utilizzerà l'IA per confrontare […]

02/09/2026
HF Daily Papers

UE5M3 FP4 Ridimensionamento dei Blocchi per il Pre‑addestramento Stabile dei Modelli Linguistici

Il pretraining stabile a 4 bit in virgola mobile (FP4) è difficile perché il payload E2M1 rappresenta solo un intervallo ristretto di magnitudini. La ricetta \nv{} del Transformer Engine di NVIDIA affronta questo problema con il ridimensionamento dei tensori corrente, una trasformata di Hadamard randomizzata (RHT) e strati finali bfloat16 (BF16), aggiungendo lavoro al di fuori delle moltiplicazioni di matrici FP4. Noi, invece, accoppiamo i payload E2M1 con scale di blocco unsigned E5M3 (\ue{}).

02/09/2026
The Verge AI

I ricercatori temono un disastro per la sicurezza in vista del rilascio di Astra da parte di OpenAI.

OpenAI è sul punto di rilasciare il suo modello di IA più potente finora, Astra, dopo settimane di ritardi per rafforzare i protocolli di sicurezza a seguito degli attacchi dei suoi agenti a obiettivi reali durante i test. Man mano che i dettagli sul modello emergono, i ricercatori avvertono che potrebbe essere "lo sviluppo più negativo per la sicurezza/affidabilità dell'IA fino ad oggi". Poco dopo […]

02/09/2026
HF Daily Papers

frb100-40 Dopo due decenni: un certificato di ottimalità e uno studio di ricerca preregistrato.

Per più di 20 anni, il benchmark Model‑RB frb100‑40 è rimasto una sfida aperta; dal 2014, il suo record pubblico era di 99 variabili su 100. Forniamo un insieme indipendente di 100 vertici verificabile per il suo grafo di 4.000 vertici. Insieme a una partizione verificata in 100 clique di dimensione 40, il testimone dimostra che la dimensione massima dell’insieme indipendente è 100 e la dimensione minima del vertex‑cover è 3.900. L’esecuzione stocastica che ha trovato il testimone è tenuta separata da questa dimostrazione.

02/09/2026
The Verge AI

L'amministrazione Trump sta sostenendo OpenAI nella causa per violazione del copyright intentata dal NYT.

L'amministrazione Trump è intervenuta nella causa per violazione del copyright intentata dal New York Times contro OpenAI, avanzando un argomento a favore del laboratorio di intelligenza artificiale. La causa storica, presentata a dicembre 2023, accusa OpenAI di aver addestrato illegalmente i propri sistemi di IA su articoli del New York Times e di cercare di recuperare “miliardi di dollari” di danni da […]

02/09/2026
HF Daily Papers

I Modelli di Fondazione Tabulari Conoscono la Fisica? Contaminazione, Unità e il Limite Deterministico

I modelli di fondazione tabulari (TFM) imparano a completare le tabelle nello stesso modo in cui i modelli linguistici completano il testo, e le tabelle sono probabilmente il formato in cui arrivano la maggior parte delle misurazioni fisiche. Hanno appreso qualche concetto di fisica durante il processo? Sono bayesiani per costruzione, quindi la domanda è cosa contenga il loro prior. Lo esaminiamo direttamente, valutando quattro di essi (TabPFN-3, TabICLv2, TabDPT e Real-TabPFN-2.5) contro sei baseline su dataset campionati da 316 equazioni fisiche, sia dentro che fuori dal dominio.

02/09/2026
The Verge AI

Google sta inviando MrBeast nella natura selvaggia, armato di intelligenza artificiale.

MrBeast presenterà Gemini, Google Health e il Fitbit Air nei prossimi video nell'ambito di una partnership pluriennale con Google. L'accordo inizierà con un video in cui Jimmy "MrBeast" Donaldson si rivolge a Gemini per consigli di sopravvivenza nella natura: il primo, in programma per il 5 settembre, sarà un nuovo video di MrBeast che segue Jimmy e il suo team […]

02/09/2026
HF Daily Papers

SPADE: Rilevamento degli Attacchi SPaT dalla Prospettiva del Veicolo Connesso

I messaggi Signal Phase and Timing (SPaT) sono una pietra miliare della sicurezza dei veicoli connessi (CV), consentendo ai CV di percepire e rispondere allo stato dell’intersezione tramite comunicazione Vehicle-to-Infrastructure (V2I) e Vehicle-to-Vehicle (V2V). L’integrità di questi messaggi è minacciata da una serie di attacchi a livello di applicazione che possono aggirare l’autenticazione convenzionale quando un’unità stradale o un veicolo peer è compromesso.

02/09/2026
HF Daily Papers

LoRA-TSD: Discesa Spettrale nello Spazio Tangente per LoRA tramite Aggiornamenti in Stile Muon

L'adattamento a bassa rango (LoRA) è il metodo standard per affinare i grandi modelli, tuttavia quando i suoi due fattori vengono addestrati in modo indipendente, l'aggiornamento ignora la geometria della variazione di peso a bassa rango che induce. Introduciamo LoRA‑TSD, un ottimizzatore che tratta ogni passo di LoRA come un vettore tangente del varietà delle matrici a rango fisso e compie il passo di discesa più ripida in norma spettrale di Muon all'interno di quello spazio tangente, rimappando il risultato ai fattori tramite una retrazione nativa della parametrizzazione LoRA.

02/09/2026
Google AI Blog

Difesa informatica proattiva per governi e imprese

Introduzione al Programma Fairwind

02/09/2026
AI News

Motional e MIT AI spiegano le decisioni delle auto a guida autonoma

Motional e i ricercatori del MIT hanno creato un sistema che consente alle auto a guida autonoma di spiegare le proprie decisioni in tempo reale, affrontando il problema della "scatola nera" nell'IA dei veicoli autonomi. Il lavoro, pubblicato su Nature, proviene da un team di Motional che include la CEO Laura Major, che collabora con i ricercatori del Computer Science and Artificial Intelligence Laboratory del MIT. Il loro metodo proposto, […] L'articolo Motional and MIT AI explains self-driving car decisions è apparso per primo su AI News.

02/09/2026
Hugging Face Blog

Intelligenza in tempo reale con i modelli di serie temporali IBM su Confluent

Intelligenza in tempo reale con i modelli di serie temporali IBM su Confluent

02/09/2026
OpenAI Blog

ATV Big Air Tour ha trasformato 3 giorni di lavoro in 3 ore con ChatGPT

ATV Big Air Tour utilizza ChatGPT Work per accelerare marketing, merchandising e altro. Ha persino trasformato le foto dei prodotti in un sito di inventario in 15 minuti.

02/09/2026
Apple ML Research

REFACTOR-VLA: Apprendimento non supervisionato di librerie di programmi motori tipizzati

I modelli più recenti di visione‑linguaggio‑azione (VLA), come OpenVLA, π0, RT-2 e RDT-1B, sono “monolitici”. Ciò significa che generano comandi motori grezzi o sequenze molto brevi di azioni, senza organizzare i comportamenti in astrazioni riutilizzabili e ben definite. Di conseguenza, questi modelli hanno scarse prestazioni su compiti a lungo orizzonte (a più passaggi) ed è difficile interpretare ciò che hanno appreso.

02/09/2026
Hugging Face Blog

BenchMIRT: cosa misurano realmente i benchmark per i LLM?

BenchMIRT: Cosa misurano realmente i benchmark per i LLM?

01/09/2026
Google AI Blog

Le ultime notizie sull'IA che abbiamo annunciato ad agosto 2026

Transizione delle schede: 1. Testo "Gemini 3.7 Flash" accanto all'icona del logo Gemini; 2. una foto di un telefono Pixel; 3. logo Google Gemini sopra il testo "Richiedi il tuo piano studente per 1 anno senza costi".

01/09/2026
OpenAI Blog

Come le aziende AI-native trasformano i flussi di lavoro in capacità operative

Basis, Clay ed Exa Labs utilizzano agenti IA per migliorare l’onboarding, la gestione degli account e le integrazioni per gli sviluppatori. Scopri cosa possono applicare i leader aziendali.

01/09/2026
AI News

ChatGPT Ads supera il tasso di esecuzione di 1 miliardo di dollari in 200 giorni.

ChatGPT Ads ha raggiunto un fatturato annuo di 1 miliardo di dollari in meno di 200 giorni, e OpenAI sta espandendo gli annunci self‑service a nuove regioni. Decine di migliaia di inserzionisti ora utilizzano la piattaforma e l’accesso self‑service tramite Ads Manager sarà lanciato oggi in India, Europa, Medio Oriente e Nord Africa. Secondo OpenAI, le persone […] L’articolo “ChatGPT Ads passes $1B run rate in 200 days” è stato pubblicato per prima su AI News.

01/09/2026
Google AI Blog

Prova Google Pics: creazione e modifica facili di immagini in Google Workspace

Collage di immagini create da Google Pics, con il testo "Say hello to Google Pics" in alto.

01/09/2026
OpenAI Blog

Percorso verso Astra: capacità critiche e salvaguardie di frontiera

Astra è il primo modello OpenAI a soddisfare la soglia di capacità critica di cybersicurezza nel quadro di Preparazione, con misure di salvaguardia più robuste per il rilascio.

01/09/2026
OpenAI Blog

Le organizzazioni sanitarie possono ora collegare i dati EHR e altri dati del settore a ChatGPT

ChatGPT può ora connettersi a dati sanitari affidabili, aiutando i clinici ad accedere in modo sicuro al contesto dei pazienti, alla ricerca medica e altro.

01/09/2026
OpenAI Blog

Come lo studio legale Gilbert + Tobin gestisce e scala l'IA con OpenAI

Scopri come Gilbert + Tobin combina l'impegno guidato dal CEO, una governance rigorosa e la responsabilità umana per estendere ChatGPT Enterprise e Codex in tutta l'azienda.

01/09/2026
Hugging Face Blog

Presentazione di @huggingface/kernels: oltre 200 kernel WebGPU per l'IA locale

Presentazione di @huggingface/kernels: oltre 200 kernel WebGPU per l'IA locale.

01/09/2026