Chain of News Agents & Code

Agents & Code

Ultime notizie

1640 contenuti totali

Partner consigliato

Sponsorizzato
ArXiv cs.AI

Resistenza Epistemica a Sybil: Moltiplicare gli Agenti IA Senza Moltiplicare le Prove

I sistemi di IA multi‑agente migliorano l’inferenza generando agenti e sintetizzando rapporti. Ma un altro agente non è un’altra osservazione: apparentemente rapporti indipendenti possono discendere dalla stessa evidenza, e un’evidenza realmente indipendente può produrre rapporti quasi identici. Formalizziamo questo come un problema epistemico di Sybil. Un rapporto Z è un’estensione epistemica di Sybil rispetto ai rapporti R quando I(Theta; Z | R) = 0.

03/09/2026
The New Stack

Multiverse afferma che il suo modello 438B è sufficientemente veloce per gli agenti IA. I benchmark raccontano una storia più complicata.

Un modello di ragionamento da 438 miliardi di parametri non è una scelta ovvia quando la velocità è una priorità. Multiverse Computing scommette che la compressione possa ... Il post Multiverse dice che il suo modello da 438B è sufficientemente veloce per gli agenti IA. I benchmark raccontano una storia più complicata. apparso per primo su The New Stack.

02/09/2026
Copilot Changelog

Le impostazioni gestite a livello aziendale supportano qualsiasi modello predefinito.

Puoi ora impostare il modello GitHub Copilot preferito come predefinito per le nuove conversazioni tramite le impostazioni gestite dall'azienda. Questo ti consente di scegliere il modello predefinito più adatto ai tuoi flussi di lavoro.… Il post Enterprise-managed settings support any default model è apparso per primo su The GitHub Blog.

02/09/2026
Copilot Changelog

Le esclusioni dei contenuti sono generalmente disponibili nell'app Copilot e nella CLI.

L'app GitHub Copilot e Copilot CLI ora rispettano le politiche di esclusione dei contenuti configurate da amministratori aziendali, di organizzazione e di repository. Copilot non utilizzerà i file esclusi come contesto, aiutandoti a proteggere le informazioni sensibili… Il post Content exclusions generally available in Copilot app and CLI è apparso per primo su The GitHub Blog.

02/09/2026
GitHub Blog

Come rendiamo la programmazione AI più efficiente in termini di costi senza sacrificare la qualità del compito.

Perché output più brevi possono costare di più e come GitHub Copilot riduce il lavoro sprecato nell'intero compito di programmazione. Il post "How we make AI coding more cost efficient without sacrificing task quality" è apparso per primo su The GitHub Blog.

02/09/2026
Simon Willison

Il nuovo prompt di sistema di Claude non vuole davvero riprodurre i testi delle canzoni.

Anthropic pubblica i prompt di sistema per le loro applicazioni consumer Claude (Claude.ai e le app mobile Claude – purtroppo non per Claude Cowork o Claude Code). Mi piace che lo facciano e che condividano non solo i prompt attuali ma anche le modifiche storiche ai loro prompt.

02/09/2026
DZone

Oltre il "Agent-Washing": i Principi di Ingegneria alla Base degli Agenti IA Pronti per la Produzione

Un agente IA non è definito da quanto intelligentemente parla. È definito da ciò a cui è affidato. Fornisci a un modello linguistico una finestra di chat e avrai un'interfaccia. Concedigli l'accesso a API di produzione, identità, logica di business, memoria e l'autorità di eseguire azioni per tuo conto, e otterrai qualcosa di categoricamente diverso: un nuovo tipo di attore software, capace di leggere i tuoi dati, scrivere nei tuoi sistemi e prendere decisioni più velocemente di qualsiasi revisore umano possa osservare in tempo reale.

02/09/2026
ArXiv cs.AI

OpenAgentFlow: Abilitare i Limiti di Sicurezza a Livello di Sistema per Flotte Eterogenee di Agenti IA

Gli agenti IA alimentati da grandi modelli linguistici stanno evolvendo da assistenti isolati a sistemi eterogenei in cui più agenti, pianificatori, controller e backend di esecuzione operano nello stesso ambiente utente o aziendale. In tali contesti, la sicurezza diventa un problema di governance delle azioni a livello di sistema: decidere se le azioni concrete generate dagli agenti debbano essere confermate prima di modificare lo stato condiviso.

02/09/2026
ArXiv cs.AI

EULER: Esplorare collegamenti poco usati con ritorno verificato da evidenze per la scoperta matematica multi‑agente

Le comunità matematiche lavorano con oggetti, invarianti e strumenti diversi, quindi trasferire un problema tra di esse è costoso e spesso viene evitato. Presentiamo EULER, un sistema multi‑agente che prende questo trasferimento—un ponte—come sua unità di ricerca.

02/09/2026
Simon Willison

Claude Fable 5.1 mi ha regalato un pellicano animato davvero bello.

Oggi è il giorno di Claude Fable (e Mythos) 5.1. Anthropic afferma che Fable 5.1 "stabiliscono un nuovo standard per la programmazione, il lavoro di conoscenza e i compiti di risoluzione di problemi a lungo termine". Il loro annuncio dedica una notevole quantità di tempo alla ricerca scientifica, vantandosi di un punteggio del 52,6 % sul nuovissimo benchmark Terminal-Bench-Science 0.1 (annunciato per la prima volta il 27 agosto), in aumento rispetto al 24,7 % di Fable 5, al 29,0 % di Opus 5 e al 22,4 % di GPT-5.6 Sol.

01/09/2026
Copilot Changelog

Imposta una data di scadenza per i budget individuali degli utenti.

Puoi ora impostare una data di scadenza opzionale su un budget individuale per utente, e GitHub rimuove il budget in quella data. Questa funzionalità è ora disponibile per tutti. L'utente poi… Il post Set an expiration date for individual user budgets è apparso per primo su The GitHub Blog.

01/09/2026
TechCrunch AI

AIR raccoglie 50 milioni di dollari per aiutare le aziende a verificare le competenze e i componenti aggiuntivi utilizzati dagli agenti IA.

La piattaforma di AIR può scoprire gli agenti in esecuzione in un'azienda, verifica continuamente le competenze e i componenti aggiuntivi che utilizzano e blocca qualsiasi comportamento indesiderato.

01/09/2026
The New Stack

Il rivale Claude Code di Meta esce dalla fase beta con tre nuovi livelli di abbonamento — e sta spingendo molto sul prezzo.

Meta ha lanciato formalmente Muse Code fuori dalla fase beta, meno di un mese dopo il suo debutto iniziale dell'agente di programmazione. Accanto al post "Il rivale Claude Code di Meta esce dalla beta con tre nuovi livelli di abbonamento — e sta spingendo forte sul prezzo" apparso per primo su The New Stack.

01/09/2026
HF Daily Papers

MutMem-V2: Mutazione autorizzata crittograficamente nella memoria persistente dell'agente Verifica portatile e prove riproducibili

MutMem V1 ha introdotto una mutazione autorizzata crittograficamente e che preserva la conservazione dei dati per la memoria persistente dell'agente, ma non ha fornito un contratto di verifica portatile completo né un percorso di riproduzione per l'installazione pulita. MutMem V2 colma questa lacuna di pubblicazione senza introdurre un secondo motore di memoria.

01/09/2026
AI News

Perché i server MCP stanno diventando la nuova superficie di attacco dell'IA.

Man mano che l'adozione dell'IA accelera, lo fa anche l'evoluzione dell'infrastruttura che la supporta. Nuovi standard e connettori continuano a comparire, e quelli che prendono piede si diffondono nell'ecosistema in mesi anziché in anni. Questa velocità potenzia le capacità dell'IA, ma rende molto difficile per i team di sicurezza mantenere protezioni sufficienti. […] Il post Why MCP servers are becoming AI’s newest attack surface è apparso per la prima volta su AI News.

01/09/2026
The New Stack

Riduci l'uso del token dell'agente di codifica con output di strumenti migliori

Prima che un agente di codifica AI scriva una singola riga di codice, ha già speso token. Ad esempio, nella fonte "The post Cut coding agent token use with better tool output appeared first on The New Stack".

31/08/2026
HF Daily Papers

Oltre il payload: come l’invocazione da parte dell’utente influenza la vulnerabilità degli agenti di codifica al “poisoning” dei repository.

Gli agenti di codifica sono sempre più utilizzati per compiti di ingegneria del software, incluso l'avvio di progetti da repository di terze parti la cui integrità non può essere data per scontata. I lavori precedenti sul avvelenamento dei repository si concentrano in gran parte sull'iniezione controllata dall'attaccante e sul travestimento, ma gli sviluppatori modellano anche il rischio attraverso le scelte quotidiane di invocazione: quale compito delegare, come formulare la richiesta e quali competenze o regole fornire.

31/08/2026
Simon Willison

Comprendere il lavoro di ChatGPT

OpenAI ha annunciato ChatGPT Work il 9 luglio e da allora ha continuato a ripeterlo furiosamente. È un prodotto straordinariamente confuso e molto potente. Ecco cosa ho capito finora. ChatGPT Work è in realtà composto da due prodotti. La versione più interessante di ChatGPT Work è quella che funziona nel cloud. È possibile accedervi tramite chatgpt.com o tramite le app mobili ChatGPT. Chiamiamolo Work Cloud.

30/08/2026
InfoQ AI/ML

AWS Open Sources Kiro Crew per gli agenti di codifica asincrona

Amazon ha recentemente annunciato Kiro Crew, un sistema open source per eseguire più agenti di codifica Kiro in diverse sessioni, strumenti e compiti. Il nuovo spazio di lavoro consente agli sviluppatori di assegnare compiti di codifica asincroni agli agenti AI, permettendo che attività come l'indagine su incidenti, la triage dei ticket, le migrazioni e il monitoraggio delle PR continuino senza supervisione attiva. Di Renato Losio

30/08/2026
InfoQ AI/ML

Presentazione: Progettare il livello dati per gli agenti IA: dai sistemi transazionali a MCP e modelli semantici

Fabiane Nardon condivide come TOTVS prepara i dati aziendali per gli agenti IA affamati di token. Discute dell'equilibrio tra logica deterministica e LLM non deterministici in termini di precisione, sicurezza e costo. Nardon descrive l'uso del data mesh, delle architetture di database a bassa latenza, delle ontologie semantiche e della selezione dinamica degli strumenti MCP per ottimizzare le finestre di contesto e ridurre il sovraccarico di token nei sistemi transazionali. Di Fabiane Nardon.

29/08/2026
DZone

Il Piano di Controllo del Ragionamento: Lo Strato Architettonico Mancante nei Sistemi Multi-Agente

Abbiamo trascorso gli ultimi due anni a imparare come ancorare un singolo agente IA ai dati aziendali. Questa è stata la parte facile. Coordinare una flotta di agenti si rivela invece un problema completamente diverso. I sistemi multi‑agente pongono domande a cui le nostre piattaforme attuali non sono state progettate per rispondere. Come possono due agenti condividere lo stato senza contraddirsi? Quali credenziali vengono utilizzate quando l'Agente A chiama l'Agente B? Chi verifica la decisione quando un agente attiva un altro basandosi su un'inferenza probabilistica?

28/08/2026
GNews: Cursor Windsurf

Cursor AI Hack: Aurora Ransomware violazione di 7 aziende [2026] - tech-insider.org

Cursor AI Hack: Aurora Ransomware viola 7 aziende [2026] tech-insider.org

28/08/2026
GNews: AI Agents Code

Annuncio di AI Studio Skill—strumenti pro-code per sviluppatori - Oracle Blogs

Annuncio di AI Studio Skill—strumenti pro-code per sviluppatori Oracle Blogs

28/08/2026
GNews: AI Agents Code

Agent Island consente agli sviluppatori di allontanarsi mentre Claude Code e Codex continuano a lavorare.

Agent Island consente agli sviluppatori di allontanarsi mentre Claude Code e Codex continuano a lavorare.

28/08/2026
HN AI/LLM

Terminal-Bench-Science: Valutare gli agenti IA nei flussi di lavoro della ricerca scientifica

Terminal-Bench-Science: Valutare gli agenti IA nei flussi di lavoro della ricerca scientifica

28/08/2026
TLDR AI

Gemini Omni 1.1 🎬, Cohere Parse 📄, Codex persistent mode 👨‍💻

Gemini Omni 1.1 🎬, Cohere Parse 📄, Codex persistent mode 👨‍💻

28/08/2026
Claude Blog

Claude per insegnanti, ora disponibile per scuole e distretti.

Claude per insegnanti, ora disponibile per scuole e distretti.

28/08/2026
Claude Blog

Come i dipendenti di Anthropic usano Claude Tag

Come i dipendenti di Anthropic usano Claude Tag

28/08/2026
Ars Technica AI

Il nuovo standard hardware di Anthropic consente agli agenti IA di controllare il mondo fisico.

L'interfaccia driver standardizzata mira a consentire ai dispositivi di comunicare con l'IA e tra loro.

27/08/2026
GNews: AI Agents Code

Tuttavia, OpenAI persiste con il nuovo agente sempre attivo - Gizmodo

Tuttavia, OpenAI persiste con il nuovo agente sempre attivo di Gizmodo.

27/08/2026