Encrypted Reasoning Traces Are Not A Security Boundary
Encrypted Reasoning Traces Are Not A Security Boundary A new research paper shows a major flaw in how AI providers handle reasoning. Anthropic, OpenAI, and Google send encrypted r…
AI, machine learning e insight sugli LLM.
Encrypted Reasoning Traces Are Not A Security Boundary A new research paper shows a major flaw in how AI providers handle reasoning. Anthropic, OpenAI, and Google send encrypted r…
La SPV, denominata Theseus Infrastructure, raccoglierà capitale, attingerà a fondi di credito privato, costruirà i data center e li affitterà ad Anthropic. I canoni di locazione dovranno coprire tale indebitamento, il che significa che gli sviluppatori potrebbero dover affrontare tariffe più elevate per le API di Claude qualora i costi del debito nascosto dovessero aumentare.
Dopo quattro mesi trascorsi a spostare una pipeline RAG da un notebook, l'autore dimostra che la sola modifica della strategia di chunking ha portato il tasso di successo del recupero all'83%, mentre un set di valutazione di 200 query ora intercetta la maggior parte delle regressioni prima che raggiungano i clienti.
Le dimissioni si aggiungono a una serie di addii dai team di sicurezza di OpenAI, tra cui il gruppo Superalignment nel 2024 e i rimpasti del consiglio di amministrazione nel 2023, evidenziando la crescente tensione tra il rapido rilascio di prodotti e i controlli interni sui rischi.
Lo studio del NIST ha imposto una revisione del funzionamento degli strumenti di ricerca di tatuaggi, esortando gli sviluppatori ad abbandonare i match binari, a mostrare punteggi di somiglianza e a lasciare che siano analisti esperti a prendere le decisioni finali prima di qualsiasi utilizzo in ambito legale.
L'ultimo fondo da 550 milioni di dollari di Accel fa parte di un piano globale da 3,5 miliardi di dollari rivolto all'India, mirato a startup fintech basate sull'IA, manifattura avanzata e deep-tech, con una strategia che favorisce lo sviluppo di applicazioni basate su modelli linguistici di grandi dimensioni esistenti.
Subquadratic afferma che il suo modello SubQ garantisce un'accuratezza pari ai principali LLM in ambito coding e ricerca, riducendo drasticamente il numero di moltiplicazioni quadratiche che fanno lievitare i consumi energetici e i costi del cloud.
Alimentando i modelli di Anthropic con simulazioni fisiche personalizzate, la startup sostenuta da YC può testare migliaia di candidati materiali ogni giorno, abbattendo il tradizionale limite di 20 tentativi giornalieri e accelerando il percorso verso la creazione di composti dissipatori di calore brevettabili e producibili.
Il nuovo manifesto sull'IA di Zuckerberg, che sia stato scritto da lui, dal suo team o da un LLM, presenta l'IA come l'inevitabile acceleratore di produttività. I critici sostengono che esso trascuri il bisogno umano di un'espressione autentica basata sull'impegno, avvertendo che un'ondata di contenuti a basso sforzo potrebbe svuotare di significato l'interazione online.
La filigranatura sarà invisibile per il testo e utilizzerà lo standard aperto C2PA per le immagini, mantenendosi anche dopo copia-incolla e modifiche minori, ma modifiche sostanziali o cambi di formato potrebbero comunque rimuovere il segnale.
La collaborazione integrerà agenti IA capaci di recuperare dati, progettare molecole, eseguire simulazioni e redigere protocolli di laboratorio in un unico ciclo, con l'obiettivo di comprimere un processo che tradizionalmente richiede anni in pochi mesi.
A partire dal 2 agosto, Anthropic inserirà una firma digitale nascosta in ogni testo generato da Claude: una filigrana a livello di token capace di resistere al copia-incolla e a lievi modifiche. La mossa risponde al Codice di Trasparenza dell'EU AI Act e contrasta la minaccia, di recente coniata, del 'Claudefishing', ovvero l'impersonificazione realizzata tramite IA.
Anthropic inserirà watermark leggibili dalle macchine in ogni output di Claude — sia testuale che visivo — utilizzando lo standard C2PA per le immagini e un nuovo segnale linguistico per il testo, aggiornando i modelli esistenti entro un periodo di grazia di quattro mesi per rispettare la scadenza del 2 agosto stabilita dall'AI Act.
OpenAI ha confermato che ChatGPT ha raggiunto un miliardo di utenti attivi settimanali a luglio, dopo una crescita di cinque mesi partendo da 900 milioni, mentre Gemini di Google è passato da 750 milioni a un miliardo di utenti mensili tra febbraio e l'inizio di agosto, segnando la crescita di prodotto più rapida nella storia di Google.
Spotify etichetterà le personalità AI e limiterà le raccomandazioni algoritmiche. Spotify sta prendendo una posizione decisa contro l'afflusso di identità sintetiche introducendo l'etichetta "AI Persona"...
Nemotron 3.5 Lightning’s hybrid Mamba-Transformer architecture activates just 3.6 billion of its 31.6 billion parameters per token, delivering 670 tokens per second—about twice Gemini 3.5 Flash-Lite’s 386 tps—while scoring 24 on the Intelligence Index, on par with OpenAI’s 120-billion-parameter mode
Lightcap, who built OpenAI’s finance, legal, security and go-to-market functions, announced his departure to launch a venture tackling AI infrastructure and governance—areas he says could block the technology’s global mission. His exit follows a wave of senior exits as the firm readies for a potenti
Il modello di seconda generazione di Backflip AI converte scansioni 3D grezze e file mesh in operazioni CAD completamente parametriche — estrusioni, rivoluzioni e altro ancora — direttamente all'interno di Autodesk Fusion, consentendo agli ingegneri di modificare le dimensioni al volo.
Il rilascio b10327 corregge i calcoli dei thread-block che causavano crash per esaurimento della memoria e perdita di precisione, mentre NeMo 3.0 di NVIDIA e ROCm di AMD introducono strumenti per il parlato e il supporto a SVDQuant, consolidando l'intero stack di IA locale.
Il nuovo modello non solo vanta un punteggio Elo di 1.439 in Image Edit e 1.320 in Text-to-Image, ma include anche strumenti come Magic Wand, Segmentation e Smart Resize, con l'obiettivo di ottimizzare i flussi di lavoro professionali, dalle foto di prodotto agli asset per i videogiochi.
Il test ha indicizzato 100k embedding di OpenAI a 1536 dimensioni, rivelando che LanceDB non solo carica i dati in modo drasticamente più veloce, ma utilizza anche circa un terzo dello spazio di archiviazione richiesto da pgvector, mentre il modello 'process-per-client' di pgvector gli conferisce un vantaggio in termini di concorrenza.
Anthropic ha ricalibrato il classificatore di sicurezza di Fable 5, riducendo drasticamente i blocchi per falsi positivi sulle domande biomediche di routine di circa quattro quinti, pur mantenendo i divieti assoluti su virologia, tossicologia e progettazione molecolare, e lanciando un programma di accesso per ricercatori accreditati.
A seguito di una sentenza di un tribunale tedesco secondo cui il suo modello può riprodurre brani protetti da copyright e di un caso di frode sulle royalty da 8 milioni di dollari di alto profilo, Suno sta inasprendo i filtri dei prompt, integrando le scansioni di Audible Magic e Musixmatch e limitando il numero di brani che gli utenti possono scaricare contemporaneamente.
Il nuovo canale combina clip in stile anime, CGI a basso budget, brevi scene horror e una rivisitazione fantasy dell'Odissea, ma gli spettatori lamentano una qualità visiva estremamente inconsistente e interruzioni pubblicitarie brusche.