Notizie quotidiane sui LLM — 2026-09-25
Solo 89 minuti dopo che Anthropic ha annunciato Claude Opus 5.5 il 22 settembre, OpenAI ha lanciato GPT-6 Sol/Luna dimezzandone i prezzi: la sfida tra annunci di modelli chiusi è stata confermata indipendentemente su quattro piattaforme — X, YouTube, Bluesky e Lemmy — ed è il tema più discusso di oggi. La valutazione dello slancio dei modelli open-weight, però, varia nettamente da una piattaforma all'altra.
Le notizie LLM più discusse di oggi — 2026-09-25
L'evento più importante della settimana è la "gara sui tempi degli annunci" tra modelli chiusi: appena 89 minuti dopo l'annuncio di Anthropic per "Claude Opus 5.5" il 22 settembre, OpenAI ha introdotto "GPT-6 Sol/Luna" dimezzandone il prezzo. L'episodio è stato trattato indipendentemente su quattro piattaforme — X, YouTube, Bluesky e Lemmy — e si può considerare il tema più discusso di oggi. Su Reddit, al contrario, quasi non se ne parla: hanno invece attirato attenzione argomenti su un asse diverso rispetto al confronto fra modelli chiusi e open-weight, come l'aumento dei prezzi delle GPU locali e l'indagine delle autorità di Pechino su DeepSeek/Kimi. Lo slancio dei modelli open-weight viene giudicato in modi diametralmente opposti a seconda della piattaforma: non si può quindi liquidare la situazione dicendo semplicemente che l'open sta vincendo o perdendo.
Across platforms
- Botta e risposta Claude Opus 5.5 → GPT-6 Sol/Luna: il lancio di GPT-6 Sol/Luna da parte di OpenAI appena 89 minuti dopo l'annuncio di Opus 5.5 da parte di Anthropic il 22 settembre, con prezzi dimezzati, è stato citato separatamente su YouTube (AI時短ラボ "Opus5.5発表当日にGPTも更新" https://www.youtube.com/watch?v=fl42jHc7Ewc, BitBiasedAI https://www.youtube.com/watch?v=m5wb-3gsmOo), Bluesky (TestingCatalog https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w, Simon Willison https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n) e Lemmy (tre thread relativi a Opus 5.5 via !ai_reddit https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/ ecc.). Su X, creatori giapponesi nel settore video e videogiochi hanno pubblicato in sequenza dimostrazioni pratiche in cui sfruttano Opus 5.5 (tra gli altri @kevin_t_ngo https://x.com/kevin_t_ngo/status/2102761406315839798), a indicare che il tema è ormai entrato in una fase d'uso concreto più che di semplice notizia.
- Valutazioni divergenti su chiusi contro open-weight: Lemmy ha un tono fortemente favorevole agli open-weight, guidato da un articolo che cita dati Vercel secondo cui la quota di mercato dei modelli chiusi sarebbe crollata dal 70% al 21,6% in tre mesi (https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/). Al contrario, su Bluesky il post di Simon Willison che confronta Opus 5.5 e GPT-6 (👍123) ha ricevuto una reazione enormemente maggiore rispetto all'open source di MiMo-V2.6 di Xiaomi (👍2), mentre YouTube descrive gli open-weight come "silenziosi oggi". Anche osservando gli eventi della stessa settimana, una piattaforma conclude che l'open avanza e un'altra che avanzano i modelli chiusi: è una divergenza da tenere presente.
- Interesse per sicurezza e governance: diversi temi legati a incidenti e rischi causati dagli LLM sono stati ripresi indipendentemente su più piattaforme, inclusi l'incidente di accesso non autorizzato di Gemini (divulgato il 18 settembre, YouTube: NEWS9 Live https://www.youtube.com/watch?v=MOyQRVF7gXE) e la ricerca sulla deanonymizzazione su larga scala tramite LLM (Lemmy !blueteamsec https://infosec.pub/post/52730942).
Platform by platform
Reddit: i principali fronti sono r/LocalLLaMA (esecuzione locale e hardware) e r/singularity (notizie rapide sui nuovi modelli). Il post col punteggio più alto della giornata è stato lo sconforto per il rincaro di GPU locali e hardware dedicato (647pt, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), seguito da un thread secondo cui DeepSeek/Kimi sarebbe sotto indagine delle autorità di Pechino per sospette "fughe di dati ad Anthropic" (311pt, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Argomenti sociali e culturali, come la crescente accettazione della scrittura con LLM nel mondo accademico (r/PhD, 493pt), hanno raccolto più punti delle notizie di prodotto. Vale la pena registrare, come esempio del divario fra piattaforme evidenziato dal brief, che nella raccolta Reddit non compaiono riferimenti a Opus 5.5 o GPT-6 Sol/Luna, il principale tema delle altre piattaforme.
X: Explore (i trend) era dominato da argomenti estranei agli LLM — Taylor, Serbia, Cardano e altri — e le sole due query che hanno funzionato per contenuti LLM sono state "Opus 5.5" e "Claude". Gli otto post trovati erano tutti dimostrazioni pratiche di creatori individuali giapponesi che "hanno fatto usare strumenti a Opus 5.5"; non è emersa alcuna fonte primaria con valore di notizia, come annunci di modelli, variazioni di prezzo o benchmark. La raccolta è stata interrotta a otto elementi, senza raggiungere il criterio di completamento di dieci.
YouTube: il tema che si è acceso più rapidamente è stato il "primo risultato" del nuovo laboratorio biologico di Anthropic: Claude avrebbe scoperto un sistema enzimatico simile a CRISPR (ART). Più canali lo hanno trattato simultaneamente 18–19 ore dopo la pubblicazione (Dr. Samuel Allen Alexander https://www.youtube.com/watch?v=_m_216JykA0, Wes Roth https://www.youtube.com/watch?v=H7KruLVX2Rk). Sono usciti anche più video che confrontano prezzi e benchmark di Opus 5.5 e GPT-6 Sol/Luna; non è stato possibile ottenere visualizzazioni e iscritti (vedi Limits), ma per qualità degli argomenti questa è stata la piattaforma più ricca della giornata.
Bluesky: TestingCatalog e Simon Willison sono i nodi informativi principali. Abbondano notizie ancora nella fase di "anticipazione/fuga", come il preannuncio del lancio di GPT-6 Sol/Luna, leak di Gemini 4 Pro e informazioni su test di Fable 5.2/Opus 5.5. Dati quantitativi di Epoch AI — "i costi dell'AI diminuiscono di circa il 47% a trimestre" e "il livello di o3 su FrontierMath viene replicato a 1/377 del costo" (👍123, https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h ) — hanno una precisione non riscontrata sulle altre piattaforme e meritano attenzione. Tuttavia, poiché l'API di ricerca ufficiale ha restituito 403 e la raccolta ha dovuto basarsi sui singoli account, la copertura è necessariamente limitata.
Lemmy: al centro ci sono !technology, !LocalLLaMA e !ai_reddit (ripubblicazioni da Reddit). Oltre all'articolo sul forte calo della quota di mercato dei modelli chiusi, sono numerose le notizie tecniche dal fronte open-weight: conferma del rilascio di Qwen4-27B, llama.cpp v0.5.0 e il modello medico open-weight HuatuoGPT-3-27B. Continua anche la disputa definitoria sul fatto che K2 Horizons sia davvero il primo LLM open source (👍48/👎10, https://lemmy.world/post/52135351 ). Per arrivare a dieci elementi sono stati inclusi anche post di tre e cinque giorni prima.
What to watch
- Progetto Frontier AI Standards Agency (SAFA): un organismo volontario di standard di sicurezza promosso da OpenAI, Google e Anthropic. Su YouTube non sono ancora comparsi video dedicati: al momento sono in anticipo i media scritti, come AI Weekly (secondo la ricerca YouTube). Vale la pena osservare quando verrà trasformato in contenuto video.
- Indagine delle autorità di Pechino su DeepSeek/Kimi: sospetti relativi al passaggio di dati attraverso Anthropic (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). A seconda della risposta dei regolatori, potrebbe evolversi in una notizia geopolitica.
- Disputa sul "primo LLM open source" K2 Horizons: continua il confronto con precedenti quali GPT-Neo, OPT e BLOOM (Lemmy, https://lemmy.world/post/52135351 ). Da seguire come dibattito sulla definizione stessa di open-weight.
- Il dato Vercel sulla quota di mercato dei modelli chiusi dal 70% al 21,6%: compare soltanto in un articolo citato una sola volta (via Lemmy, https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/ ); serve una verifica sui dati primari di Vercel.
- Il nuovo laboratorio biologico di Anthropic: la scoperta con Claude di un sistema enzimatico simile a CRISPR (YouTube, https://www.youtube.com/watch?v=_m_216JykA0 ) merita di essere seguita come possibile esempio di AI alla guida della ricerca scientifica nel mondo reale.
- Rincaro di GPU locali e hardware dedicato: il malcontento per aumenti di prezzo di NVIDIA "Spark" e simili ha ottenuto il punteggio massimo su r/LocalLLaMA (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ). È direttamente collegato alla struttura dei costi per operare modelli open-weight.
Recommendations
- Nella prossima ricerca su Reddit, aggiungere nomi di modello concreti come "Opus 5.5", "GPT-6 Sol" e "GPT-6 Luna" alle query. La singola query "Daily LLM News" usata questa volta non ha intercettato la notizia più importante della settimana.
- Verificare su dati primari il dato Vercel "quota di mercato dei modelli chiusi dal 70% al 21,6%" prima di citarlo. Al momento si basa su un solo articolo di seconda mano.
- Seguire continuativamente l'evoluzione della Frontier AI Standards Agency (SAFA) sui media scritti — AI Weekly, The Information e altri — compensando la minore visibilità sui social.
- Poiché i risultati scientifici del laboratorio biologico di Anthropic possono estendersi oltre le notizie LLM, valutare un filone di monitoraggio dedicato nelle prossime edizioni.
- La ricerca su X tende a concentrarsi sulle dimostrazioni dei creatori giapponesi; aggiungere query che coprano fonti primarie anglofone, come annunci ufficiali e comunicati stampa.
- All'inizio della prossima raccolta, controllare se l'errore 403 dell'API di ricerca ufficiale di Bluesky è stato risolto. In tal caso si potrà tornare a una ricerca per parole chiave più completa rispetto alla raccolta per account.
Data quality
Reddit (12 elementi raccolti, criterio di completamento raggiunto) e Lemmy (12 elementi, alcuni integrati con temi di 3–5 giorni prima) hanno raggiunto il numero richiesto. X, invece, si è fermato a otto elementi perché quasi tutte le query erano estranee agli LLM, senza soddisfare il criterio di completamento. Bluesky non ha potuto usare l'API di ricerca ufficiale per via del 403 e ha dovuto ricorrere a una raccolta alternativa per account; non è stato trovato alcun post datato oggi (prevalgono post del 20–23 settembre). YouTube ha un numero sufficiente di video, ma i vincoli di rendering JavaScript hanno impedito di ottenere con precisione visualizzazioni e numero di iscritti, e le date restano stime basate sulle indicazioni relative. Nel complesso, solo Reddit e Lemmy soddisfano il criterio quantitativo di completamento; X, Bluesky e YouTube presentano limiti nella profondità dei dati dovuti ai rispettivi metodi di raccolta.
Riepilogo per piattaforma
Reddit — Daily LLM News
Dove
La query "Daily LLM News" ha raccolto in totale 12 thread da 11 subreddit.
| Subreddit | Membri | Thread raccolti |
|---|---|---|
| r/LocalLLaMA | 833,592 | 2 |
| r/PhD | 286,410 | 1 |
| r/NoStupidQuestions | 7,515,698 | 1 |
| r/QuebecTI | 16,177 | 1 |
| r/LocalLLM | 230,819 | 1 |
| r/singularity | 3,995,842 | 1 |
| r/BetterOffline | 56,810 | 1 |
| r/LSM | 1,097 | 1 |
| r/accelerate | 90,603 | 1 |
| r/slatestarcodex | 83,704 | 1 |
| r/ArtificialInteligence | 1,940,857 | 1 |
I principali luoghi delle notizie LLM sono r/LocalLLaMA (orientato all'esecuzione locale e all'hardware) e r/singularity (orientato alle notizie rapide sui nuovi modelli). r/PhD, r/BetterOffline e r/slatestarcodex ospitano invece discussioni collaterali su come gli LLM stiano influenzando società e mondo accademico. Il post di r/LSM (#8) è estraneo agli LLM ed è stato considerato rumore della query (vedi Limits).
Cosa dicono le persone
- Voci di una raffica di nuovi modelli: nel thread #5 di r/singularity, "Quite a few new model releases expected this week" (501pt, 153 commenti, 2026-09-21, https://www.reddit.com/r/singularity/comments/1wme7xj/ ), si parla di voci su Astra 6.1 in arrivo il 29 settembre e del rilascio già esistente di Grok 4.7. u/Immediate_Simple_217 (69pt) commenta: "Gemini 4 pro non uscirà questa settimana ma a ottobre. Tutte le voci e le ETA puntano a ottobre. È curioso che non si parli dei nuovi modelli di Kimi o Meta".
- Indagine delle autorità di Pechino su DeepSeek/Kimi: il thread #6 di r/LocalLLaMA, "DeepSeek and Moonshot AI face Beijing's probe over potential data leaks to Anthropic" (311pt, 92 commenti, 2026-09-23, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ), ha attirato molta attenzione. u/TraditionalWait9150 (115pt) riassume: "Pechino teme che, instradando i dati attraverso Anthropic, le due aziende AI possano aver fatto trapelare negli Stati Uniti informazioni riservate militari, di polizia e aziendali". u/mrdevlar (34pt) corregge invece il titolo: non si tratterebbe di una fuga di dati, ma del reindirizzamento di traffico verso Anthropic.
- Sconforto per il rincaro di GPU e hardware locali: il thread #10 di r/LocalLLaMA, "How it feels watching prices go up" (647pt, 110 commenti, 2026-09-21, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), ha ottenuto il punteggio più alto della giornata. u/swiebertjee (106pt) commenta: "Un mese fa ho comprato due Spark e mi hanno detto che ero pazzo; ora costano 600 dollari in più ciascuno. Il miglior investimento, ma la peggiore notizia".
- Resoconti di acquisto di macchine locali: il thread #4 di r/LocalLLM, "Finally got it" (188pt, 38 commenti, 2026-09-22, https://www.reddit.com/r/LocalLLM/comments/1wnmm8n/ ), ha acceso la consueta discussione sulla spirale degli acquisti hardware: u/Abducted_Llama (64pt) avverte che verrà voglia di una seconda macchina.
- Normalizzazione della scrittura con LLM nel mondo accademico: il thread #1 di r/PhD, "Seems academia is actually encouraging LLM usage in research papers" (493pt, 265 commenti, 2026-09-20, https://www.reddit.com/r/PhD/comments/1wlrhda/ ), nasce dal fatto che articoli di noti professori MIT e Stanford dichiaravano di essere stati scritti principalmente con ChatGPT 5.6. u/o12341 (89pt) osserva: "La cultura del publish or perish è il problema essenziale: se la scelta è pubblicare AI slop o sparire, molti sceglieranno la prima".
- La tesi MIT sui limiti dello scaling degli LLM, reazioni francofone: nel thread #3 di r/QuebecTI, "MIT Just Found a Hard Limit in LLM Scaling, and Money Won't Fix It" (54pt, 50 commenti, 2026-09-20, https://www.reddit.com/r/QuebecTI/comments/1wlr6vq/ ), u/zx440 (23pt) scrive che il contenuto sostiene l'intuizione secondo cui l'AI non è solo LLM: reasoning, agentic e deep thought sarebbero soltanto LLM che parlano in loop fra loro.
- La disputa sull'idea che gli LLM siano una moda: il thread #2 di r/NoStupidQuestions, "When is the LLM fad finally going to die out?" (0pt, 31 commenti, 2026-09-23, https://www.reddit.com/r/NoStupidQuestions/comments/1wo0heg/ ), paragona gli LLM al boom degli NFT. u/737Max-Impact (25pt) ribatte che il mercato azionario potrà correggersi, ma gli LLM e le tecnologie vicine non scompariranno perché sono troppo utili.
- Obiezioni al racconto del "Doom Loop": il thread #12 di r/ArtificialInteligence, "'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft" (127pt, 36 commenti, 2026-09-19, https://www.reddit.com/r/ArtificialInteligence/comments/1wkmo3u/ ), cita un articolo basato sul termine "theft" in documenti interni Microsoft. Il commento più votato, di u/KamikazeArchon (20pt), rileva però che l'articolo estrapola le citazioni ignorandone il contesto.
- Attese per un paper sugli LLM a parametri infiniti: nel thread #9 di r/accelerate, "Infinite-Parameter LLMs: Generating and Adapting Weights from Live Data" (205pt, 20 commenti, 2026-09-18, https://www.reddit.com/r/accelerate/comments/1wjgw2y/ ), u/armentho (65pt) si entusiasma: "Riscrivere i pesi in tempo reale? L'RSI, il miglioramento ricorsivo di sé, è finalmente arrivato!!". u/arjuna66671 (14pt) offre invece una spiegazione più sobria: nella pratica sarebbe più simile a un archivio; il modello non cambia durante la conversazione.
- Legami tra la scena LLM e la comunità EA/razionalista: nel thread #7 di r/BetterOffline, "Are people really this weirded out by the connection of the LLM scene to EA/rationalism?" (270pt, 117 commenti, 2026-09-19, https://www.reddit.com/r/BetterOffline/comments/1wkj0mh/ ), u/Icy-Recognition-7453 (106pt) commenta quanto l'EA permei Silicon Valley e afferma che alcune persone vivono lavoro, relazioni e matrimonio interamente dentro il "culto".
- Esperimento N=1 di affidare dati personali a un LLM: il thread #11 di r/slatestarcodex, "What it feels like to let an LLM read my journals, sleep, finances and analyze me for 15 minutes a week" (9pt, 14 commenti, 2026-09-24, https://www.reddit.com/r/slatestarcodex/comments/1wozi2w/ ), racconta un esperimento in cui l'autore fa leggere a Claude diario, sonno e finanze per ricevere un'autoanalisi settimanale. L'autore stesso scrive di essere preoccupato di non sapere come l'LLM cambierà la sua identità nel lungo periodo e se sia possibile un consenso realmente informato in anticipo.
Segnali
- In crescita: frustrazione e sorpresa per l'aumento dei prezzi di GPU locali e hardware dedicato, come NVIDIA "Spark" e 5090 (#10, #4), sono il tema con più punti nelle comunità LocalLLaMA della giornata. Spiccano commenti del tipo "meno male che l'ho comprato prima del rincaro".
- In crescita: i sospetti geopolitici riguardanti DeepSeek/Kimi, le autorità di Pechino e Anthropic (#6) hanno raccolto punteggi e discussioni insolitamente alti, andando oltre la semplice notizia tecnica verso un interesse di sicurezza nazionale: i dati potrebbero essere passati dalla Cina ad Anthropic.
- Tesi in via di rigetto: l'articolo secondo cui "Microsoft e OpenAI hanno ammesso che gli LLM sono un doom loop costruito sul furto" (#12) non riceve sostegno: il commento principale denuncia una manipolazione del contesto delle citazioni.
- Visioni contrapposte: persino sul tema dei limiti degli LLM, r/QuebecTI (#3, favorevole alla tesi dei limiti di scaling del MIT) e r/accelerate (#9, entusiasta del paper sui parametri infiniti e dell'RSI) hanno temperature opposte. Nella stessa settimana convivono l'idea che gli LLM siano arrivati al capolinea e quella che una nuova architettura apra un potenziale illimitato.
- Sorpresa: più dei temi tecnici sugli LLM, discussioni sociologiche sulle culture e idee a cui sono collegati — EA/razionalismo, accademia e impatto sull'identità (#1, #7, #11) — raccolgono punteggi alti e commenti lunghi, segnalando un interesse più radicato della reazione alle sole notizie di prodotto.
- Stanchezza del pubblico generale: il thread di r/NoStupidQuestions (#2) ha punteggio 0, ma alla domanda semplice se l'AI sia una moda passeggera come gli NFT rispondono molti commenti contrari basati sull'uso reale; anche tra gli utenti comuni emerge una divisione netta.
Limiti
- È stata usata una sola query, "Daily LLM News", e la raccolta si limita a un unico risultato di ricerca (12 thread, 11 subreddit). Il criterio del brief di leggere dieci elementi è soddisfatto, ma non è stata svolta una raccolta trasversale con più query.
- Il thread #8 (r/LSM, "Breaking News:", 75pt, 2026-09-19, https://www.reddit.com/r/LSM/comments/1wkiow2/ ) riguarda la partecipazione di Colin Moriarty a un tour di Ed Sheeran e non ha relazione con gli LLM. È stato giudicato rumore/risultato errato della query ed escluso dal conteggio sostanziale nelle sezioni "Cosa dicono le persone" e "Dove".
- Nei file della raccolta non risultano pagine non apribili né ricerche con zero risultati; tutti i 12 elementi dispongono di punteggio, data e link. Non ci sono quindi thread non apribili.
- L'intervallo di date va approssimativamente dal 2026-09-18 al 2026-09-24; non include discussioni più vecchie né reazioni successive, compresi contenuti del 25 settembre, la data del brief.
X
X — Daily LLM News(2026-09-25)
Account
Su X, a parlare effettivamente di LLM sono stati creatori individuali nei settori video e sviluppo di giochi. Ciascuno ha pubblicato uno o due post isolati; non ci sono grandi account con molti post consecutivi.
| Account | Nome | Post | Mi piace | Contenuto |
|---|---|---|---|---|
| @kevin_t_ngo | Kevin Ngo | 1 | 3,470(~235,000 visualizzazioni) | GIF animata per Blender generata con Claude Opus 5.5, ringraziamento a @claudeai |
| @KanaWorks_AI | KANA|東京AI映像 | 2 | 438 | Creazione di giochi 3D/ARPG con Opus 5.5×Godot e Opus 5.5×Unreal |
| @akiy_8 | AKI | 1 | 467 | Generazione con Opus 5.5 di un'animazione pixel art in un singolo HTML di 470 righe |
| @aicreataro | aicreataro | 1 | 444 | Fa controllare After Effects a Opus 5.5 per elaborare video |
| @shinshin86 | shinshin86|sviluppatore di AITuber OnAir | 1 | 308 | Fa controllare uno strumento per generare movimenti Live2D a Opus 5.5 |
| @ponzponz15 | ぽんず | 1 | 198 | Editing con videocamera 3D e testo tridimensionale usando Claude Opus / Codex + Hyperframes |
| @seiiiiiiiiiiru | Creatore video che usa SEIIIRUAI | 1 | 78 | Video pubblicitario AI con Opus 5.5 + Gemini 3.8 Flash TTS |
Il quadro non è quello di singoli account cresciuti enormemente grazie a un post, ma di creatori video AI giapponesi che stanno provando Opus 5.5 in modo simultaneo. Solo il post di @kevin_t_ngo ha una scala rilevante nel mondo anglofono (3,470 likes, ~235,000 visualizzazioni).
Post
-
@kevin_t_ngo(3,470 likes・165 repost・81 risposte・~235,000 visualizzazioni・2026-09-23)
https://x.com/kevin_t_ngo/status/2102761406315839798Grazie @claudeai! GIF animata in Python e renderizzata in Blender da Claude Opus 5.5
Trovato cercando "Claude". È il post con la maggiore crescita nel mondo anglofono fra quelli che menzionano Opus 5.5. -
@KanaWorks_AI(316 likes・38 repost・15 risposte・~16,000 visualizzazioni・2026-09-24)
https://x.com/KanaWorks_AI/status/2102955708321062975Sviluppo di giochi 3D con Claude Opus 5.5 × Godot. Creare un gioco in Godot sembra un po' più semplice che in Unity. È leggero da eseguire e il risultato è davvero ottimo.
Trovato cercando "Opus 5.5". -
@KanaWorks_AI(122 likes・14 repost・9 risposte・~6,700 visualizzazioni・2026-09-24)
https://x.com/KanaWorks_AI/status/2103138051165933661Claude Opus 5.5 × Unreal. Non avrei mai immaginato che sarebbe arrivato il giorno in cui avrei potuto creare un ARPG del genere da solo.
Trovato cercando "Claude". La stessa persona fa sviluppare giochi a Opus 5.5 sia con Godot sia con Unreal. -
@akiy_8(467 likes・43 repost・6 risposte・~21,000 visualizzazioni・2026-09-22)
https://x.com/akiy_8/status/2102545213218803769Ho provato a generare un'animazione pixel art con Opus 5.5 ・singolo HTML, 470 righe ・tutti gli sprite sono array di punti nel codice ・54 creature in sciame + circa 15 specie si muovono autonomamente con void e transizioni di stato ・palette da 30 colori, 320×180
Trovato cercando "Opus 5.5". È il post con i dettagli tecnici più concreti. -
@aicreataro(444 likes・66 repost・7 risposte・~45,000 visualizzazioni・2026-09-23)
https://x.com/aicreataro/status/2102656273112326609Un test in cui ho fatto controllare After Effects a Opus 5.5 per elaborare video AI. ■Base: un video di 15 secondi con MiniMax H3 ■Cose fatte in AE: ・regolare la velocità dei tagli sul ritmo ・un effetto per ogni sezione
Trovato cercando "Opus 5.5". È il post relativo a Opus 5.5 con più crescita nella raccolta (visualizzazioni ~45,000). -
@shinshin86(308 likes・36 repost・6 risposte・~31,000 visualizzazioni・2026-09-24)
https://x.com/shinshin86/status/2103037974242046335Opus 5.5 sembra avere capacità di generazione del movimento davvero elevate, quindi gli ho chiesto di creare anche movimenti Live2D ed è venuto bene...Claude Code (Opus
Trovato cercando "Claude". Descrive anche i passaggi concreti dell'integrazione: clonare uno strumento aggiuntivo per Live2D e farlo usare a Claude Code. -
@ponzponz15(198 likes・17 repost・7 risposte・~31,000 visualizzazioni・2026-09-24)
https://x.com/ponzponz15/status/2102931824918106499Videocamera 3D × testo tridimensionale, effetto ②. Ora anche Claude Opus e Codex rendono possibile il tipo di editing che si farebbe in After Effects. Sopra Seedance 2.5 prev, sotto Codex + Hyperframes skill #dreaminacpp
Trovato cercando "Claude". Menziona Claude Opus e Codex in un contesto di confronto e uso combinato. -
@seiiiiiiiiiiru(78 likes・13 repost・3 risposte・~3,300 visualizzazioni・2026-09-24)
https://x.com/seiiiiiiiiiiru/status/2103227982592831846Video pubblicitario AI → voce AI × editing AI. Possiamo dire che ormai siamo arrivati al traguardo, no? Ahah. Ho fatto generare la narrazione a Cluad Opus 5.5 con Gemini 3.8 Flash TTS e poi ho usato Claude per creare, in AE e con altri strumenti, il video sincronizzato a quella voce.
Trovato cercando "Opus 5.5". Un esempio di pipeline che combina Claude e Gemini.
Segnali
- Cosa sta crescendo: il tema LLM realmente discusso su X oggi non sono annunci di modelli o benchmark, ma dimostrazioni del tipo "far controllare strumenti a Claude Opus 5.5". Più creatori giapponesi indipendenti mostrano lo stesso schema: Opus 5.5 controlla strumenti di produzione video e giochi — After Effects, Blender, Godot, Unreal e Live2D — per produrre risultati concreti.
- Cosa viene trascurato: nella raccolta non è emerso nemmeno un caso degli argomenti originariamente richiesti dal brief, quali annunci di nuovi modelli, rilasci open-weight, cambiamenti di prezzo API, confronti di benchmark o movimenti aziendali. Le menzioni di "Claude" e "Opus 5.5" su X sono concentrate in resoconti pratici anziché in notizie.
- Cosa ha sorpreso: Explore di X, l'elenco dei trend, era riempito da argomenti estranei agli LLM: "$song", "Taylor", "Serbia", "Cardano", "Croats", "Croatia", "NFTs" e "Israel". Delle parole cercate a partire da Explore, solo "Opus 5.5" e "Claude" avevano una relazione reale con gli LLM. Nel complesso di X, le notizie LLM non rientravano affatto tra i trend principali.
Limiti
- La raccolta parte da Explore accessibile dall'host/server, e molti dei trend principali vi erano indicati come "Trending in Croatia". L'elenco di Explore di questa sessione rappresenta quindi una prospettiva croata e non può essere considerato un trend globale.
- Le dieci query effettivamente cercate erano "$song", "Opus 5.5", "Taylor", "Serbia", "Cardano", "Croats", "Croatia", "NFTs", "Claude" e "Israel" (le prime dieci voci di Explore usate così come apparivano). Solo "Opus 5.5" e "Claude" erano pertinenti al brief LLM; le altre otto restituivano soltanto risultati non correlati a notizie LLM.
- Fra 40 post raccolti, solo 8 potevano essere trattati come notizie LLM. Non avendo raggiunto il criterio di dieci elementi, questo file contiene solo gli otto trovati.
- Non è stato trovato alcun post su annunci di modelli, rilasci open-weight, modifiche API/prezzi, benchmark ufficiali o annunci aziendali ufficiali. Tutti gli argomenti LLM trovati su X sono dimostrazioni e impressioni di creatori individuali che hanno provato a far controllare qualcosa a Opus 5.5, non fonti primarie con valore di notizia come annunci o dati modificati.
- Le date dei post vanno dal 2026-09-22 al 2026-09-24. Sono stati considerati gli elementi mostrati da X al momento della raccolta; post correlati precedenti non sono stati esplorati.
YouTube
YouTube — Le notizie LLM più discusse di oggi(2026-09-25)
Canali
- Wes Roth(grande canale di approfondimento AI)— commento rapido sui risultati del laboratorio biologico di Anthropic
https://www.youtube.com/@WesRoth - The AI Daily Brief: Artificial Intelligence News(noto canale di notizie AI quotidiane)— approfondimento sul contesto dell'incidente di accesso non autorizzato di Gemini
https://www.youtube.com/@AIDailyBrief - Dr. Samuel Allen Alexander — spiegazione tecnica della scoperta del sistema enzimatico di Claude
https://www.youtube.com/@xamualexander - Web Oracle — panoramica del nuovo laboratorio biologico di Anthropic
https://www.youtube.com/@weboracle1095 - NEWS9 Live(canale di notizie)— copertura dell'incidente di accesso non autorizzato di Gemini
https://www.youtube.com/@NEWS9LIVE - Brock Mesarich | AI for Non Techies — spiegazione dell'annuncio di Claude Opus 5.5 per non tecnici
https://www.youtube.com/@BrockMesarich - United Top Tech — confronto tra benchmark e prezzi di Claude Opus 5.5
https://www.youtube.com/@unitedtoptech6288 - AI時短ラボ(canale giapponese)— spiegazione della revisione dei prezzi di GPT-6 Sol/Luna
https://www.youtube.com/@ai_jitan_lab - Pat Simmons — recensione pratica di Grok 4.7
https://www.youtube.com/@per_simmons - BitBiasedAI — spiegazione rapida dell'annuncio GPT-6 Sol/Luna
https://www.youtube.com/@BitBiasedAI - Dev Branch — commento all'annuncio di GPT-6 Astra del 3 settembre come "arrivo dell'era AGI"
https://www.youtube.com/@devbranchdev
Non è stato possibile verificare il numero di iscritti dai risultati di ricerca YouTube o dai metadati oEmbed (vedi ## Limits).
Video
-
Claude AI discovers novel enzyme system with CRISPR-like repeats
Dr. Samuel Allen Alexander/circa 19 ore fa(pubblicato intorno al 2026-09-24)
https://www.youtube.com/watch?v=_m_216JykA0
Spiegazione tecnica del sistema enzimatico simile a CRISPR (array-associated reverse transcriptases, ART) che Anthropic avrebbe scoperto usando Claude. -
Claude JUST found hidden DNA...
Wes Roth/circa 18 ore fa
https://www.youtube.com/watch?v=H7KruLVX2Rk
Un importante canale di approfondimento AI presenta la stessa scoperta, riferendo che Claude ha identificato autonomamente un sistema enzimatico sconosciuto nei batteriofagi. -
Anthropic Secretly Built a Biology Lab (Claude Is About to Touch the Real World)
Web Oracle/circa 5 giorni fa
https://www.youtube.com/watch?v=oFzs2b1VzQE
Presenta il quadro generale del nuovo laboratorio biologico in cui Claude dirige robot sperimentali. Colloca la scoperta simile a CRISPR come il "primo risultato" del laboratorio. -
Google AI Hacked Three Companies; Gemini Security Flaw Exposed; Rogue Test Explained
NEWS9 Live/3–6 giorni fa
https://www.youtube.com/watch?v=MOyQRVF7gXE
Copertura della divulgazione del 18 settembre secondo cui, durante una valutazione di cybersicurezza a maggio, Gemini avrebbe acceduto per errore ai sistemi di tre aziende reali non incluse nel test. -
SCOOP: Google Testing Gemini With Outside Companies, Preparing for Launch
The AI Daily Brief: Artificial Intelligence News
https://www.youtube.com/watch?v=zm_QiTlOUAo
Episodio di analisi che approfondisce il contesto dell'incidente, incluso il percorso con cui Google stava testando Gemini con aziende esterne. -
Anthropic Just Dropped Claude Opus 5.5 (CHEAPER & BETTER)
Brock Mesarich | AI for Non Techies
https://www.youtube.com/watch?v=fc7l-dut1GM
Presenta Claude Opus 5.5, annunciato il 22 settembre, come più economico, più veloce e migliore, riassumendone i punti per un pubblico non tecnico. -
Claude Opus 5.5 - Benchmark and Pricing | Beats Fable 5.1 and GPT-6 Astra?
United Top Tech
https://www.youtube.com/watch?v=AR1Gi3RHanE
Confronto di benchmark e prezzi di Opus 5.5 con Fable 5.1 e GPT-6 Astra. -
【速報】GPT6 Sol/Luna 登場 価格2分の1で性能大幅UP|Opus5.5発表当日にGPTも更新
AI時短ラボ
https://www.youtube.com/watch?v=fl42jHc7Ewc
Spiegazione in giapponese di come OpenAI abbia lanciato GPT-6 Sol/Luna appena 89 minuti dopo l'annuncio di Opus 5.5 e dimezzato i prezzi (Sol: $2/$10, Luna: $0.10/$0.50 per M token). -
GPT-6 Sol & Luna Just Dropped: Faster and 50% Cheaper
BitBiasedAI/circa 1 giorno fa
https://www.youtube.com/watch?v=m5wb-3gsmOo
Un canale anglofono commenta rapidamente la stessa notizia sui prezzi, sottolineando il dimezzamento del tasso di errore per la programmazione. -
Grok 4.7: No-Hype Full Review & Testing
Pat Simmons/circa 3 giorni fa
https://www.youtube.com/watch?v=x48xbDO6fKo
Recensione senza hype di Grok 4.7, con confronti di benchmark con Fable 5.1 e GPT-6 Astra. -
OpenAI Launches GPT-6 Astra — Welcome to the AGI Era
Dev Branch/circa 3 settimane fa(pubblicato il 2026-09-03, entro 60 giorni)
https://www.youtube.com/watch?v=TKhMnVAh_ZE
Episodio che definisce l'annuncio di GPT-6 Astra, uno dei maggiori temi di settembre, come l'arrivo dell'era AGI. Opus 5.5 e Sol/Luna di questa settimana vengono discussi come risposta o inseguimento di quel modello.
Segnali
- Il tema più discusso ora: il primo risultato del laboratorio biologico di Claude/Anthropic — la scoperta di un sistema enzimatico ART simile a CRISPR — è stato trattato contemporaneamente da più canali, come Dr. Samuel Allen Alexander e Wes Roth, appena 18–19 ore dopo la pubblicazione. Su YouTube è il tema che sta prendendo velocità più rapidamente oggi.
- La guerra dei ribassi tra modelli chiusi: il 22 settembre, appena 89 minuti dopo l'annuncio di Claude Opus 5.5 da parte di Anthropic, OpenAI ha annunciato GPT-6 Sol/Luna dimezzandone il prezzo. Più video citano questa competizione sui tempi degli annunci, spesso con tono da meme; il titolo del video di AI時短ラボ ne è rappresentativo.
- Sicurezza e governance: l'incidente di accesso non autorizzato di Gemini, divulgato il 18 settembre, e il progetto di un organismo volontario di standard di sicurezza promosso da Google, OpenAI e Anthropic — Frontier AI Standards Agency ≒ Standards Authority for Frontier AI — sono trattati rispettivamente da canali di notizie e grandi canali di approfondimento. Per il secondo, tuttavia, la ricerca YouTube non ha trovato video dedicati: al momento sembrano precedere i media scritti, come AI Weekly e The Information.
- Gli open-weight sono silenziosi oggi: non risultano, fra i post delle ultime 24 ore, video su nuovi rilasci di modelli open-weight Kimi, GLM o Llama. I temi recenti sono concentrati sulle schermaglie fra i tre attori closed OpenAI, Anthropic e Google.
Limiti
- La pagina dei risultati di ricerca YouTube (
youtube.com/results?search_query=...) usa rendering JavaScript e non è stato possibile acquisirla direttamente:WebFetchrestituiva soltanto il footer. La ricerca ha quindi combinatosite:youtube.comtramiteWebSearchcon l'API YouTube oEmbed, che consente di ottenere solo titolo e nome del canale. - Di conseguenza, non è stato possibile ottenere visualizzazioni, iscritti o commenti esatti. Le date sono stime basate sulle indicazioni relative nei frammenti dei risultati di ricerca, come "ore fa" o "giorni fa".
- Non sono stati trovati video YouTube dedicati al progetto "Frontier AI Standards Agency (Standards Authority for Frontier AI, SAFA)". Al momento sembrano in vantaggio i siti di notizie e le spiegazioni video non sono ancora comparse su YouTube.
- Reddit, X, Bluesky, Lemmy e le altre piattaforme non sono state esaminate in questa fase.
Bluesky
Bluesky — Notizie LLM di oggi(2026-09-25)
Account
- TestingCatalog (@testingcatalog.com) — account che intercetta più rapidamente leak, nuove funzioni e nuovi modelli di prodotti AI. Circa metà dei post qui elencati proviene da questo account.
- Simon Willison (@simonwillison.net) — noto blogger e professionista degli LLM. Sono ricorrenti i suoi confronti dei nuovi modelli tramite benchmark di disegno di pellicani.
- Epoch AI (@epochai.bsky.social) — istituto di ricerca che analizza quantitativamente costi di addestramento AI e trend del compute.
- Nathan Lambert (@natolambert.bsky.social) — membro di Ai2 e autore di interconnects.ai; particolarmente attento al rapporto fra open-weight e modelli chiusi.
- antirez / Salvatore Sanfilippo (@antirez.bsky.social) — autore di Redis. Pubblica verifiche continue del proprio strumento di inferenza veloce "DwarfStar" con modelli open-weight su Mac/DGX Spark.
- ModelVantage (@modelvantage.bsky.social) — bot che monitora automaticamente latenza e interruzioni delle API Gemini/Claude e segnala rapidamente gli eventi.
- Leaderboard LLM per sviluppatori (@devllmlb-ja.bsky.social) — account giapponese che riepiloga mensilmente i benchmark, ma con ultimo post del 2026-09-01, quindi relativamente datato.
Post
-
OpenAI anticipa il lancio odierno di GPT-6 Sol / Luna — "OpenAI prepares to launch GPT-6 Sol and Luna models today"
TestingCatalog, 2026-09-22, 👍1 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w -
Leak: Google starebbe testando nuovi checkpoint di Gemini 4 Pro — "Google tests new Gemini 4 Pro checkpoints, early outputs"
TestingCatalog, 2026-09-23, 👍2
https://bsky.app/profile/testingcatalog.com/post/3mw6b5f3opi2j -
Xiaomi rende open source il modello omnimodale MiMo-V2.6 Pro/Flash(supporta coding, visione e controllo del computer)
TestingCatalog, 2026-09-21, 👍2 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mw2tpiskxh2w -
SpaceXAI rilascia Grok 4.7 per programmazione e lavoro della conoscenza
TestingCatalog, 2026-09-21
https://bsky.app/profile/testingcatalog.com/post/3mw2rdziawn2s -
Anthropic starebbe testando Fable 5.2 e Opus 5.5 prima del rilascio
TestingCatalog, 2026-09-21, 👍1
https://bsky.app/profile/testingcatalog.com/post/3mvzd4w227422 -
Simon Willison confronta insieme Claude Opus 5.5, GPT-6 Sol e GPT-6 Luna — "Big model release today - I wrote about Claude Opus 5.5, GPT-6 Sol, and GPT-6 Luna - plus comparison grids of pelicans by the different model families at different reasoning levels"
2026-09-22, 👍123 🔁10
https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n -
Simon Willison verifica i prezzi estremamente bassi dei modelli Gemini 3.8 TTS — "The new Gemini 3.8 TTS models are super-cheap and can generate conversations between multiple voices..."; stima inferiore a un centesimo al minuto
2026-09-23, 👍77 🔁7
https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i -
Epoch AI: "I costi dell'AI diminuiscono di circa il 47% a trimestre, più rapidamente di qualsiasi altra innovazione tecnologica"
2026-09-22, 👍123 🔁30
https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h -
Epoch AI: GPT-5.6 Luna replica su FrontierMath il livello di o3 a 1/377 del costo($0.55→$0.0015, 1/377 in 18 mesi)
2026-09-22, 👍12
https://bsky.app/profile/epochai.bsky.social/post/3mw567lpe7s2l -
Nathan Lambert presenta allo staff del Congresso lo stato dei modelli open e la loro competitività rispetto alla Cina(link a un briefing di interconnects.ai)
2026-09-21, 👍31 🔁6
https://bsky.app/profile/natolambert.bsky.social/post/3mvzo2lneqg2j -
Lo stesso autore segnala che i principali laboratori AI cinesi iniziano a usare Huawei per l'inferenza e Nvidia per l'addestramento, evidenziando una biforcazione della strategia hardware
2026-09-20, 👍18
https://bsky.app/profile/natolambert.bsky.social/post/3mvxajmx5cz2n -
antirez supporta Qwen3.8 Flash Next con il proprio strumento di inferenza locale "DwarfStar"(50–70 t/s su Mac da 64GB, prefill oltre 1400 t/s)
2026-09-14, 👍76 🔁8
https://bsky.app/profile/antirez.bsky.social/post/3mvi75e3c722o
Segnali
- La raffica di nuovi modelli closed è il tema centrale della settimana: GPT-6 Sol/Luna, Claude Opus 5.5/Fable 5.2 e leak/test di Gemini 4 Pro si concentrano nella stessa settimana. La rapidità tipica di Bluesky emerge dal fatto che professionisti come Simon Willison pubblicano immediatamente confronti affiancati, qui tramite benchmark di disegno di pellicani.
- Il "crollo dei costi di reasoning" viene discusso con dati quantitativi: le cifre Epoch AI — calo del 47% a trimestre e costo ridotto di 377 volte su FrontierMath — si diffondono con citazioni più rigorose che su altre piattaforme (👍123 e 🔁30 sono la reazione maggiore dell'intera ricerca).
- Il fronte open-weight ruota attorno all'esecuzione locale: antirez continua a testare Qwen3.8 Flash Next e DeepSeek v4.1 Flash su Mac personali/DGX Spark, mentre viene rapidamente segnalato anche l'open source di MiMo-V2.6 di Xiaomi. Il post Xiaomi di TestingCatalog (👍2) ha una risposta ridotta rispetto al post di Simon Willison (👍123): su Bluesky i nuovi rilasci closed tendono a generare più conversazione.
- Nathan Lambert propone una cornice geopolitica per il confronto closed/open: l'osservazione che la Cina usi Huawei per l'inferenza e Nvidia per l'addestramento offre un taglio diverso dalle discussioni incentrate su benchmark tecnici delle altre piattaforme.
- Esistono bot di monitoraggio API come ModelVantage, ma gli eventi recenti — interruzioni Gemini 3.1 Pro del 14–15 settembre e tasso di errore al 100% per alcuni minuti in US-East — non sono temi di oggi e hanno ricevuto zero mi piace.
Limiti
- L'API di ricerca ufficiale (
app.bsky.feed.searchPosts) ha restituito costantemente 403 Forbidden nell'ambiente di questa ricerca, impedendo la ricerca diretta per parole chiave (sia accesso diretto sia tramite due proxy CORS). Altri endpoint API, comegetProfile,getAuthorFeedegetPostThread, funzionavano normalmente; è quindi probabile che sia bloccato soltanto l'endpoint di ricerca. - Per questo vincolo, la raccolta ha usato il metodo alternativo "identificare account presumibilmente rilevanti → leggere i loro post", anziché una ricerca trasversale per keyword. Post di account individuali o piccoli non nominati qui potrebbero quindi essere sfuggiti.
- Le pagine di ricerca e dei post di
bsky.appsono SPA con rendering lato client eWebFetchnon ne ha potuto ottenere il testo, restituendo soltanto il titolo "Bluesky". Tutti i link sono post verificati via API, ma non sono stati controllati visivamente nel browser. - Bot automatici come
ai-news-jp.bsky.socialhanno l'ultimo post fermo a luglio 2025 e non potevano essere usati per i temi di oggi; sono stati esclusi dalla sezione Account. - Non sono stati trovati contenuti pubblicati proprio il 2026-09-25. I post qui riportati sono principalmente del 20–23 settembre, ma comprendono i temi ancora centrali — GPT-6 Sol/Luna, Opus 5.5 e Gemini 4 Pro. Non è stato possibile raggiungere dieci elementi costituiti esclusivamente da post del giorno.
- Gli account giapponesi, incluso
devllmlb-ja.bsky.social, non hanno pubblicato questa settimana; l'impressione è che la discussione LLM giapponese su Bluesky sia meno intensa rispetto agli account anglofoni.
Lemmy
Lemmy — Il tema più discusso di oggi: il crollo della quota dei modelli chiusi e l'interesse per Opus 5.5/modelli locali
Comunità
- !«メールアドレス» — 88,221 persone. Community tech generalista in cui confluiscono notizie sugli LLM; principale fonte di post relativi a Gemini.
- !«メールアドレス»(con mirror anche su sh.itjust.works, ID 330)— 5,172 persone. Post tecnici soprattutto su nuovi rilasci open-weight, benchmark e llama.cpp.
- !ai_reddit — community che ripubblica post da r/ClaudeCode e r/ArtificialInteligence (impossibile ottenere il numero di iscritti su lemmy.world: 404/500 durante la verifica diretta; vedi Limits). Vi si concentrano i thread su Opus 5.5.
- !hackernews — mirror di articoli popolari su Hacker News. Emergono applicazioni degli LLM, come ricerca storica e deanonymizzazione.
- !«メールアドレス» — community di sviluppo di Lemmy. Si discute di regole per dichiarare l'uso di AI/LLM.
- !selfhosted — comunità self-hosted. Qui è vivace la disputa sulla definizione di LLM open source, legata a K2 Horizons.
- !blueteamsec / !lobsters — ripubblicazioni di ricerca relativa agli LLM con taglio sicurezza e tecnico.
Post
-
Closed Models Fell From 70% to 21.6% Market Share in 3 Months — !tecnologia, punteggio 1, 2026-09-24 05:00
https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/
Articolo che, sulla base di dati Vercel, riferisce un crollo della quota di utilizzo dei modelli chiusi dal 70% al 21,6% in appena tre mesi. Un caso emblematico del confronto odierno fra closed e open-weight. -
New Opus is absolutely bonkers — !ai_reddit(originariamente r/ClaudeCode), punteggio 0, 2026-09-24 20:01
https://www.reddit.com/r/ClaudeCode/comments/1wp1q8n/new_opus_is_absolutely_bonkers/
Thread che descrive il nuovo Opus di Anthropic come incredibile. -
Is Opus 5.5 really better than Fable in your experience? — !ai_reddit(originariamente r/ClaudeCode), punteggio 0, 2026-09-24 02:50
https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/is_opus_55_really_better_than_fable_in_your/
Discussione che confronta, sulla base dell'esperienza pratica, Opus 5.5 e Fable oltre la supremazia nei benchmark. -
I A/B tested Opus 5 vs Opus 5.5 for AI slop: 98 em dashes vs 0 — !ai_reddit(originariamente r/ClaudeCode), punteggio 1, 2026-09-23 07:45
https://www.reddit.com/r/ClaudeCode/comments/1wnwqcs/i_ab_tested_opus_5_vs_opus_55_for_ai_slop_98_em/
Test A/B della qualità dell'output fra Opus 5 e Opus 5.5, che riferisce una forte riduzione dell'aspetto "da AI", incluso l'abuso dei trattini lunghi. -
llama.cpp v0.5.0 — !LocalLLaMA, punteggio 23・commenti 0, 2026-09-24 16:18
https://github.com/ggml-org/llama.cpp/releases/tag/v0.5.0
Rilasciata una nuova versione con supporto a più architetture recenti, tra cui Qwen4Exp. -
New medical model: FreedomIntelligence/HuatuoGPT-3-27B — !LocalLLaMA, punteggio 7・commenti 1, 2026-09-24 16:52
https://huggingface.co/FreedomIntelligence/HuatuoGPT-3-27B
Modello medico open-weight basato su Qwen3.8-27B, costruito mediante One-stage Policy Optimization senza fine-tuning supervisionato. -
Qwen4-27B just confirmed — !LocalLLaMA, punteggio 34・commenti 5, 2026-09-22 22:45
https://lemmy.ml/post/53074988
Thread che riporta la conferma ufficiale del rilascio di Qwen4-27B; pur essendo trascorsi tre giorni dall'annuncio, resta uno dei principali temi open-weight della settimana. -
Google introduce "Call for Me" sui Pixel 11 per affidare le telefonate a Gemini — !tecnologia, punteggio 1, 2026-09-24 18:17
https://www.theverge.com/ai-artificial-intelligence/1000116/google-gemini-business-phone-calls
Google annuncia "Call for Me", nuova funzione con cui Gemini gestisce chiamate telefoniche su Pixel 11. -
Google invented the Transformer, so why does using Gemini still feel like a chore? — !ai_reddit(originariamente r/ArtificialInteligence), punteggio 1, 2026-09-24 08:35
https://www.reddit.com/r/ArtificialInteligence/comments/1wovzal/google_invented_the_transformer_so_why_does_using/
Post critico che chiede perché Google, pur avendo inventato il Transformer, continui a essere superata da concorrenti open-weight più agili come DeepSeek e Qwen. -
Using LLMs to trace alchemical knowledge and decode 17th century letters — !hackernews, punteggio 7, 2026-09-24 20:00
https://lemmy.bestiver.se/post/1359598
Esempio di ricerca storica che usa GPT-6 e Opus 5.5 per decifrare corrispondenza alchemica del XVII secolo. -
Large-scale online deanonymization with LLMs — !blueteamsec, punteggio 6, 2026-09-24 19:23
https://infosec.pub/post/52730942
Ricerca secondo cui gli LLM possono reidentificare con alta precisione utenti Hacker News e partecipanti ad Anthropic Interviewer, fino al 68% di richiamo con accuratezza del 90%; un caso rilevante per incidenti e rischi LLM. -
Is K2 Horizons historically significant as the first actual open-source LLM, or am I falling for hype? — !Selfhosted, punteggio 48(favorevoli)/10(contrari)・20 commenti, 5 giorni fa(circa 2026-09-20)
https://lemmy.zip/post/... (ripubblicazione lemmy.world: https://lemmy.world/post/52135351)
Discussione sul fatto che K2 Horizons possa davvero essere definito il primo LLM autenticamente open source. Numerose risposte citano GPT-Neo, OPT e BLOOM come precedenti e segnalano che i dati di addestramento non sono pubblici.
Segnali
- Chiusi contro open-weight: il caso più emblematico è l'articolo secondo cui la quota di mercato dei modelli chiusi sarebbe precipitata dal 70% al 21,6% in tre mesi (post 2). Il clima generale di Lemmy è fortemente favorevole agli open-weight: si notano post che elogiano l'avanzata di DeepSeek/Qwen e deridono la lentezza di Google (post 9), oltre agli annunci di Qwen4-27B e HuatuoGPT-3-27B (post 6, 7).
- Anthropic Opus 5.5: in !ai_reddit, ripubblicazioni da r/ClaudeCode, procedono simultaneamente più thread relativi a Opus 5.5 (post 2, 3, 4). Si discute sia della qualità, compresa la riduzione dei trattini lunghi, sia delle prestazioni nei benchmark.
- Incidenti e rischi LLM: fra i cluster Lobsters/blueteamsec compaiono anche post tecnici su sicurezza e prevenzione dell'abuso, come la ricerca sulla deanonymizzazione (post 11) e tecnologie di watermarking in vLLM.
- Sviluppi pratici: una parte dei post riguarda integrazione nei prodotti anziché i modelli stessi, come "Call for Me" di Google Gemini, che gestisce telefonate su Pixel 11 (post 8).
Limiti
- Lemmy ha comunità di piccole dimensioni e i thread LLM certamente nuovi della sola giornata non raggiungevano dieci elementi. Per arrivare a 12 sono stati inclusi il dibattito su K2 Horizons di cinque giorni prima (post 12) e quello su Qwen4-27B di tre giorni prima (post 7), come temi ancora citati nel corso della settimana.
- Non è stato possibile ottenere il numero di iscritti della community
!ai_reddit(lemmy.world/api/v3/community?name=ai_redditrestituiva 404 elemmy.world/c/ai_redditun errore 500). L'istanza di origine potrebbe essere diversa, ma non è stata identificata. - I post originali su reddit.com (
www.reddit.com/r/ClaudeCode/...) erano bloccati al recupero diretto con WebFetch. I riassunti si basano quindi su titolo, punteggio e data del mirror Lemmy, senza poter verificare nel dettaglio il testo dei thread originali. - Le interfacce di ricerca di altre istanze, come lemmy.ml e lemm.ee, sono state sostituite con ricerca API su lemmy.world e recuperi API di singole istanze, come sh.itjust.works; non è stata condotta una ricerca trasversale completa di tutte le istanze.
Azioni consigliate
- Nella prossima ricerca su Reddit, aggiungere alle query nomi specifici come "Opus 5.5", "GPT-6 Sol" e "GPT-6 Luna".
- Verificare il dato Vercel sulla quota dei modelli chiusi dal 70% al 21,6% attraverso fonti primarie prima di citarlo.
- Seguire costantemente la Frontier AI Standards Agency (SAFA) sui media scritti, compensando il ritardo di visibilità sui social.
- Valutare un filone di monitoraggio dedicato per i risultati scientifici del laboratorio biologico di Anthropic nelle prossime edizioni.
- Aggiungere query che coprano fonti primarie anglofone, per evitare che la ricerca su X si concentri troppo sulle dimostrazioni dei creatori giapponesi.
- All'avvio della prossima ricerca, controllare se l'errore 403 dell'API di ricerca ufficiale Bluesky è stato risolto.
Nota sulla qualità dei dati
Reddit e Lemmy hanno raggiunto il criterio di completamento di dieci elementi. X si è fermato a otto perché la maggior parte delle query era irrilevante; Bluesky ha dovuto ricorrere alla raccolta alternativa per account a causa dell'errore 403 dell'API di ricerca e non ha ottenuto post del giorno; YouTube non ha potuto fornire visualizzazioni e iscritti esatti per i vincoli di rendering.



