Notizie sull'IA per la generazione di immagini e video — 2026-09-08
I modelli closed-source hanno alimentato su Reddit, X e Bluesky un nuovo filone: agenti LLM come GPT-6 Astra che controllano strumenti GUI e Blender per creare immagini e contenuti 3D. L'open source è emerso soprattutto nella comunità ComfyUI di Lemmy e nei canali YouTube di benchmark.
Il fronte closed-source ha visto emergere indipendentemente su Reddit, X e Bluesky un nuovo filone — «non modelli di diffusione, ma agenti LLM (GPT-6 Astra) che controllano strumenti GUI e Blender per creare immagini e video 3D» — mentre le attività open source si sono concentrate nella comunità ComfyUI di Lemmy e nei canali YouTube di verifica, con osservazioni quasi assenti su Bluesky, Pinterest, Reddit e X.
Notizie sull'IA per la generazione di immagini e video — 2026-09-08
L'aspetto più rilevante di questa indagine su sei piattaforme è stato che, sul fronte closed-source, un nuovo filone — «non modelli di diffusione, ma agenti LLM (GPT-6 Astra) che controllano direttamente strumenti GUI e Blender per creare immagini e video 3D» — è diventato argomento di discussione indipendentemente su tre piattaforme. L'open source era complessivamente meno visibile, ma a livello di comunità di sviluppatori restava attivo: nella comunità Lemmy !stable_diffusion sono stati rilasciati in successione, nella stessa settimana, cinque o sei nodi ComfyUI per accelerare i modelli video MiniMax H3; su YouTube continuano inoltre le verifiche sulla competizione per la leadership tra Flux.2/Flux 2 Klein e Qwen-Image. Pinterest e la maggior parte dei post su Reddit e X erano invece concentrati su nomi di prodotti closed-source (Midjourney, Sora, Veo, Runway, Kling, Nano Banana, Seedream ecc.), con nomi propri open source quasi del tutto assenti. Un altro tratto comune è che, più delle tendenze tecniche stesse, su Reddit e Pinterest spiccavano dibattiti sull'autenticità — se qualcosa fosse davvero IA — e sull'impatto sociale degli agenti IA che sostituiscono ruoli e attività umane.
Tra le piattaforme
- La generazione visiva agentica di GPT-6 Astra è diventata argomento indipendente su tre piattaforme: il caso di Astra che controlla Blender per creare un rendering è stato trattato separatamente sia su Reddit (r/DefendingAIArt) sia su Bluesky (@simonwillison.net); una demo che crea una città 3D con Astra ha innescato una catena di imitazioni su X (@synabreu, @GulatiYajat). Il principale tema trasversale dell'indagine non è stata «l'evoluzione dei modelli di diffusione», bensì l'idea nuova di «agenti LLM che prendono il controllo di strumenti esistenti per creare immagini e contenuti 3D».
- Resta condivisa, ma divisa, la valutazione che la coerenza di personaggi e scene nella generazione video sia ancora irrisolta: sia su Reddit (r/generativeAI, r/aivideomaking) sia su X (@atlas_remake, che elogia Seedance 2.5, e @Aiden_Tech_Ai, che ne evidenzia i fallimenti nelle scene complesse) sono comparsi nello stesso periodo pareri opposti sul medesimo tema.
- La presenza dell'open source è fortemente sbilanciata a seconda della piattaforma:
!stable_diffusionsu Lemmy è tanto attiva da vedere rilasci simultanei di nodi ComfyUI per MiniMax H3 (ComfyUI-Ref2VA-VSA e altri), e su YouTube continuano i video comparativi su Qwen-Image, FLUX e Wan 2.2. Al contrario, su Bluesky, Pinterest, Reddit e X si sono trovati pochissimi post che citano specifici modelli open source, come nuove versioni di Stable Diffusion, FLUX, Wan o HunyuanVideo. Molte sezioni Limits delle piattaforme rilevano la medesima debolezza strutturale: non è chiaro se «l'open source non sia oggetto di discussione» oppure se sia stato perso perché le query erano sbilanciate verso il closed source. - Dibattiti sull'autenticità e impatto sociale procedono accanto alle tendenze tecniche: post la cui natura reale o generata divide gli utenti (Reddit r/isthisAI, il video di Thor su r/pj_explained contro r/NewRockstars), aimod.social su Bluesky che etichetta automaticamente le immagini IA, il video falso relativo all'elezione del governatore di New York (Bluesky/404media), e miniature Pinterest con timbri «FAKE»: su più piattaforme sono emersi indipendentemente temi orientati più al «riconoscere e dubitare» che al «creare».
Piattaforma per piattaforma
Reddit ha mostrato, tra 12 thread, maggiore engagement nei subreddit dedicati ai dibattiti pro e contro l'IA e alla verifica dell'autenticità (r/antiai, r/aiwars, r/DefendingAIArt, r/isthisAI, r/pj_explained, r/NewRockstars) rispetto a quelli specializzati in IA per immagini e video (r/generativeAI, r/aivideomaking, r/GoogleFlow, r/freetoolsAI). A causa della query unica, non è stato praticamente possibile confrontare closed source e open source.
X si è concentrato sull'annuncio di Sol-H3 di NVIDIA — inferenza video più rapida della riproduzione in tempo reale — e sulla sua riproduzione locale da parte di singoli utenti, oltre che sulla catena di imitazioni nella generazione di città 3D con GPT-6 Astra. Dei 40 elementi raccolti, solo una parte era direttamente collegata all'IA per immagini e video; le tendenze locali, attorno alla Croazia nell'Explore, hanno introdotto molti post fuori tema.
YouTube non ha consentito di recuperare visualizzazioni e iscritti a causa del rendering JavaScript delle pagine, ma ha confermato canali comparativi e divulgativi dedicati sia al closed source (Midjourney V8.2, Grok Imagine, Google Gemini «Omni») sia all'open source (Qwen-Image-2.0, FLUX, Wan 2.2). Tra le sei piattaforme è stata la fonte più adatta a confrontare closed e open source.
Bluesky ha costretto a passare alla verifica individuale dei feed di account noti, come @simonwillison.net e @404media.co, poiché l'API di ricerca (app.bsky.feed.searchPosts) ha restituito costantemente 403. Non è quindi stata raggiunta la soglia di completamento di «20 elementi analizzati». L'unico post concreto sull'open source era una segnalazione dell'esecuzione locale di Qwen 3.7 27B.
Lemmy ha visto il maggior fermento singolo nella controversia sul presunto cambio di rotta di Midjourney verso gli scanner ecografici medici (!techtakes); dal lato open source, i rilasci simultanei di nodi ComfyUI per MiniMax H3 e la competizione di benchmark su Qwen-Image-Bench (LLaDA-Image, Boogu-Image-0.1) hanno reso questa l'unica delle sei piattaforme con una solida quantità di informazioni primarie sull'open source.
Pinterest ha consentito di verificare 30 dei 50 pin pre-raccolti, ma la query unica, senza classificazione per genere, ha prodotto soprattutto infografiche di confronto e how-to su prodotti closed-source. Non è stato trovato nemmeno un nome di modello o progetto open source. Inoltre, il manifest non includeva data di pubblicazione né dati di engagement, impedendo di valutarne la freschezza.
Da tenere d'occhio
- Inferenza video più veloce del tempo reale con MiniMax H3 / Sol-H3 e proliferazione di nodi ComfyUI di ottimizzazione — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA e altri). Resta da vedere fino a che punto le riproduzioni open-weight raggiungeranno gli annunci cloud.
- Espansione della generazione visiva agentica di GPT-6 Astra — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu). Da seguire l'ampiezza futura della catena di imitazioni.
- Competizione per la leadership open source tra FLUX.2/Flux 2 Klein e Qwen-Image — YouTube (SECourses, Urban Decoders). Occorre valutare come i risultati di oltre 700 test influenzeranno le future adozioni.
- Seguiti della controversia sul cambio di rotta di Midjourney verso i dispositivi medici (Midjourney Medical) — Lemmy (via pivot-to-ai.com). Resta da capire se il pivot di un'azienda di generazione immagini sia uno scherzo o verrà effettivamente implementato.
- Conseguenze dell'abuso di video IA nella pubblicità politica, nell'elezione del governatore di New York — Bluesky (404media.co). Da osservare se seguiranno interventi regolatori o delle piattaforme.
- Stato della soluzione al problema della coerenza di personaggi e scene nella generazione video — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai). Resta da verificare se gli strumenti all-in-one stiano davvero avvicinandosi a una soluzione.
Raccomandazioni
- Continuare a monitorare nelle prossime edizioni la generazione visiva agentica di GPT-6 Astra — controllo di Blender e generazione di città 3D — come tema dedicato.
- Per non perdere gli annunci open source, aggiungere nella prossima raccolta query trasversali alle piattaforme con nomi propri quali "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" e "ComfyUI".
- Poiché è probabile che l'API di ricerca Bluesky continui a restituire 403, ampliare in anticipo la lista degli account da monitorare.
- Poiché Pinterest non fornisce data di pubblicazione né engagement, limitarlo al monitoraggio continuativo della notorietà degli strumenti e non usarlo per confronti di notizie rapide che richiedono freschezza.
- Poiché la controversia sul cambio di rotta di Midjourney verso i dispositivi medici non è ancora verificata nei fatti, evitare citazioni assertive finché non verrà pubblicata una fonte primaria, come un annuncio ufficiale di Midjourney.
- Dare priorità a
!stable_diffusionsu Lemmy e ai canali YouTube di verifica come fonti principali per seguire le tendenze open source.
Qualità dei dati
Bluesky — con l'API di ricerca costantemente in 403, controlli limitati ai singoli account e mancato raggiungimento della soglia di 20 elementi — e Pinterest — senza data di pubblicazione né engagement nel manifest, quindi con freschezza sconosciuta e nessun riferimento open source in una query unica — sono stati i più poveri di informazioni. Reddit e X sono rimasti su un'unica query, il titolo stesso del brief, e non hanno quindi raccolto intenzionalmente post che confrontassero chiaramente closed e open source. Di conseguenza, gli argomenti open source si sono concentrati su Lemmy e YouTube. YouTube non ha consentito di acquisire visualizzazioni e iscritti a causa delle limitazioni del rendering JavaScript.
Riepilogo per piattaforma
Reddit — Notizie sull'IA per la generazione di immagini e video
Principali sedi di discussione (subreddit)
I 12 thread raccolti provengono tutti da subreddit diversi, uno per ciascuno. Le comunità specializzate in IA per immagini e video sono poche; spiccano invece i subreddit di verifica relativi a cinema e falsi, oppure quelli dedicati ai dibattiti sulla cultura dell'IA.
| Subreddit | Membri | Thread raccolti |
|---|---|---|
| r/whenthe | 813,975 | 1 |
| r/isthisAI | 406,607 | 1 |
| r/antiai | 317,903 | 1 |
| r/aiwars | 167,158 | 1 |
| r/generativeAI | 151,385 | 1 |
| r/RemoteWorkers | 75,332 | 1 |
| r/DefendingAIArt | 72,770 | 1 |
| r/pj_explained | 96,256 | 1 |
| r/NewRockstars | 15,523 | 1 |
| r/freetoolsAI | 7,887 | 1 |
| r/aivideomaking | 6,517 | 1 |
| r/GoogleFlow | 1,789 | 1 |
La query era soltanto "Image and Video Generation AI News". I risultati erano sbilanciati verso subreddit di dibattito sull'IA (r/antiai, r/aiwars, r/DefendingAIArt) e di verifica «è IA?» (r/isthisAI, r/pj_explained, r/NewRockstars, r/whenthe), più che verso quelli specializzati in IA per immagini e video (r/generativeAI, r/aivideomaking, r/GoogleFlow, r/freetoolsAI).
Reazioni degli utenti
- GPT-6 disegna illustrazioni "a mano" usando il mouse, rendendo possibile anche falsificare timelapse (thread 2, r/antiai, 7,013 pt e 1,009 commenti, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). Un post sostiene che, invece di usare un modello di diffusione, un LLM (GPT-6) possa ricevere controllo di mouse e tastiera, disegnare in un software di pittura digitale e persino generare un timelapse apparentemente autentico. Il commento più votato, di u/Nayutantantan (2,507 pt), esprime sconforto: «non ho più nemmeno la motivazione di registrare timelapse come prova».
- GPT-6 "Astra" crea rendering fotorealistici in Blender (thread 9, r/DefendingAIArt, 143 pt e 13 commenti, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/). L'elemento discusso è che l'IA non abbia generato direttamente il video, ma abbia operato Blender come agente IA per creare il rendering. u/TheMaliciousSquid commenta: «GPT-6 sembra destinato a diventare il migliore per i contenuti visivi; mi chiedo se supererà Claude nella programmazione».
- L'estensione "AutoFlow" per Google Flow aggiunge la generazione video continua (thread 12, r/GoogleFlow, 12 pt e 6 commenti, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/). Aggiunge la funzione "Continue from Last Frame", che trasferisce automaticamente l'ultimo frame di una clip al primo della successiva; consente anche la gestione delle code di generazione e delle immagini di riferimento. È stata anticipata una futura funzione per unire le clip senza soluzione di continuità.
- Grande domanda per un post promozionale su uno "strumento gratuito di generazione immagini IA" (thread 3, r/freetoolsAI, 39 pt e 48 commenti, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). I commenti si concentrano su un servizio dichiarato gratuito, illimitato e senza registrazione. u/Puzzleheaded_Lab4757 afferma positivamente che gli ha fatto risparmiare centinaia di dollari e molte ore, mentre u/thecragmire chiede come possano sostenerne i costi operativi.
- Nei video IA, durata e coerenza dei personaggi restano l'ostacolo principale (thread 10, r/generativeAI, 4 pt e 15 commenti, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/). A un utente che desidera creare un video cinematografico sci-fi di 2–4 minuti, u/Missy_Desu risponde che la soluzione realistica è creare frame con GPT Image 2 e convertirli in video con Seedance 2.5, avvertendo di mettere in conto circa 100 dollari per minuto finito. u/KissinglyPolished osserva che il passaggio dall'immagine fissa al video rende estremamente difficile mantenere la coerenza dei personaggi e che gli strumenti all-in-one non l'hanno ancora risolto.
- La generazione video gratuita con hardware leggero resta irrealistica (thread 8, r/aivideomaking, 6 pt e 15 commenti, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/). A un utente che vuole produrre gratuitamente un video IA di 45 secondi soltanto con smartphone e iPad, u/NewLifeWares risponde che 45 secondi richiedono risorse da data center; gratuitamente si può aspirare al massimo a clip di cinque secondi con filigrana da assemblare.
- Le immagini IA per la pubblicità alimentare vengono ancora stroncate come "poco appetitose" (thread 4, r/aiwars, 4 pt e 177 commenti, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Gli utenti mettono in dubbio la tendenza delle aziende a usare immagini di cibo generate dall'IA negli annunci. u/LCI_Jake dice che sembra un'immagine gore generata intenzionalmente, quasi un nido di insetti. u/Bassed_Hummble replica con un risultato generato localmente in 40 secondi con Krea 2, sostenendo che il prompt possa migliorare il risultato.
- Molte reazioni a un annuncio di lavoro remoto per valutare didascalie IA (thread 5, r/RemoteWorkers, 152 pt e 739 commenti, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/). L'offerta propone 30 dollari l'ora per controllare errori nelle didascalie generate dall'IA, come oggetti identificati erroneamente, colori e testo letti male. La maggioranza dei commenti è costituita da risposte standard che chiedono il link per candidarsi, con poca discussione nel merito.
- Due dibattiti sull'autenticità di un video IA "troppo realistico" (thread 1/6, r/NewRockstars e r/pj_explained, ripubblicazione duplicata dello stesso post, 2026-09-02). A un post che sostiene che il presunto filmato di Thor che colpisce un pilastro sia CGI e non IA, il commento più votato su r/pj_explained, di u/ceaserisnothome, replica frontalmente che l'esplosione perfettamente circolare è una prova dell'IA. Lo stesso filmato divide quindi gli utenti sulla sua autenticità.
- Il video di onde che appaiono all'interno di una finestra divide i commenti tra IA e ripresa reale (thread 7, r/isthisAI, 0 pt e 79 commenti, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/). L'autore nota l'innaturalità dell'acqua che appare in casa senza rompere il vetro; u/RioReiser85 ritiene che sia una ripresa reale spiegabile da un errore di prospettiva, mentre u/bulbousEd afferma che il moto della schiuma di prua sia fisicamente impossibile e dunque IA.
Segnali
- Ciò che sta crescendo: la diffidenza verso un'IA che «non sembra IA». L'ampia risonanza del thread 2 (7,013 pt, 1,009 commenti) indica una forte preoccupazione per il fatto che gli LLM possano ormai controllare direttamente strumenti GUI e falsificare persino le prove di un disegno manuale.
- Ciò che viene sottovalutato o respinto: il desiderio di «creare gratuitamente video lunghi e di alta qualità» viene ripetutamente liquidato dalla comunità (thread 8, 10). Il consenso su Reddit è che i vincoli di hardware e costo restino severi.
- Aspetto inatteso: i subreddit specializzati in IA per immagini e video (r/generativeAI, r/aivideomaking, r/GoogleFlow) hanno generato meno intensità di discussione e meno engagement dei subreddit dedicati a verifica, dibattito e conflitto sull'IA (r/isthisAI, r/antiai, r/aiwars, r/pj_explained, r/NewRockstars, r/whenthe). Le «notizie» su immagini e video IA su Reddit vengono oggi raccontate più come attrito sociale intorno alla domanda «è IA oppure no?» che come evoluzione dei modelli.
- Segnali in conflitto: sullo stesso presunto filmato di Thor che colpisce un pilastro, i commenti su r/NewRockstars e r/pj_explained arrivano a conclusioni opposte — «non è IA» e «è IA» (thread 1/6). Anche nel thread 7 le posizioni sono equilibrate, suggerendo che il giudizio visivo degli utenti comuni non sia più affidabile.
Limitazioni
- La query è stata soltanto "Image and Video Generation AI News" e non sono state effettuate ricerche alternative, come "Stable Diffusion", "Midjourney", "Sora", "Kling" o "generazione immagini open source". Non sono quindi stati raccolti quasi per nulla post che consentano un confronto chiaro tra closed source (Midjourney, DALL-E, Sora, Veo, Runway ecc.) e open source (Stable Diffusion, Flux, ecosistema ComfyUI ecc.).
- I 12 thread raccolti provengono da 12 subreddit diversi, uno per ciascuno; non è stato possibile approfondire un singolo subreddit confrontando più thread sullo stesso tema.
- I thread 9 e 11 hanno corpo vuoto, con soltanto titolo e commenti, perciò manca informazione primaria sull'intento del post.
- I thread 1 e 6 sono di fatto ripubblicazioni dello stesso post in subreddit diversi; contarli come due elementi indipendenti riduce il campione effettivo a circa 11 elementi.
- Per la natura della raccolta via browser, in questa esecuzione non sono stati effettuati ulteriori accessi a Reddit, come nuove ricerche con altre query o l'espansione di tutti i commenti nei thread.
X
X — Notizie sull'IA per la generazione di immagini e video
Account
I 40 elementi raccolti provengono da 37 account. Quasi tutti sono casi isolati, con un singolo post che è diventato virale o è passato inosservato; l'unico account collegato all'IA per immagini e video che ha costruito un thread con più post è @yu_ichi_suzuki (Yuichi Suzuki).
| Account | Post | Tendenza |
|---|---|---|
| @yu_ichi_suzuki(鈴木憂一) | 2 | Thread tecnico sull'esecuzione di MiniMax H3 su RTX 5090 locale (309 like complessivi). Condivisione procedurale, non viralità isolata |
| @xieenze_jr(Enze Xie) | 1 | Post di annuncio del nuovo modello da parte di un ricercatore MiniMax (349 like, circa 85.000 visualizzazioni) |
| @voxelphotonics | 1 | Demo di visualizzazione volumetrica di Duke Nukem 3D: 6,097 like e circa 297.000 visualizzazioni |
| @synabreu | 1 | Modello della città 3D di Seul creato con GPT-6 Astra: 2,700 like e circa 235.000 visualizzazioni |
| @GulatiYajat(Yajat Gulati) | 1 | Città 3D di Gurgaon con GPT-6 Astra: 574 like |
| @luccacerf | 1 | Demo combinata Blender MCP + Astra + Tripo: 445 like |
| @He1s_Sammy | 1 | Lungo thread sul business dei «video IA per bambini senza mostrare il volto»: 388 like |
| @SD_Tutorial(Stable Diffusion Tutorials) | 1 | Account di spiegazioni tecniche su Sol-H3, con risposta contenuta: 22 like |
| @Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox | 1 ciascuno | Account di media dimensione che discutono qualità e limiti di Seedance 2.5 e dei video IA |
A eccezione di @xieenze_jr, gli account non appartengono agli sviluppatori ma a utenti del tipo «l'ho provato» o «l'ho creato». La discussione è trainata da due livelli: pochi grandi post virali (@voxelphotonics, @synabreu) e condivisioni di procedure da parte di singoli tecnici (@yu_ichi_suzuki, @SD_Tutorial).
Post
- MiniMax annuncia Sol-H3, generazione video più rapida della riproduzione in tempo reale (#2 @xieenze_jr, 349 like, 62 repost, 23 risposte, circa 85.000 visualizzazioni, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012). Annuncia: «Five seconds of world. 1.653 seconds to infer.» Con 8× NVIDIA B300 Blackwell, possono essere generati 5 secondi di video a 1344×768 in 1,653 secondi. Il post ha dato origine alla tendenza n. 1 di X Explore, «NVIDIA Speeds Up AI Video Generation Past Real-Time Playback».
- Diffusa una spiegazione tecnica dell'annuncio (#3 @SD_Tutorial, 22 like, circa 2.100 visualizzazioni, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224). Definisce Sol-H3 «a high-performance video inference stack developed by NVIDIA Research that runs the MiniMax-H3 video generation model faster than real-time playback» e collega alla pagina Sol-Engine/Sol-H3 su nvlabs.github.io. Gli account tecnici hanno seguito immediatamente l'annuncio, oltre agli account ufficiali.
- Pubblicata una procedura per eseguire MiniMax H3 localmente su RTX 5090 (#4–5 @yu_ichi_suzuki, 295+14 like e circa 18.000+1.100 visualizzazioni, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192). Condivide un workflow individuale, accompagnato da note GitHub: MiniMax H3 locale produce in circa nove minuti un video di 15 secondi oltre il 2K su RTX 5090; utilizza una LoRA distillata di Alibaba per trovare un buon risultato a 480p e poi effettua upscaling 2× a 2688×1536 con RTX Video Super Resolution. È il contraltare, dal lato dell'uso individuale di open weight, agli annunci cloud (#1, #2).
- Generato un video fashion con Seedance 2.5 (#1 @Strength04_X, 68 like, 2 repost, 35 risposte, circa 7.700 visualizzazioni, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302). Pubblica il prompt completo e afferma di aver creato con «Seedance 2.5 on Dreamina_ai» un «30-second photoreal cinematic fashion-travel music video».
- Generato un mondo in stile Toy Story con Seedance 2.5 (#14 @atlas_remake, 3 like, circa 133 visualizzazioni, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995). Commenta positivamente: «What impressed me most here is how Seedance 2.5 handles multiple animated» characters/objects, valutando favorevolmente la coerenza di più personaggi.
- Segnalato il problema: «i video IA sono ancora una slot machine» (#12 @Aiden_Tech_Ai, 1 like, 2 repost, 4 risposte, circa 494 visualizzazioni, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791). «You prompt. You generate. Something is wrong. You generate again... when you're dealing with multiple spaces, camera movement, character blocking and continuity»: il post indica la scarsa coerenza nelle scene complesse. L'engagement è limitato, ma il tema fa da contrappunto alla valutazione ottimista del n. 5.
- Duke Nukem 3D ricreato su display 3D volumetrico (#10 @voxelphotonics, 6,097 like, 921 repost, 130 risposte, circa 297.000 visualizzazioni, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562). È stato il post con il maggiore engagement dell'intero periodo su X. Non è una demo di IA generativa per immagini o video in senso stretto, bensì di rendering e visualizzazione, ma ha contribuito alla tendenza n. 3 di Explore, «Duke Nukem 3D Brought to Life in True 3D Display».
- L'intera Seul trasformata in città 3D con GPT-6 Astra (#20 @synabreu, 2,700 like, 451 repost, 81 risposte, circa 235.000 visualizzazioni, 2026-09-06, https://x.com/synabreu/status/2096557555086725159). Il post dichiara: «for my first project created with GPT-6 Astra, I built the entire city of Seoul in 3D—a small revolution in digital geography!» ed è diventato molto virale come esempio di generazione 3D conversazionale.
- Anche Gurgaon viene ricreata come città 3D con GPT-6 Astra (#22 @GulatiYajat, 574 like, 28 repost, 53 risposte, circa 46.000 visualizzazioni, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684). «I saw everyone building all sorts of cool demos with Astra, so I decided to give it a shot»: è un esempio concreto di imitazione nata sull'onda del caso n. 8. È stato pubblicato anche il sito dedicato gurgaon-3d-atlas.cratorlabs-2435.chatgpt.site.
- Demo combinata Blender MCP + Astra + Tripo (#21 @luccacerf, 445 like, 20 repost, 11 risposte, circa 31.000 visualizzazioni, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782). «First time building a gUI with Blender MCP + Astra + Tripo This is insane. Html preview for AI is dead.» È un esempio di integrazione di più strumenti IA tramite MCP.
- I «video IA per bambini senza mostrare il volto» diventano un business di contenuti (#23 @He1s_Sammy, 388 like, 96 repost, 17 risposte, circa 19.000 visualizzazioni, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056). Il post «FACELESS AI KIDS VIDEOS ARE BECOMING A SERIOUS CONTENT BUSINESS...a phone, laptop, or iPad is enough to start experimenting» si è diffuso come contenuto di monetizzazione e lavoro secondario con video IA.
Segnali
- Ciò che sta crescendo: far creare mondi 3D ad agenti conversazionali, come le città 3D in GPT-6 Astra e l'integrazione con Blender MCP, è la tendenza che ha prodotto più imitazioni e seguito nel periodo. Dopo aver visto il post n. 8 di synabreu, GulatiYajat afferma esplicitamente nel n. 9 di averlo provato perché «tutti stavano creando demo», segnalando una catena di imitazioni e non una semplice notizia isolata.
- Ciò che sta crescendo, parte 2: l'inferenza video «più veloce della riproduzione in tempo reale» (Sol-H3, n. 2/3) e le riproduzioni personali su GPU locali (il n. 3 di @yu_ichi_suzuki) sono emerse quasi nello stesso momento. Su X, annunci closed-source e adozione di open weight da parte degli utenti procedono quindi in parallelo senza un significativo ritardo temporale.
- Ciò che viene sottovalutato o divide le opinioni: la coerenza di più personaggi e più spazi nei video IA riceve sia elogi (n. 5, «handles multiple animated characters well») sia critiche (n. 6, «slot machine problem») nello stesso periodo, e la valutazione su X non è ancora stabilizzata.
- Aspetto inatteso: tra le nove tendenze Explore da cui derivano i 40 post raccolti, solo le prime tre erano direttamente connesse all'IA per immagini o video: NVIDIA/Sol-H3, il ritorno animato della VTuber Veibae e il display volumetrico di Duke Nukem 3D. Le altre sei — Croatian, Building, $song, Harvey, Ukrainian, Democrats — erano tendenze locali visibili dal server della sessione, con «Trending in Croatia» esplicitamente indicato alla posizione 4, e non pertinenti al tema. La ricerca su «Building» ha però avuto un esito utile inatteso: le demo di città 3D con GPT-6 Astra (n. 8–10).
- Il caso della VTuber Veibae: cercando la tendenza Explore n. 2, «VTuber Veibae Teases Return with Sunflower Farm Animation», sono comparsi soltanto account non pertinenti che riassumevano gli incassi nordamericani, come @mediamanint e copie dei suoi post. Non è stato raccolto nessun post di Veibae né relativo alla produzione dell'animazione.
Limitazioni
- Tra le tre principali tendenze Explore, «VTuber Veibae Teases Return with Sunflower Farm Animation», potenzialmente collegata all'IA per immagini e video, non ha prodotto post pertinenti: i risultati n. 6–9 erano tutti duplicati non collegati, relativi agli incassi cinematografici. Non è stato possibile confermare se la produzione dell'animazione della VTuber abbia impiegato IA.
- Le altre sei tendenze Explore — Croatian, Building, $song, Harvey, Ukrainian, Democrats — erano quasi tutte tendenze locali o di attualità senza rapporto con l'IA per immagini e video; 29 dei 40 risultati raccolti (#6–#9, #13, #15–#19, #24–#40) sono stati pertanto esclusi dal rapporto come fuori tema.
- Le query erano limitate ai titoli testuali delle tendenze. Non sono state fatte ricerche per nomi direttamente pertinenti, come "Stable Diffusion", "Midjourney", "Sora", "Kling" o "ComfyUI". Di conseguenza, anche qui sono stati raccolti pochissimi post in grado di confrontare chiaramente closed source e open source.
- Explore è geograficamente legato alla localizzazione del server della sessione, che sembra essere nell'area croata, e non rappresenta le tendenze mondiali complessive di X.
- La raccolta si è fermata a 40 elementi; in questa esecuzione non sono stati effettuati approfondimenti ulteriori, come altri post degli stessi account, espansione delle risposte o ricerche per hashtag.
YouTube
YouTube — Ultime tendenze nell'IA per la generazione di immagini e video
Canali
- 動画編集の中の人(canale)— Pubblica molti confronti pratici sull'uso dell'IA per immagini.
- AI大学【AI&ChatGPT最新情報】(canale)— Specializzato in video riepilogativi mensili sugli strumenti di IA generativa.
- 【さき】のAIでええやん。(canale)— Spiegazioni sugli aggiornamenti di Google I/O e Gemini.
- Qwen(ufficiale)(canale)— Pubblica video ufficiali di annuncio della serie Qwen-Image.
- AIOnTrend(canale)— Confronti diretti tra modelli open source per immagini.
- Urban Decoders(canale)— Spiegazioni dell'architettura dei modelli della famiglia Flux.
- SECourses(canale)— Grandi verifiche della generazione immagini locale, con oltre 700 test.
- Woollyfern(canale)— Canale che monitora regolarmente gli aggiornamenti mensili di Midjourney.
- 寺田部チャンネル(canale)— Recensioni pratiche della generazione video locale con ComfyUI.
- 東京大学 吉田幸 研究室(canale)— Spiegazioni periodiche sulle tendenze della tecnologia IA generativa, provenienti da un laboratorio universitario.
Il numero di iscritti non è stato ottenibile perché le pagine dei risultati di ricerca e dei video di YouTube sono renderizzate in JavaScript (vedere Limits sotto).
Video
Area closed-source
- 【ド課金して判明】2026年おすすめ画像生成AIはコレ!NanoBananaPro・Seedream4.0・Midjourney・AdobeFireflyを徹底比較します! — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — Confronta direttamente Nano Banana Pro, Seedream 4.0, Midjourney e Adobe Firefly attraverso utilizzi a pagamento e formula una raccomandazione per il 2026.
- 【2026年冬最新】ここ数か月で過去イチ進化した無料の人気動画生成AIツール6選!~Sora 2、Veo 3.1、Kling 2.6など~ — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — Presenta sei strumenti gratuiti di generazione video, inclusi Sora 2, Veo 3.1 e Kling 2.6, evidenziandone il grande avanzamento negli ultimi mesi.
- 【性能ランキング世界1位】xAIの動画生成AI「Grok Imagine」徹底解説! Sora/Veo級の映像を無料で作る方法! — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — Sostiene che Grok Imagine di xAI sia al primo posto nella classifica delle prestazioni e spiega come creare gratuitamente video di livello Sora/Veo.
- 【最新】GoogleのAI Geminiのモデルが大幅アップデート!動画生成Omniも発表されたGoogle I/O 2026を解説するで! — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — Spiega il grande aggiornamento di Gemini annunciato a Google I/O 2026 e il nuovo modello di generazione video «Omni».
- Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — Riporta il rilascio di Midjourney V8.2, con personalizzazione e NIJI Style Creator, come ultima puntata di una sequenza di aggiornamenti mensili: V8 Alpha a marzo 2026, V8.1 ad aprile, anteprima V8.2 a giugno e release finale V8.2 a luglio.
Area open source
- 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Canale ufficiale Qwen — https://www.youtube.com/watch?v=1tM7Wd0lEeI — Video di annuncio ufficiale del team Alibaba Qwen per Qwen-Image-2.0, presentato come modello open source di nuova generazione per immagini.
- Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX - Presets Published — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — Verifica, sulla base di oltre 700 test, i punti in cui Qwen Image supera FLUX e pubblica i preset.
- Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro - Which AI Image Wins? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — Confronta con lo stesso prompt Flux 2 Klein, Qwen e Z Image Turbo open source con Nano Banana Pro closed-source.
- Flux.2 New Open Source King? Architecture FULL guide + Nano Banana Pro comparisons — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — Spiega l'architettura di Flux.2 rilasciato da Black Forest Labs e verifica, nel confronto con Nano Banana Pro, se sia il nuovo re dell'open source.
- Flux 2 Klein Just Dropped—This Image Editing Model Isn't Just About Speed! — https://www.youtube.com/watch?v=JXgBe3twxbc — Notizia rapida sul rilascio di Flux 2 Klein, modello leggero di editing immagini eseguibile localmente di Black Forest Labs.
- Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — Tutorial che riassume gli aggiornamenti di modelli open source all'avanguardia per immagini e video, come Wan 2.2 di Alibaba, FLUX e Qwen Image.
- 【無料・ComfyUI】ローカル動画生成AIを使って長編動画を制作するのは簡単か?無茶苦茶大変です — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — Resoconto pratico sulla produzione di un video lungo con ComfyUI e IA video locale, con sinceri fallimenti e lezioni: «è tremendamente difficile».
Segnali
- Sul closed source, il tema dominante è il confronto tra economicità e velocità da un lato, qualità dall'altro: più contenuti comparativi sostengono che Nano Banana Pro vinca nel 63% dei test di fotorealismo (video 1, 9), mentre opzioni gratuite o economiche, come Grok Imagine (video 3), promuovono provocatoriamente l'idea di offrire «livello Sora/Veo gratis».
- Midjourney continua a migliorare la serie V8 con cadenza mensile: il canale Woollyfern la segue con costanza — annuncio V8 a febbraio 2026, Alpha a marzo, V8.1 ad aprile, anteprima V8.2 a giugno e versione finale V8.2 a luglio — mettendo in evidenza un ritmo di aggiornamento rapido (video 5).
- L'annuncio di Gemini video "Omni" a Google I/O 2026 viene trattato come una grande notizia autonoma, con spiegazioni immediate anche su canali giapponesi (video 4).
- L'open source è impegnato nella lotta per la leadership tra Qwen Image e FLUX: canali di approfondimento continuano a pubblicare verifiche su «quale dei due sia superiore», come i più di 700 test di SECourses (video 7) e la spiegazione dell'architettura di Urban Decoders (video 9), segnalando forte interesse della comunità.
- Flux 2 Klein di Black Forest Labs è un modello derivato orientato a leggerezza ed esecuzione locale, distinto da Flux.2 full-size, e viene seguito anche autonomamente come notizia rapida (video 10).
- Gli strumenti Alibaba, Wan e Qwen Image, vengono trattati come due pilastri open source per video e immagini, abbastanza da essere riuniti in un unico tutorial (video 11).
- La generazione video locale resta "difficile" nella pratica: una recensione franca descrive la creazione di video lunghi in ComfyUI come «tremendamente difficile» (video 12). Oltre alla qualità, il peso operativo è considerato un problema della generazione video open source.
Limiti
- Le pagine dei risultati di ricerca di YouTube (
/results?search_query=...) e le pagine watch renderizzano il contenuto con JavaScript, perciò WebFetch ha potuto recuperare solo HTML statico, contenente link di footer a termini e copyright. Anche aprendo direttamente le pagine non è stato possibile leggere elenco video, visualizzazioni, data di pubblicazione, descrizione o commenti. Questo contraddice l'assunto del playbook secondo cui l'HTML della pagina contiene titolo, canale, visualizzazioni e data. - In alternativa, sono stati incrociati risultati di ricerca Web con
site:youtube.com— che forniscono titolo, URL, sintesi del motore e talvolta parte della data — e l'endpointoembeddi YouTube, che restituisce in JSON titolo ufficiale, nome del canale e URL del canale. Tuttavia, in questa raccolta non è stato possibile ottenere visualizzazioni, iscritti, testo delle descrizioni o commenti, che non sono pertanto inclusi. - Le ricerche in giapponese su notizie di agosto e settembre 2026 non hanno restituito notizie specifiche sulla generazione di immagini o video IA; sono invece comparsi canali di notizie quotidiane sull'IA in generale e notizie meteorologiche non pertinenti. Non sono state trovate notizie specialistiche immediatamente aggiornate al periodo 1–8 settembre.
- Reddit/X/Bluesky/Lemmy/Pinterest non sono stati esaminati in questo stadio, come indicato in brief.md, perché assegnati a stadi separati.
Bluesky
Bluesky — Notizie sull'IA per la generazione di immagini e video
Account
| Handle | Profilo | Follower ecc. | Nota |
|---|---|---|---|
| @simonwillison.net | Persona singola, noto blogger tecnico sull'IA e autore di Datasette | — | Confronta la capacità di generazione immagini di ogni nuovo modello usando il suo benchmark personale: un pellicano che va in bicicletta. È stata la fonte più ricca di contenuto della raccolta. |
| @404media.co | Media, redazione e giornalisti di 404 Media | — | Principalmente reportage su sorveglianza, ma pubblica occasionalmente scoop sui media generati dall'IA. |
| @aimod.social | Gestione comunitaria, etichettatore di immagini sospette di IA | 2,555 follower, 94 post | Servizio di etichettatura Bluesky che applica automaticamente etichette alle immagini sospettate di essere generate dall'IA; più infrastruttura che fonte di notizie. |
| @stablediffusion.bsky.social | Persona singola, condivisione di prompt SDXL/Stable Diffusion | — | Non pubblica più dal gennaio 2025. |
| @bm63ai.bsky.social | Persona singola, arte con ComfyUI/Flux/Midjourney | — | Ha pubblicato arte IA fino all'aprile 2025; l'ultimo post, nel giugno 2026, riguarda un'app realizzata con Codex e la programmazione vibecoding, quindi la pubblicazione di IA art è sostanzialmente cessata. |
| @petapixel.bsky.social | Media specializzato in fotografia | — | Tratta criticamente funzioni IA di Adobe, come Firefly e Lightroom, ma gli ultimi post risalgono al febbraio 2025 e non appartengono a questo ciclo di notizie. |
Post
- Nuovo benchmark del pellicano in bicicletta con GPT-6 Astra (@simonwillison.net, 2026-09-04, 202 like, 9 repost, 18 risposte, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c). «Got access to GPT-6 Astra. Want to see some pelicans?» Pubblica una griglia che confronta illustrazioni SVG di un pellicano in bicicletta prodotte da GPT-6 Astra, GPT-5.6 Sol, Terra e Luna, ciascuno a tre livelli di ragionamento (dettagli: static.simonwillison.net/static/2026/gpt-6-and-5.6-pelicans.html). Secondo l'alt text, Astra dà risultati raffinati e coerenti; Sol ha proporzioni variabili; Terra un'anatomia innaturale; Luna pose più semplici e rigide. In risposta, un utente osserva che Astra è il primo modello a capire che una creatura quadrupede immaginaria necessiti di una bicicletta tandem.
- GPT-6 Astra controlla Blender e genera una scena 3D con un pellicano (@simonwillison.net, 2026-09-05, 400 like, 30 repost, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s). Con istruzioni in tre fasi — «Use the already install /Applications/Blender to render a scene of a pelican riding a bicycle», poi «add a background and a lot of flair», infine «make it a whole lot better» — pubblica il risultato ottenuto facendo creare la scena 3D in Blender tramite un agente di programmazione. Lo stesso tema, «GPT-6 Astra crea rendering fotorealistici in Blender», è apparso indipendentemente anche nel thread Reddit r/DefendingAIArt, confermandone la rilevanza trasversale.
- Qwen 3.7 27B open source disegna localmente un pellicano (@simonwillison.net, 2026-08-14, 183 like, 14 repost, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z). «The new Qwen 3.7 27B, running as a 17GB GGUF in LM Studio on my M5 Max MacBook Pro, just drew me the best pelican riding a bicycle I've seen from any model that runs on my laptop». È uno dei pochissimi post concreti che mostrano il miglioramento nella generazione immagini di modelli open source eseguibili localmente.
- Un candidato governatore di New York attacca un avversario con un falso video generato dall'IA (@404media.co, 2026-09-02, 124 like, 22 repost, 7 risposte, https://bsky.app/profile/404media.co/post/3muka24vu4v2q). «The Republican Nominee for New York Governor Made a Creepy, AI-Generated Video of Mamdani and Hochul». Nel quote post dello stesso articolo, una voce ironizza sul vivere in un'epoca in cui si creano falsi spot di Viagra per denigrare avversari politici (194 like, 36 repost, https://bsky.app/profile/404media.co/post/3muk7u6iepk2h; l'autore è collegato a 404 Media). È un caso di impiego della generazione video IA per disinformazione nella pubblicità politica.
- La società produttrice di Cocomelon chiede agli artisti di sperimentare con l'IA (@404media.co, 2026-09-06, 84 like, 23 repost, 21 risposte, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n). «Moonbug Entertainment, which makes Cocomelon, Blippi, and other popular content for children, says it will begin using AI but will always have a 'human in the loop.'» È un annuncio di introduzione della generazione immagini e video IA in un importante caso d'uso, la produzione di contenuti per bambini.
- L'etichettatore di immagini sospette di IA aimod.social supera i 2.500 follower (analisi del profilo, https://bsky.app/profile/aimod.social). Si presenta come «Labeler for flagging suspected AI imagery» e dispone persino di un manuale sui criteri di valutazione e di una procedura per i ricorsi. Non è un articolo di notizie, ma indica che su Bluesky si è formata a livello di comunità una domanda per meccanismi che sospettano e etichettano automaticamente immagini generate dall'IA.
- Gli account storici di IA art sono in gran parte silenziosi (analisi dei feed di @stablediffusion.bsky.social e @bm63ai.bsky.social). stablediffusion.bsky.social non pubblica dal post del 22 gennaio 2025 con il prompt «the liberty statue playing electric guitar» (#SDXL #StableDiffusion, 10 like). bm63ai.bsky.social ha smesso di pubblicare IA art dopo «Star Trek: The Muppet Generation» del 25 aprile 2025 (#comfyui #midjourney #flux, 5 like), mentre il suo ultimo post dell'8 giugno 2026 riguarda un'app musicale realizzata con un agente di programmazione.
- Critiche alle funzioni IA generative di Adobe, come riferimento al ciclo precedente (@petapixel.bsky.social, 2025-02-12 e 2025-01-09, 7 like e 33 like). Tra i post: «Adobe's newly-announced text-to-video tool is very much not ready to have a price tag attached to it» e il caso di un fotografo che, tentando di rimuovere un oggetto con Generative Remove di Lightroom, ha ottenuto al suo posto il logo Bitcoin. Sono precedenti al ciclo di notizie di settembre 2026, ma registrati come esempi della continuità di una visione critica degli strumenti commerciali closed-source.
Segnali
- Ciò che sta crescendo: le attività di GPT-6 Astra assimilabili a generazione visiva — disegno SVG del pellicano e controllo di Blender per rendering 3D — sono state trattate indipendentemente sia su Reddit (r/DefendingAIArt, r/antiai) sia su Bluesky (@simonwillison.net), costituendo il maggiore tema trasversale. Va però notato che non si tratta precisamente di immagini create da modelli di diffusione, ma di un nuovo filone in cui un agente LLM genera elementi visivi attraverso codice e strumenti 3D.
- Ciò che viene sottovalutato o respinto: l'open source è estremamente poco presente. È stato confermato soltanto un post sull'esecuzione locale di Qwen 3.7 27B; non sono stati trovati su Bluesky annunci relativi a modelli open source specializzati in immagini o video, come nuove versioni di FLUX, Stable Diffusion, Wan o HunyuanVideo.
- Aspetto inatteso: mentre gli account specializzati di IA art, attivi fino alla prima metà del 2025, sono quasi tutti silenziosi, un servizio di labeling che sospetta e marca automaticamente le immagini IA, aimod.social, continua a esistere e crescere come infrastruttura comunitaria indipendente. Il centro di gravità della conversazione sulle immagini IA su Bluesky potrebbe essersi spostato dalla creazione al riconoscimento e alla moderazione.
- Segnali in conflitto: le notizie concrete sulla generazione video IA hanno reso più visibile il suo abuso nella pubblicità politica, nel falso video sull'elezione del governatore di New York, piuttosto che la competizione di prestazioni fra modelli. Su Bluesky, la generazione video IA è quindi più visibile come problema sociale che come tendenza tecnica.
Limiti
- L'API pubblica di ricerca Bluesky (
app.bsky.feed.searchPosts) ha restituito costantemente HTTP 403 per query in inglese e giapponese, inclusi "image generation AI", "Stable Diffusion", "Midjourney", "Sora", "Veo" e "Kling". Nella stessa sessioneapp.bsky.actor.getProfileeapp.bsky.feed.getAuthorFeedrispondevano normalmente, perciò sembra che il solo endpoint di ricerca richieda autenticazione o sia bloccato. - La Web UI
bsky.app/searchè una SPA renderizzata lato client e il testo dei post non è incluso nell'HTML; lo strumento di acquisizione Web non ha quindi potuto leggere i risultati effettivi della ricerca. - Per questi motivi non è stato possibile eseguire la procedura prevista dal playbook, «ricerca per parola chiave → lettura dei post». Si è passati invece a recuperare individualmente le cronologie di account conosciuti emersi dalla ricerca Web — simonwillison.net, 404media.co, petapixel.bsky.social, aimod.social, stablediffusion.bsky.social e bm63ai.bsky.social. La raccolta è pertanto un campione di account, non un sostituto esaustivo della ricerca per keyword.
- Gli handle previsti di OpenAI, Google DeepMind, Midjourney, Runway, Stability AI, Black Forest Labs, Krea, TechCrunch, The Verge, Ars Technica ed Engadget non esistono su Bluesky oppure non hanno mostrato post pertinenti nei rispettivi feed.
- La soglia di completamento di circa 20 post analizzati per piattaforma non è stata raggiunta a causa dell'indisponibilità dell'API di ricerca. Gli elementi effettivamente analizzabili sono gli otto pubblicati nel testo, più un elemento di riferimento; gli altri feed acquisiti non contenevano post pertinenti. Feed senza elementi pertinenti: techcrunch.com, theverge.com, arstechnica.com, engadget.com e garymarcus.bsky.social, con un solo elemento.
- Non è stato possibile trovare un solo post concreto su modelli open source per immagini e video, come FLUX, nuove versioni di Stable Diffusion, Wan o HunyuanVideo. Con il metodo usato, non si può distinguere se non siano stati discussi oppure se siano stati mancati per l'impossibilità di cercare.
Lemmy
Lemmy — Notizie sull'IA per la generazione di immagini e video
Lemmy è un social federato molto più piccolo di Reddit, quindi qui un «post virale» non raggiunge centinaia di upvote ma qualche decina. Ciononostante, sono emerse informazioni sorprendentemente dense 🐘✨ Sono state esplorate soprattutto !«メールアドレス» (rilasci ComfyUI e modelli), !ai_reddit (bot che ripubblica direttamente le notizie di r/ArtificialIntelligence), oltre a !technology e !techtakes (con molto sarcasmo). La ricerca è stata svolta interrogando ripetutamente lemmy.world/api/v3/search con parole chiave diverse.
Comunità
!«メールアドレス»— 5,709 iscritti, di cui 893 locali. Hub per nodi personalizzati ComfyUI e informazioni sui rilasci di modelli. Pubblicazioni quasi quotidiane.!«メールアドレス»— 2,362 iscritti. Galleria di opere create con Stable Diffusion, Flux e Krea2.!«メールアドレス»— Dedicata all'arte IA in stile anime. Il numero di iscritti non era pubblico, ma il volume di attività è pressoché pari al precedente.!«メールアドレス»— 87,904 iscritti. Ripubblica grandi articoli tech ed è stata tra le comunità dove si è discusso della controversia Midjourney.!«メールアドレス»— 2,690 iscritti. Comunità sarcastica sull'industria dell'IA, particolarmente dura con le presunte deviazioni di Midjourney.!«メールアドレス»— Account di ripubblicazione RSS da r/ArtificialIntelligence. Il numero di iscritti non è stato ottenibile dall'API, ma è la comunità con la maggiore densità di notizie.!«メールアドレス»— 8,154 iscritti. Comunità anti-IA, dove sono finiti anche articoli che criticano la catena di fornitura della generazione IA.
Post
Tendenza closed-source
- Midjourney cambia rotta verso uno scanner ecografico medico "Midjourney Medical" (?) — 2026-06-18–19, dibattito acceso in
!techtakese!hackernews. The Register lo ha deriso come una spa di medicina estetica illuminata d'oro; pivot-to-ai.com ha ironizzato: «questo è un pivot verso Theranos lol». Score 40–58.
https://lemmy.world/post/48384985 (articolo originale: pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/) - Midjourney chiede agli studi di Hollywood di rivelare come usano l'IA — Articolo TechCrunch, Score 73 in
!technology. Seguito del contenzioso sul copyright.
https://lemmy.world/post/49069400 - Google rilascia Nano Banana 2 Lite — Modello leggero per immagini di DeepMind. Post tramite
!hackernewse il media tech svizzero itmagazine.ch, 2026-06-30–07-02.
https://lemmy.world/post/48857780 (deepmind.google/models/gemini-image/flash-lite/) - MAI-Image-2.5 di Microsoft raggiunge Nano Banana 2 nei benchmark — Tramite the-decoder.com,
!ai_reddit, 2026-05-28.
https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/ - Recensione comparativa approfondita di ByteDance Seedream 5.0 Pro — Menziona la forza nell'editing e nella generazione iterativa,
!ai_reddit, 2026-07-10.
https://www.reddit.com/gallery/1usc03q - La funzione Earth AI di Google viene sospesa il giorno dopo il lancio — Fortune riporta che utenti hanno iniziato a sovrapporre immagini false a luoghi reali e ad abusarne;
!ai_reddit, 2026-08-07.
https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/ - L'attività enterprise di Runway raddoppia con NRR superiore al 300% — Notizia sulla crescita nel business aziendale della società di generazione video Runway,
!ai_reddit, 2026-08-30.
https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says_enterprise_business_doubled_nrr_over/ - Amnesty International definisce i principali sistemi IA "illegali fin dalla progettazione" — Contesto di pressione normativa sulla generazione IA in generale,
!ai_reddit, 2026-06-24.
https://reddit.com/r/ArtificialInteligence/comments/1ue64s2 - Pax Silica: l'armamentizzazione della catena di fornitura dell'IA — Analisi della guerra economica fra USA e Cina su semiconduttori e risorse di calcolo, trattata come rischio geopolitico per le grandi aziende tech closed-source in
!fuck_ai, Score 14, 2026-09-06.
https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare - Chiesto ad "Astra 6 max" di creare arte emozionante — Generazione artistica filosofica e autoriflessiva con un modello commerciale closed-source,
!ai_reddit, 2026-09-05.
https://i.redd.it/3h241pocalnh1.png
Tendenza open source
- Rilasciato LLaDA-Image — Nuovo modello che combina un Diffusion Transformer da 6B con un modulo congelato di comprensione visivo-linguistica, basato su LLaDA2.0-Mini. Ottiene punteggi SOTA in Qwen-Image-Bench: 53.53 in inglese e 53.38 in cinese. È stato pubblicato anche LLaDA-Image-Turbo, versione rapida in 2–4 step, con pesi, codice di addestramento e ricette completamente aperti.
!stable_diffusion, 2026-09-04.
https://lemmy.dbzer0.com/post/74988021 (paper: arxiv.org/abs/2609.03796, codice: github.com/inclusionAI/LLaDA-Image) - Rilasciato Boogu-Image-0.1 — Famiglia di modelli aperti in più varianti, Base/Turbo/Edit, con licenza Apache-2.0 e libero uso commerciale. Con 10B parametri, ottiene il più alto punteggio open source in Qwen-Image-Bench (53.58).
!stable_diffusion, 2026-06-17.
https://boogu.org/ (paper: arxiv.org/abs/2607.13125) - ComfyUI-Ref2VA-VSA: nodo di accelerazione dell'inferenza per MiniMax H3 — Migliora significativamente la velocità d'inferenza della generazione video,
!stable_diffusion, 2026-09-08.
https://github.com/Kablex/ComfyUI-Ref2VA-VSA - ComfyUI-AetherScale: upscaler video nativo per GPU NVIDIA —
!stable_diffusion, 2026-09-05.
https://github.com/vizart-vj/ComfyUI-AetherScale - ComfyUI-VDN-H3: attenzione ibrida Video Delta Net — Nodo per migliorare l'efficienza dei modelli di generazione video,
!stable_diffusion, 2026-09-05.
https://github.com/Saganaki22/ComfyUI-VDN-H3 - ComfyUI-Majoor-OmniCam: strumento per layout e animazione della camera — Nodo per il controllo del lavoro di camera in generazione video/immagini,
!stable_diffusion, 2026-09-04.
https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam - FastH3-Ref2V-Stream-Controller — Strumento di controllo streaming per la generazione video della famiglia MiniMax H3,
!stable_diffusion, 2026-09-04.
https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller - ComfyUI-InpaintCanvas: UI di inpainting in stile Krita —
!stable_diffusion, 2026-09-08.
https://github.com/DenRakEiw/ComfyUI-InpaintCanvas - ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — Tre nodi consecutivi di accelerazione e alleggerimento per modelli video della famiglia MiniMax H3, pubblicati simultaneamente il 2026-09-01–02. Sono prova di un ecosistema open source per la generazione video estremamente attivo.
https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE - InterleaveThinker: ricerca sul reinforcement learning per generazione interleaved agentica — Ricerca che aggiunge a modelli di generazione immagini esistenti la capacità di generazione sequenziale testo↔immagine mediante un sistema multi-agente,
!stable_diffusion, 2026-06-12.
https://arxiv.org/abs/2606.13679 - Flusso continuo di opere create con Flux/Krea2 turbo —
!stable_diffusion_arte!share_anime_artricevono quotidianamente più opere di arte e anime generate con Flux e Krea2. Non è una notizia isolata, ma un segnale continuo che i modelli open weight sono usati ogni giorno.
https://lemmy.dbzer0.com/post/75150630 e molti altri
Segnali
- 🔥 Il tema più discusso è lo smarrimento di Midjourney. La notizia che un'azienda di generazione immagini sia entrata nel settore degli scanner ecografici medici ha animato sia
!techtakessia!technology, e non in senso positivo: l'atmosfera è «ma stanno bene?». Tra le notizie sulle aziende closed-source, ha di gran lunga gli score più alti (40–73). - 🛠️ Sul lato open source, nello stesso periodo sono usciti in successione cinque o sei nodi ComfyUI per modelli video della famiglia MiniMax H3. È il tipico schema in cui una comunità di sviluppatori converge rapidamente su uno specifico modello video di base e compete nell'ottimizzazione. La presenza di molti nomi di sviluppatori dell'area cinese, come nazgut e lisitskyaa, suggerisce anche una diffusione globale.
- 📊 Gli appassionati di benchmark usano Qwen-Image-Bench come metrica comune. LLaDA-Image (53.53) e Boogu-Image-0.1 (53.58) competono sullo stesso benchmark, rendendo visibile numericamente la lotta prestazionale interna all'open source.
- 😤 Articoli sui rischi geopolitici delle aziende closed-source arrivano persino nelle comunità critiche dell'IA, come
!fuck_ai, segnalando che il tema dell'IA generativa è fuoriuscito dalla sola comunità tecnica. - 🤖 Lemmy ha un campione piccolo, quindi la soglia di «viralità» è totalmente diversa da Reddit/X: uno score negli anni 70 equivale a una grande notizia. I valori vanno letti in termini di fermento relativo, non assoluto.
Limiti
- Lemmy è federato e la ricerca varia da istanza a istanza. L'API di
lemmy.worldha recuperato soprattutto post della stessa istanza o di altre istanze federate verso di essa. Sono stati tentati accessi alla UI di ricerca dilemm.eeelemmy.ml, ma per ragioni di tempo la raccolta è stata limitata all'API dilemmy.world; non è stato possibile coprire tutte le istanze. - Le query "Kling AI", "Stability AI", "Wan 2.2" e "Runway Gen" hanno restituito zero risultati o risultati irrilevanti, come notizie politiche. Su Lemmy, le discussioni su modelli video cinesi come Kling e Wan, o su Stability AI in sé, sono quasi assenti; quelle sui video emergono soltanto nella comunità di sviluppatori ComfyUI attraverso il nome MiniMax H3.
!ai_redditè un bot di ripubblicazione automatica da r/ArtificialIntelligence: si tratta sostanzialmente di notizie provenienti da Reddit e riproposte su Lemmy, non di informazione primaria originale di Lemmy.- La soglia di circa 20 post analizzati è stata raggiunta, con circa 20 elementi riportati in questo testo e molti risultati duplicati o irrilevanti verificati. Tuttavia, il volume complessivo di post su Lemmy è di ordini di grandezza inferiore a Reddit/X, e la disponibilità di informazioni primarie di alta qualità resta più limitata rispetto alle altre piattaforme.
Pinterest — Notizie sull'IA per la generazione di immagini e video
Dei 50 pin già raccolti (output/pinterest.pins.md / images/pinterest/manifest.json, senza classificazione di genere e derivati dall'unica query "Image and Video Generation AI News"), sono state aperte e verificate direttamente 30 immagini. Quanto segue si basa su tale verifica.
Temi visivi
- Miniature clickbait in stile "notizie IA": uomo barbuto con espressione sorpresa e loghi di strumenti al neon ([11]), sfondo esplosivo con sorriso in stile Sam Altman ([19]), conduttore di notizie metà robot con microfono «B» ([44]). Sono frequenti composizioni che replicano direttamente le miniature dei video YouTube. La maggior parte dei pin collega a video YouTube, non ad articoli veri e propri.
- Infografiche di classifica "best of" per prodotti closed-source: liste in riquadri al neon con Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo AI, HeyGen, Synthesia, InVideo, Sora e Google Veo compaiono ripetutamente [9, 27, 33]. Esiste una versione equivalente per immagini, con ChatGPT/Nano Banana/Ideogram/GenTube/Z-Image [36].
- Rappresentazioni personificate di robot e conduttori IA: robot bianchi seduti a un banco di notizie ([32]), video sintetici di conduttrici ([38, 49]), robot insieme a infermieri o umani in contesti medici ([50]). Più che schermate di strumenti, dominano immagini metaforiche in cui l'IA sostituisce ruoli umani, come giornalisti e medici.
- Immagini che alimentano ansia su deepfake e autenticità: foto di gatto con timbro «FAKE» e numero di like ([3]), quiz «Which is AI?» con due foto di montagna ([10]), forme d'onda sonore e rilevatori «97% likely AI generated» ([25, una delle immagini interne, e 35). Una parte dell'offerta riguarda rilevamento e sospetto più che generazione.
- Visual IA generici da stock: immagini neutre con neon viola-blu, sagome di cervello, circuiti e particelle, con il solo testo del titolo ([2, 4, 5, 15, 20, 30]). Sono riempitivi da «immagine dall'aspetto IA» senza nomi concreti di prodotti o schermate.
- Griglie dimostrative prima/dopo per image-to-video: griglie che trasformano una foto o un video in più stili — LEGO, origami, persona ricoperta di fiori, auto giocattolo — ([7]), oppure diagrammi che generano una timeline di cinque fotogrammi da una sola immagine ([1, 6]). Alcuni pin visualizzano concretamente la funzione «una immagine → video».
- Compaiono nomi di prodotti reali, ma quasi tutti closed-source: Veo 2/3 ([13, 24]), VASA-1 di Microsoft Research ([41]), Grok ([32]), Sora, ChatGPT e Nano Banana ([36]) e molti altri. Tra i 30 elementi verificati non è comparso un solo nome di modello o repository identificabile come open source.
- Infografiche che promuovono una "pipeline IA": un diagramma [47] propone di creare automaticamente un vlog da un link a un video virale usando quattro agenti, «Scout→Script→Generate→Animate». È un segnale della trasformazione della generazione video da strumento isolato a workflow automatizzato.
Pin notevoli
- [1] Image to Video AI: How It Works and Why It Matters — Il pin più concreto come spiegazione tecnica: illustra come una singola immagine statica diventi una timeline video passando per slider di intensità del movimento, coerenza temporale e controllo visivo.
- [7] (senza titolo, griglia di trasformazioni LEGO/origami/fiori) — Griglia 3×5 prima/dopo che trasforma video sorgente di una persona, un panda di peluche e una Tesla in «blocchi di legno», «origami», «LEGO» e «fiori». È uno dei pochi esempi che mostrano risultati di generazione effettivi.
- [9] 10 FREE AI VIDEO TOOLS IN 2026 — Dieci strumenti video IA gratuiti: Pictory, Runway ML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva e Hyperwrite. Fornisce un colpo d'occhio sugli attuali piani gratuiti delle aziende closed-source.
- [24] (senza titolo, image-to-video con personaggio mostro viola) — Demo che colloca la stessa immagine in input in tre video con sfondi completamente diversi, come sala server, rovine sottomarine e città di caramelle. Il titolo è collegato a Veo 3.
- [27] 5+ Best AI Video Generation Websites — Oltre a confrontare Runway/Pika/Kling AI/Luma/Canva/Hailuo, specifica come usi finali YouTube Shorts, TikTok, pin video Pinterest e video di presentazione prodotto, mostrando che Pinterest stesso è immaginato come destinazione dei video IA.
- [36] Top AI Image Generation Tools — Elenca ChatGPT, Nano Banana, GenTube, Ideogram e Z-Image come strumenti di generazione immagini nel 2026. Nomi più recenti come Nano Banana e Z-Image sono già penetrati anche negli articoli SEO su Pinterest.
- [39] The Latest AI Developments (tre notizie in stile breaking news) — L'unico pin davvero simile a notizie, con tre avvenimenti concreti: IA che risponde in prima battuta al 911 di New Orleans; Meta che rilascia gratuitamente il modello di agenti offline Muse Glimmer; il gruppo nordcoreano Kimsuky che automatizza documenti di phishing con il proprio stack IA.
- [41] Microsoft Unveils VASA-1 — Diagramma di una demo tecnica Microsoft Research che genera in tempo reale volti di più persone in conversazione da un'immagine e un clip audio, con eventuale segnale di controllo dell'espressione. È uno dei pochi elementi derivati da un annuncio di ricerca.
- [16] AI Image Video: Best Quality vs Best Free — Guida decisionale che contrappone ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber e Synthesia a Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut e altri. Considera persino criteri di selezione come leggibilità del testo, disponibilità di GPU e necessità di editing SVG.
- [47] AI video creation just got crazy — Propone un workflow a quattro agenti, «Scout→Script→Generate→Animate», per generare automaticamente un vlog completo da un link a un video virale, andando oltre il singolo strumento.
Segnali
- Su Pinterest, l'area «Image and Video Generation AI» è dominata non da notizie rapide ma da infografiche di confronto strumenti e how-to a fini SEO/affiliazione. Le fonti primarie — annunci ufficiali, paper di ricerca o post social — sono quasi del tutto assenti; la maggior parte dei pin rimanda a blog o video YouTube.
- Le sole notizie concrete individuate sono le tre del pin [39] — IA per risposte 911, Meta Muse Glimmer e Kimsuky nordcoreano — oltre a pin su annunci di Veo 2/3, VASA-1 e Grok. Le informazioni primarie che possano dirsi «ultime notizie» su una scala di circa 20 elementi sono limitate.
- La presenza closed-source è schiacciante: Runway, Pika, Kling AI, Luma, Canva, Hailuo, HeyGen, Synthesia, Sora, Veo, ChatGPT/Nano Banana e Ideogram ricorrono ripetutamente. Al contrario, tra gli elementi verificati non sono comparsi nomi di modelli o progetti open source: nessun riferimento a Stable Diffusion, ComfyUI, Open-Sora e simili. Pinterest è quindi una fonte debole per descrivere l'andamento open source.
- Sono ricorrenti sia l'idea che l'IA sostituisca ruoli umani — conduttori, infermieri, operatori del 911 — sia l'idea di dubitare dell'autenticità dei contenuti — timbri FAKE, «Which is AI?», rilevatori IA. Entrambi i filoni trattano soprattutto impatto sociale e ansia sulla fiducia, più che la tecnologia generativa in sé.
- Tra gli usi della generazione video spiccano l'animazione di una sola foto e la trasformazione stilistica di video esistenti, come conversione in LEGO o origami. Sono più promossi i casi d'uso di trasformazione da immagine/video che il text-to-video creato da zero.
Limiti
- I 50 elementi raccolti in anticipo non erano classificati per genere — il campo
genreera vuoto per tutti — e derivavano da un'unica query. Non sono stati cercati intenzionalmente lungo i due assi closed-source/open-source. - Per ragioni di tempo, sono state aperte solo 30 immagini su 50; non sono state verificate direttamente le posizioni 14, 15, 18, 21, 22, 26, 28, 29, 31, 37, 40, 42, 43, 45, 48 e altre. I titoli degli elementi non verificati, come indicati in
pinterest.pins.md, includono confronti fra strumenti di lip sync, strumenti di editing video e rilevamento di contenuti IA; sembrano sovrapporsi ai temi già osservati e non mostrano segnali di un genere distinto che possa ribaltare le tendenze descritte. - Pinterest non è stato esplorato direttamente; come previsto dal playbook, la valutazione si basa solo sulle immagini e sui titoli già raccolti dal worker. Il manifest e la tabella dei pin non contengono data di pubblicazione né engagement, perciò non è possibile stabilire quando sia stata pubblicata un'informazione né quanto sia stata diffusa.
- Poiché su Pinterest non sono stati trovati riferimenti significativi all'open source, non può essere usato come fonte per le tendenze open source nel successivo rapporto integrato: questo limite va dichiarato esplicitamente.
Azioni consigliate
- Continuare a monitorare come tema dedicato la generazione visiva agentica di GPT-6 Astra, inclusi controllo di Blender e generazione di città 3D.
- Aggiungere nella prossima raccolta query trasversali alle piattaforme con nomi propri come "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" e "ComfyUI", per intercettare gli annunci open source senza omissioni.
- Per la ricerca su Bluesky, ampliare anticipatamente l'elenco degli account osservati, assumendo che l'API di ricerca continui a restituire 403.
- Dato che Pinterest non consente di ottenere date dei post e dati di engagement, limitarne l'uso al monitoraggio continuativo della notorietà degli strumenti e non ai confronti di notizie rapide che richiedono freschezza.
- Poiché il presunto cambio di rotta di Midjourney verso dispositivi medici non è ancora verificato nei fatti, evitare citazioni assertive finché non emerga una fonte primaria, come un annuncio ufficiale di Midjourney.
- Considerare
!stable_diffusionsu Lemmy e i canali YouTube di verifica come fonti principali, da controllare prioritariamente, per il monitoraggio delle tendenze open source.
Immagini raccolte


















































Nota sulla qualità dei dati
Su Bluesky l'API di ricerca ha restituito costantemente 403 e non è stata raggiunta la soglia di 20 elementi; su Pinterest non è stato possibile ottenere data di pubblicazione né dati di engagement, quindi non si è potuta valutare la freschezza. Reddit e X, basati su una singola query, non hanno confrontato intenzionalmente closed e open source; gli argomenti open source risultano quindi concentrati su Lemmy e YouTube.



