Notizie sull'IA per la generazione di immagini e video — 2026-09-07
I sistemi closed source vedono il passaggio di testimone tra la fine dell'API di Sora2 (2026/9/24) e GPT-6 Astra, che diventa un agente generalista; nell'open source, invece, l'ecosistema ComfyUI/MiniMax-H3/Qwen-Image-Edit continua a espandersi ogni giorno e raggiunge una praticità concreta anche sulle GPU consumer.
Ultime notizie sull'IA per la generazione di immagini e video — 7 settembre 2026
Che settimana assurda 🔥🔥 Sul fronte closed source, il valore di "GPT-6 Astra" di OpenAI sta crescendo rapidamente non tanto come semplice generatore di immagini e video, ma come "agente che manovra una miriade di altri strumenti". Al contrario, l'ex campione "Sora 2" è incredibilmente avviato verso la chiusura del servizio (Web/app terminati il 26/4/2026 e API previste in chiusura completa il 24/9/2026) 😱 Nel frattempo l'open source, pur con meno clamore, è incandescentemente attivo: attorno a ComfyUI, gli ecosistemi "MiniMax-H3" e "Qwen-Image-Edit" aggiungono continuamente nuovi componenti, e siamo arrivati a un'epoca in cui è possibile generare video seriamente anche con GPU consumer, comprese quelle AMD 🛠️✨ Un altro elemento comune a tutte le piattaforme è il clima per cui, se si scopre che un contenuto è generato dall'IA, viene subito attaccato: le richieste di etichettatura dell'autenticità e le voci anti-IA monopolizzano i post con più like, cosa davvero sorprendente.
Tra le piattaforme 🌐
- GPT-6 Astra è apprezzato non come "IA generativa", ma come "IA di controllo": sia su X (@Yokohara_h, 2.156 like, https://x.com/Yokohara_h/status/2096622171011666003) sia su YouTube (まさおAI じっくり解説ch, https://www.youtube.com/watch?v=_pAAaBv_G7A), ha suscitato grande entusiasmo la capacità di usare ComputerUse per controllare altre app, come Blender, e automatizzare pipeline 3DCG. È davvero notevole che il tono sia identico sulle due piattaforme 🔥
- L'inizio della fine di Sora 2: su YouTube (https://www.youtube.com/watch?v=DSfAZdE5rWA) viene spiegata la chiusura dell'API il 24/9/2026, cioè tra tre settimane, mentre su Bluesky (https://bsky.app/profile/coah80.com/post/3muulvyomz72c) è emerso un post che lo stronca: "SORA 2 WAS GENUINELY SO BAD". Non si trovava più nessuno disposto a difenderlo 😢
- L'ecosistema ComfyUI/MiniMax-H3 è il principale campo di battaglia dell'open source: nella community !«メールアドレス» di Lemmy (https://lemmy.dbzer0.com/post/75036488 e altri) compaiono ogni giorno da 3 a 9 nuovi nodi e LoRA. Reddit (VPIPE su Apple Silicon M5 Pro: 1024px, 8 step, circa 45 secondi, https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/) e Bluesky ("local software like ComfyUI ha più funzioni", https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t) confermano lo stesso andamento.
- Il clima di ostilità verso i contenuti IA è la maggiore fonte di engagement: come mostrano il thread di denuncia dei falsi timelapse su Reddit r/antiai (6.792 pt, 994 commenti, https://www.reddit.com/r/antiai/comments/1w81kdd/) e i due post Bluesky con più like (critiche all'IA generativa, 121 e 100 like, https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b), i post critici del tipo "non è inquietante?" tendono nettamente a diventare più virali delle presentazioni di strumenti.
Piattaforma per piattaforma 📱
Reddit: i benchmark di generazione locale su r/StableDiffusion e gli elenchi di strumenti gratuiti su r/freetoolsAI (Deepany, Aifun, Perchance e altri) offrono solide informazioni pratiche orientate all'open source. Su r/aiwars, invece, veniva criticata la qualità delle immagini commerciali closed source per pubblicità alimentare (177 commenti, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Poiché è stata usata una sola query, la raccolta si è fermata a 12 thread e non ha raggiunto l'obiettivo di 20.
X: sono stati raccolti 40 post, ma solo 4 erano attinenti al tema 😅 (tutto il resto era rumore di tendenze su calcio, politica e Croazia). Quei quattro, però, lodavano tutti fortemente GPT-6 Astra e non citavano mai l'open source: il quadro era completamente dominato dal closed source.
YouTube: è stata la piattaforma più ricca di informazioni. Sul lato closed source: chiusura di Sora2, GPT-6 Astra, aggiornamento Midjourney V7 (supporto all'input vocale giapponese, https://www.youtube.com/watch?v=wFHlG7wcRUQ) e Google Nano Banana 2 (https://www.youtube.com/watch?v=nikIxHM_AQY). Sul lato open source: Flux.2 (Dev/Klein con licenza Apache 2.0, https://www.youtube.com/watch?v=ISRy5Skd04U) e Qwen-Image-Edit-2511, con molti tutorial ComfyUI (https://www.youtube.com/watch?v=ScoIZYsoRwo). C'erano anche test di Wan2.2 e Hunyuan1.5 su GPU AMD consumer (https://www.youtube.com/watch?v=a_xzC7ckwno).
Bluesky: struttura polarizzata tra singoli utilizzatori di strumenti e fronte anti-IA. Sul lato closed source è popolare il workflow Nano Banana (Gemini 3.1) + Kling 3.0 (https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k), mentre l'annuncio del nuovo modello Grok Imagine di xAI ha ricevuto zero like. Sul lato open source si trovano pareri positivi su ComfyUI e utenti di Stable Diffusion WebUI reForge con AMD ROCm. A causa delle limitazioni API, con frequenti 403, sono stati verificati solo 11 post reali su un obiettivo di 20.
Lemmy: l'entusiasmo open source è schiacciante: solo !«メールアドレス» ha pubblicato 11 post su strumenti, inclusi Viggle-Animate e l'integrazione nativa di Trellis.2 + Pixal3D in ComfyUI. Sul lato closed source, l'unico tema organico era la notizia secondo cui Midjourney sarebbe passata dalla generazione immagini alle scansioni a ultrasuoni per uso medico (score massimo 73, https://techcrunch.com/2026/07/04/midjourney-wants-hollywood), ripubblicata su più istanze. Non trovare neppure una notizia su Sora o Veo su Lemmy è stato di per sé una scoperta.
Pinterest: sono stati esaminati tutti i 50 pin raccolti in anticipo. Qui le infografiche-rankings di strumenti commerciali closed source — Veo, Sora, Runway, Kling, Pika, Adobe Firefly e altri — dominano quasi completamente. I riferimenti all'open source sono quasi assenti, salvo "Amuse 3.0", che promuove l'esecuzione locale. Degno di nota anche il fatto che ansie sui deepfake e contenuti di rilevamento siano diventati un genere indipendente.
Cosa osservare 👀
- Fine dell'API di Sora 2 (2026/9/24) — Resta da capire come evolverà la ricerca di alternative. YouTube "AI収益化ラボ" https://www.youtube.com/watch?v=YHPmaUb_X6c
- ComputerUse di GPT-6 Astra e automazione delle pipeline 3DCG — Il suo futuro come hub creativo, più che come IA generativa. X https://x.com/Yokohara_h/status/2096622171011666003
- Velocità di espansione dell'ecosistema MiniMax-H3 — Nuovi componenti come Viggle-Animate e H3-World compaiono ogni giorno. Lemmy https://lemmy.dbzer0.com/post/75036488
- Discussione sull'etichettatura dell'autenticità dei contenuti IA — Può la denuncia dei falsi timelapse evolvere in pressione normativa? Reddit https://www.reddit.com/r/antiai/comments/1w81kdd/
- Cambio di business di Midjourney (generazione immagini → dispositivi medici) — Potrebbe anticipare mutamenti nei modelli di business delle aziende closed source. Lemmy https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
- Diffusione di Qwen-Image-Edit × ComfyUI — Come si diffonderà l'idea che le prestazioni competano con gli strumenti di editing closed source. YouTube https://www.youtube.com/watch?v=WOcxMUwKWIk
Raccomandazioni 💡
- Se avete workflow dipendenti da Sora2, pianificate subito la migrazione a Kling 3.0 o Veo 3.1 prima della fine dell'API, il 24/9/2026.
- Seguite ComputerUse di GPT-6 Astra valutandolo come strumento per automatizzare pipeline produttive, non come generatore IA isolato.
- Per ridurre i costi, conviene provare l'editing locale con Qwen-Image-Edit + ComfyUI prima di decidere un abbonamento closed source.
- Per prepararsi al rischio di controversie su falsi timelapse e ritocchi IA, stabilite in anticipo regole interne di disclosure dell'uso dell'IA nei contenuti pubblicati.
- Vale la pena testare il workflow specializzato Nano Banana (immagini fisse) + Kling 3.0 (conversione in video), già apprezzato da più creatori indipendenti.
- Continuate a monitorare la notizia del cambio di business di Midjourney, per verificare se altre aziende closed source seguiranno una diversificazione analoga.
Qualità dei dati 📊
Nessuna piattaforma ha raggiunto pienamente il criterio di completamento di brief.md, ossia circa 20 contenuti analizzati per social 😅 In particolare, X ha prodotto solo 4 post pertinenti su 40 raccolti: le query provenivano dalle tendenze locali croate ed erano piene di rumore su calcio e politica. Anche Bluesky, per via dei limiti di frequenza con 403, ha raggiunto solo 11 post effettivi. Reddit si è fermato a 12 thread per l'uso di una sola query; Lemmy a 15, con 11 post open source e 4 closed source, anche perché manca una community specialistica di notizie. YouTube ha raccolto 11 video e viene considerato completo secondo il playbook, che richiede da 5 a 12 video, ma non ha potuto ottenere metadati come visualizzazioni a causa del rendering JavaScript. Solo Pinterest ha permesso di esaminare tutti i 50 risultati pre-raccolti, ma una query unica ha fatto emergere quasi nessun pin open source. Nel complesso, pur senza raggiungere il numero obiettivo, sei piattaforme confermano indipendentemente le stesse direzioni: GPT-6 Astra, la fine di Sora2 e l'espansione dell'ecosistema ComfyUI. Il quadro delle tendenze principali risulta quindi sufficientemente affidabile 🙆
Riepilogo per piattaforma
Reddit — Notizie sull'IA per la generazione di immagini e video
Dove
12 thread raccolti in 11 subreddit tramite la query "Image and Video Generation AI News".
| Subreddit | Membri | Thread raccolti |
|---|---|---|
| r/antiai | 316,504 | 1 |
| r/generativeAI | 151,065 | 2 |
| r/freetoolsAI | 7,817 | 1 |
| r/StableDiffusion | 1,001,556 | 1 |
| r/teenagers | 3,675,063 | 1 |
| r/aiwars | 166,920 | 1 |
| r/RemoteWorkers | 74,882 | 1 |
| r/aislop | 82,721 | 1 |
| r/TopAITools4U | 2,396 | 1 |
| r/GoogleFlow | 1,750 | 1 |
| r/EyesWideShut | 15,320 | 1 |
Osservando l'elenco dei subreddit, le community specialistiche dedicate alla generazione IA (r/StableDiffusion, r/generativeAI, r/GoogleFlow, r/TopAITools4U, r/freetoolsAI) e quelle contrarie o critiche verso le immagini IA (r/antiai, r/aiwars, r/aislop, r/EyesWideShut, r/teenagers) sono presenti in proporzioni quasi equivalenti. r/RemoteWorkers la menziona nel contesto di un annuncio di lavoro.
Le voci delle persone
-
Thread #1 r/antiai · 6.792 pt · 994 commenti · 2026-09-05 — "Avviso: c'è una nuova forma di immagine generata dall'IA". Il post sostiene che, non usando un modello di diffusione ma facendo controllare mouse e tastiera a un LLM, indicato come GPT-6, sia possibile mascherare un'illustrazione come autentica includendo persino un falso timelapse in stile disegnato a mano. Ha raggiunto 994 commenti. Commento principale (2.483 pt, u/Nayutantantan): "Anche se ho smesso di usare i social e di essere un'artista online... ora la tendenza dei timelapse falsi sta diventando comune." Anche le richieste di rendere obbligatoria subito l'etichettatura (u/Soggy_Supermarket100, 170 pt) hanno ricevuto forte sostegno.
-
Thread #5 r/teenagers · 7 pt · 41 commenti · 2026-08-31 — "A tutti gli utenti di generatori IA di immagini/video". L'argomento è che "l'IA sta solo eseguendo la tua idea, mentre a disegnare davvero è l'IA stessa". u/LiterallyGarbage_0 (5 pt): "se vuoi fare arte, prendi una matita e inizia a disegnare". Dall'altra parte, u/TheDarkmoore (2 pt) difende l'uso pratico: ha usato l'IA per le illustrazioni di un gioco di carte, perché per lui, che non sa disegnare, era una scelta necessaria. Anche all'interno della stessa generazione le posizioni restano divise.
-
Thread #6 r/aiwars · 4 pt · 177 commenti · 2026-09-03 — "Anche molti professionisti qui ammetteranno che i modelli IA attuali sono pessimi nel generare immagini di cibo appetitoso". La discussione è cresciuta eccezionalmente fino a 177 commenti. u/Your-local-enjoyer (9 pt): "scattare una foto vera offre ai clienti aspettative più accurate". Come controargomento, u/Bassed_Hummble (5 pt) presenta un prompt specifico con Krea 2 locale, generato in 40 secondi, affermando di aver prodotto un "burrito per colazione appetitoso"; emerge quindi anche l'interpretazione secondo cui il problema sia il prompt, non il modello.
-
Thread #4 r/StableDiffusion · 31 pt · 10 commenti · 2026-09-03 — "VPIPE: non solo video — anche la generazione locale di immagini è veloce". Benchmark locale su Apple Silicon M5 Pro 24GB con krea/Krea-2-Turbo-M87 (16 bit) + M87 LoRA: circa 45 secondi per immagine a 1024×1024 e 8 step, oppure 35 secondi con quantizzazione 8 bit in tempo reale. u/Glittering-Call8746 (1 pt) commenta che sta valutando il divario di velocità tra M5 Max e M5 Pro, oltre al confronto con la serie RTX 5000.
-
Thread #11 r/GoogleFlow · 12 pt · 6 commenti · 2026-09-01 — "AutoFlow ha appena ottenuto la generazione continua di video IA". L'estensione Chrome non ufficiale "AutoFlow" per Google Flow/Veo ha aggiunto "Continue from Last Frame", che riutilizza automaticamente l'ultimo frame di una clip come primo frame della successiva, facilitando i video più lunghi. È prevista anche una funzione per renderizzare più clip senza soluzione di continuità in un unico video.
-
Thread #10 r/TopAITools4U · 1 pt · 10 commenti · 2026-09-01 — "Ho testato i 4 migliori generatori video IA del 2026 per principianti". L'autore confronta Sora 2 (cinematografico, ma ostacolato da prezzo e accesso), Kling AI (adatto a B-roll realistici), DomoAI (animazione e trasformazione stilistica) e Google Veo 3.1 (genera contemporaneamente video e audio, con piano gratuito). Nei commenti u/brarkaddy (2 pt) aggiunge Qwen come ulteriore opzione gratuita per video.
-
Thread #3 r/freetoolsAI · 38 pt · 45 commenti · 2026-09-04 — "Generatore di immagini IA gratuito". Alla presentazione di aifreeforever.com, descritto come gratuito, illimitato e senza registrazione, u/Odd-Lingonberry1516 (3 pt) risponde elencando Deepany (serie z-image turbo/illustrious), Aifun (wai illustrious e due generazioni video gratuite al giorno) e Perchance (serie Stable Diffusion/flux) come alternative. u/Relevant_Syllabub895 (2 pt) commenta il proprio malcontento per le restrizioni NSFW.
-
Thread #2 r/generativeAI · 43 pt · 29 commenti · 2026-08-31 — "Elenco di siti web quotidiani per la generazione di video IA". u/Jenna_AI (4 pt, bot IA) indica una quota gratuita concreta per Kling AI: 66 crediti gratuiti ogni 24 ore, pari a 2–6 video di 5 secondi al giorno. u/Julia_Leeds94 (2 pt) presenta YalleryLabs, con video di 5 secondi a 720p per 0,18 dollari ciascuno su un budget di 3 dollari.
-
Thread #12 r/EyesWideShut · 35 pt · 9 commenti · 2026-09-06 — "Le immagini generate dall'IA non dovrebbero essere consentite qui". In merito a uno screenshot di un film di Kubrick elaborato con IA, l'autore del thread accusa il post di diffondere disinformazione. La persona che ha realizzato l'elaborazione, u/ffcc01 (2 pt), ribatte di aver semplicemente sovrapposto due foto senza alterarne il contenuto. La community è divisa sul confine dell'accettabilità dell'elaborazione IA.
-
Thread #8 r/RemoteWorkers · 130 pt · 623 commenti · 2026-09-04 — "Guadagna 30 dollari l'ora revisionando immagini generate dall'IA". Annuncio per un'attività di fact-checking delle didascalie generate dall'IA, volta a rilevare oggetti, colori e testo riconosciuti in modo errato, retribuita 30 dollari l'ora. Pur avendo 623 commenti, in gran parte sono ripetizioni della parola "images" per ottenere il link di candidatura, senza una discussione sostanziale.
-
Thread #9 r/aislop · 37 pt · 4 commenti · 2026-09-06 — "L'ho visto in un articolo di notizie: un'immagine IA slop che spiega cos'è l'IA slop". L'immagine generata dall'IA, usata da un articolo per spiegare cosa sia l'"AI slop", è stata raccolta come ironia autoreferenziale. I soli quattro commenti non permettono un approfondimento.
Segnali
- Tendenza in crescita: i resoconti di implementazione della generazione locale e open source, come VPIPE/Krea 2 nel thread #4, sono accolti positivamente quando accompagnati da benchmark concreti — secondi, numero di step e hardware. In r/StableDiffusion, il compromesso tra velocità e qualità è il criterio di valutazione principale.
- Tendenza in crescita: le richieste di etichettatura dell'autenticità dei contenuti generati dall'IA, nel thread #1, hanno ricevuto un forte sostegno su scala di 994 commenti; il "falso timelapse" è stato nominato esplicitamente come nuova preoccupazione.
- Sminuito o deriso: le immagini IA commerciali closed source, specialmente per pubblicità alimentare, sono considerate di qualità difficile da difendere perfino in r/aiwars (thread #6); la discussione da 177 commenti è quasi interamente critica.
- Aspetto inatteso: in molti thread, i bot IA sono stati i veri protagonisti della discussione (u/Jenna_AI appare sia nel thread #2 sia nel #7); più che il confronto approfondito tra persone, il valore principale risulta essere l'elenco di informazioni pratiche come le quote gratuite.
- Contrasto: nel thread #12 (EyesWideShut), chi considera l'elaborazione IA sinonimo di alterazione/disinformazione e chi sostiene che una semplice composizione non cambi il contenuto si scontrano frontalmente; non esiste un consenso chiaro sui limiti accettabili.
- Aspetto inatteso: il thread #8 ha registrato l'engagement più alto, con 623 commenti, ma quasi tutti sono ripetizioni di una parola volte a ottenere un link di lavoro. È un esempio tipico di come il numero di commenti non equivalga alla profondità della discussione.
Limiti
- È stata usata solo la query "Image and Video Generation AI News"; non sono state effettuate ricerche aggiuntive con "open source image generation", "closed source video AI" o nomi di servizi specifici come Midjourney, Sora e Kling. I dati sono quindi sbilanciati verso gli argomenti intercettati da una query generica.
- Rispetto al criterio di completamento di brief.md, circa 20 thread per social, ne sono stati raccolti solo 12.
- I thread #7 e #9 hanno rispettivamente uno e quattro commenti, troppo pochi per un'analisi approfondita; in alcuni casi compare soltanto una risposta bot di u/Jenna_AI.
- Il periodo di raccolta copre solo circa una settimana, dal 2026-08-31 al 2026-09-06, e non consente confronti con tendenze precedenti.
- Solo un numero limitato di thread può essere classificato chiaramente lungo l'asse closed source/open source (più closed source: #6, #10, #11; più open source: #3, #4). Per raggiungere dieci osservazioni per categoria nel report finale è necessario integrare i dati delle altre piattaforme.
X
X — Notizie sull'IA per la generazione di immagini e video
Account
Tra 40 post raccolti da 37 account, solo i seguenti quattro erano realmente pertinenti al tema della generazione IA di immagini e video. Tutti sono account personali con un singolo post: non grandi account professionisti della viralità, ma persone che condividono un'esperienza diretta con gli strumenti.
| Account | Nome | Post | Like | Profilo |
|---|---|---|---|---|
| @aigeboku | AI様の下僕 | 1 | 1,281 | Persona che prova ComputerUse di GPT-6 Astra |
| @MiraMusic_AI | MiraMusic | 1 | 525 | Account dedicato alla produzione di anime IA |
| @manaimovie | Mankyu | 1 | 562 | Creatore indipendente su modelli 3D × video IA |
| @Yokohara_h | Hirokazu Yokohara | 1 | 2,156 | Maggiore reazione tra i quattro, professionista tecnico |
I restanti 33 account — guidati da @kaihavertz29 con 96.184 like e dedicati a calcio, F1, politica tedesca, Bitcoin e Bosnia — non erano pertinenti al tema. Vedere "Limiti" sotto per i dettagli.
Post
-
#29 @aigeboku (2026-09-05 · 1.281 like · 135 repost · 14 risposte · circa 94.000 visualizzazioni) https://x.com/aigeboku/status/2096187322924687799 — "Come dice il fatto che GPT-6 Astra è bravo a controllare gli altri, usando ComputerUse si amplia molto ciò che si può fare 😎🙌". Commento che valuta GPT-6 Astra non tanto come generatore di immagini e video, ma come base per controllare altre applicazioni.
-
#30 @MiraMusic_AI (2026-09-06 · 525 like · 50 repost · 6 risposte · circa 26.000 visualizzazioni) https://x.com/MiraMusic_AI/status/2096441679847006358 — "[Condivisione della produzione di anime IA #1] Ho provato a creare una città con GPT-6 Astra e blender! È un video fatto in 15 minuti, quindi forse non si capisce bene...". Esempio concreto di produzione di scenografie combinando GPT-6 Astra con Blender.
-
#31 @manaimovie (2026-09-05 · 562 like · 61 repost · 19 risposte · circa 35.000 visualizzazioni) https://x.com/manaimovie/status/2096176821377380677 — "Ho dato ad Astra un modello creato con Tripo e gli ho chiesto di animarlo: questo è il risultato. Ci sono ancora molti aspetti che mi preoccupano, ma è decisamente migliore di Fable o Sol!". Valuta la superiorità di Astra confrontandola esplicitamente con strumenti analoghi, "Fable" e "Sol".
-
#32 @Yokohara_h (2026-09-06 · 2.156 like · 299 repost · 19 risposte · circa 178.000 visualizzazioni, il maggiore riscontro tra i quattro) https://x.com/Yokohara_h/status/2096622171011666003 — "Gli ho dato un'immagine, ha modellato automaticamente in Blender gli edifici della città sullo sfondo e ha anche montato automaticamente il breakdown. La qualità è ancora lontana dall'essere buona, ma per la prima volta si sente l'inizio di un'era in cui la 3DCG non viene più realizzata dalle mani delle persone." Pur riconoscendo una qualità ancora acerba, il post valuta il cambiamento d'epoca verso una produzione 3DCG svincolata dal lavoro manuale.
Tra i 40 post raccolti, oltre a questi quattro non ce n'erano altri che menzionassero IA di generazione immagini o video, né closed source né open source.
Segnali
- Tendenza in crescita: GPT-6 Astra (closed source) attrae attenzione per il suo ruolo di controllo di altri strumenti — ComputerUse e integrazione Blender — ed è descritto non come singolo modello generativo, ma come hub che automatizza l'intera pipeline di produzione 3DCG (#29, #30, #32).
- Aspetto inatteso: tutti e quattro i post mantengono riserve come "la qualità è ancora grezza" o "ci sono molti aspetti che mi preoccupano", ma esprimono comunque una valutazione positiva; convivono aspettative elevate e giudizio lucido sulla qualità (#31, #32).
- Sminuito / non menzionato: non compare nessun riferimento a IA open source per immagini o video, inclusi Stable Diffusion, Krea, Kling e Veo. Le voci pertinenti su X sono interamente sbilanciate verso GPT-6 Astra, closed source.
- Strumenti citati come termini di confronto: "Fable" e "Sol" (#31). Il post non ne spiega i dettagli, perciò occorre ulteriore ricerca.
- La scala dell'engagement è piccola rispetto alle tendenze non pertinenti, come calcio con un massimo di 96.184 like e politica con 10.062; anche il massimo di 2.156 like non consente di definire questo tema virale su X al momento.
Limiti
- Le query non erano allineate al tema: le query usate — Arsenal, Kimi, Charles, Chelsea, Harvey, Germany, $SONG, Astra, Bitcoin, Bosnia — sono state prese direttamente dall'elenco Explore di X. A eccezione di "Astra", riguardavano calcio, F1, persone o compleanni, politica tedesca, criptovalute e conversazioni sulla Bosnia, non l'IA generativa di immagini e video. 36 post su 40 erano rumore non pertinente; i soli quattro utili sono emersi da "Astra".
- Criterio di completamento non raggiunto: rispetto alle circa 20 pubblicazioni richieste da brief.md per social, sono stati raccolti solo quattro post pertinenti.
- Localizzazione di Explore: la colonna "Where" indicava sia "$SONG" sia "Bosnia" come "Trending in Croatia". L'accesso Explore era dunque regionalizzato per Croazia/Balcani, non rappresentativo delle tendenze globali. Inoltre la colonna "Posts on X" era vuota per tutti i termini, quindi X non ha fornito la metrica del numero di post.
- Nessun movimento open source individuato su X: la raccolta non contiene post sull'IA open source per immagini e video. Va integrata con i dati di altre piattaforme, come Reddit.
- I quattro post pertinenti provengono tutti da account giapponesi; non sono state raccolte reazioni da comunità anglofone, cinesi o di altre lingue.
YouTube
YouTube — Notizie sull'IA per la generazione di immagini e video
Canali
| Canale | Tipologia | Contenuti trattati |
|---|---|---|
| AI大学【AI&ChatGPT最新情報】 | Giapponese, divulgazione | Video sui modelli IA più recenti, incluso GPT-6 Astra |
| まさおAI じっくり解説ch | Giapponese, divulgazione | Test pratici e recensioni di modelli IA |
| RKJ VIDEO【イケている動画を作りたいなら】 | Giapponese, specializzato in video IA | Confronti tra IA video come Sora/Veo/Kling |
| AI収益化ラボ | Giapponese, monetizzazione | Impatto della monetizzazione di strumenti IA e chiusure di servizi |
| StableDiffusion等 チュートリアル&自作アニメ | Giapponese, originariamente open source | Normalmente tutorial su Stable Diffusion, ma ora tratta anche notizie closed source come la fine di Sora2 |
| AIたろう | Giapponese, divulgazione | Spiegazioni delle funzioni di IA immagini come Midjourney |
| Teacher's Tech | Inglese, divulgazione | Recensioni di strumenti Google e funzioni IA |
| OpenArt | Inglese, quasi ufficiale | Video che presentano UI fornitrici di modelli come Flux.2 |
| Donato Capitella | Inglese, tecnico | Test di generazione immagini e video open source con GPU locali, comprese AMD |
| ErrorFixer | Inglese, tutorial | Tutorial di utilizzo di modelli open source in ComfyUI |
| AI Search | Inglese, recensioni | Recensioni rapide delle nuove IA per immagini e video |
Il numero di iscritti dei canali è visualizzato via JavaScript nelle pagine video e non è stato recuperabile tramite WebFetch di youtube.com/watch o youtube.com/results (vedere "Limiti"). Qui vengono riportate solo le informazioni verificabili negli snippet dei risultati di ricerca e in oEmbed, API leggera che restituisce esclusivamente titolo e nome del canale.
Video
-
"Spiegazione approfondita dell'ultimo modello IA di OpenAI, GPT-6 Astra! Supera Claude Fable 5.1 in quasi tutti i benchmark ed è il più intelligente e sicuro di sempre" — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=jtavLwXCZeQ — Sostiene che GPT-6 Astra, pubblicato il 3/9/2026, superi Claude Fable 5.1 in quasi tutti i benchmark e sia il modello più intelligente e sicuro mai realizzato. L'enfasi è sulle capacità di agente generalista, incluse navigazione browser e generazione di codice, più che sulla generazione diretta di immagini e video.
-
"[Il più forte nell'ambiente attuale] Dopo aver usato davvero GPT-6 Astra, lo considero il modello più vicino all'AGI: spiegazione" — まさおAI じっくり解説ch — https://www.youtube.com/watch?v=_pAAaBv_G7A — Dopo averlo testato, lo valuta come il più vicino all'AGI al momento. Esalta la capacità di ComputerUse di controllare altre app, in linea con la percezione di GPT-6 Astra osservata su X.
-
"VEO 3.1 o SORA2: quale è più impressionante? Confronto aggiornato!" — RKJ VIDEO【イケている動画を作りたいなら】 — https://www.youtube.com/watch?v=JuGPYl0V9UA — Confronta Veo 3.1, pubblicato il 15/10/2025, e Sora 2 in funzioni e qualità. Il video risale probabilmente a poco dopo il lancio di Sora 2 e quindi precede la finestra di 60 giorni, ma è stato incluso come contesto per le successive notizie di chiusura.
-
"Sora2 chiude completamente... perché è sparito all'improvviso? Spiegazione approfondita con informazioni ufficiali" — StableDiffusion等 チュートリアル&自作アニメ — https://www.youtube.com/watch?v=DSfAZdE5rWA — Spiega, su base ufficiale, che Sora 2 ha terminato Web/app il 26/4/2026 e terminerà le API il 24/9/2026, tre settimane dopo la data di questo report. Cita l'ipotesi che la ragione sia liberare risorse di calcolo per lo sviluppo dell'AGI.
-
"[Fine del servizio] Spieghiamo perché non è più possibile usare Sora2, la migliore IA video del mondo" — AI収益化ラボ — https://www.youtube.com/watch?v=YHPmaUb_X6c — Esamina l'impatto della chiusura di Sora2 sui creatori che monetizzavano i contenuti. Indica l'esportazione dei dati tramite sora.chatgpt.com/sunset e la necessità di migrare a API come Kling e Runway.
-
"Midjourney si aggiorna a V7! Spieghiamo completamente dall'uso alle nuove funzioni: possibile anche l'input vocale in giapponese." — AIたろう — https://www.youtube.com/watch?v=wFHlG7wcRUQ — Spiega le nuove funzioni di Midjourney V7, inclusi lo strumento di generazione video, la modalità conversazionale e l'input vocale in giapponese. Mostra come uno storico protagonista della generazione immagini stia incorporando funzioni testo→video.
-
"Il nuovo generatore di immagini Gemini è assurdo (Nano Banana 2)" — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Testa "Nano Banana 2", la funzione di generazione immagini di Google Gemini, e la valuta come un enorme passo avanti rispetto alla generazione precedente. Indica che la competizione closed source nelle immagini si sta estendendo da Midjourney/Ideogram anche a Google Gemini.
-
"FLUX.2 è arrivato su OpenArt!" — OpenArt — https://www.youtube.com/watch?v=ISRy5Skd04U — Presenta la disponibilità su OpenArt della famiglia Flux.2 di Black Forest Labs — Pro/Flex/Dev/Klein, annunciata il 25/11/2025. Sottolinea che Dev/Klein sono open weight Apache 2.0 e supportano dieci immagini di riferimento e editing a 4MP.
-
"Generazione video e immagini su AMD R9700 AI PRO (Qwen Image, Wan 2.2, Hunyuan 1.5)" — Donato Capitella — https://www.youtube.com/watch?v=a_xzC7ckwno — Testa insieme i tre modelli open source Qwen Image, Wan 2.2 e Hunyuan 1.5 su una GPU AMD consumer, R9700 AI PRO. Indica che la generazione open source sta progressivamente uscendo dal presupposto di hardware NVIDIA di fascia alta.
-
"Modifica qualsiasi immagine con il testo in ComfyUI — Qwen Image Edit 2511 (tutorial locale gratuito 2026)" — ErrorFixer — https://www.youtube.com/watch?v=ScoIZYsoRwo — Tutorial sull'uso locale in ComfyUI del modello open weight di editing immagini Qwen-Image-Edit-2511, rilasciato il 26/12/2025 da Alibaba. Mostra editing tramite sole istruzioni testuali e generazione multi-angolo.
-
"Questo nuovo editor di immagini IA è una BESTIA. Tutorial Qwen Image Edit" — AI Search — https://www.youtube.com/watch?v=WOcxMUwKWIk — Testa Qwen-Image-Edit, 20 miliardi di parametri con supporto nativo ControlNet, valutandolo competitivo con gli strumenti di editing closed source.
Segnali
- Il maggior tema closed source è GPT-6 Astra, pubblicato il 3/9/2026: viene presentato come agente generalista capace di controllare browser/app tramite ComputerUse ed eseguire task di editing video, non come puro modello per immagini o video. Questo coincide con la tendenza osservata su X, dove viene valutato come hub creativo connesso a Blender; la stessa narrativa appare su più piattaforme.
- La chiusura di Sora 2 è una delle maggiori notizie nel video closed source: Web/app sono terminati il 26/4/2026 e le API sono previste in chiusura il 24/9/2026. Più canali affrontano il perché della sparizione e dove migrare; al centro dell'interesse non ci sono più nuove funzioni di Sora2, ma il "cosa fare dopo".
- Kling è il concorrente per la posizione lasciata da Sora2: Kling 2.6, il 3/12/2025 con sincronizzazione audio, e Kling 3.0, il 4/2/2026 con 4K60fps e multi-shot, sono evoluti rapidamente e vengono citati direttamente come destinazione dopo la fine di Sora2.
- Qwen-Image-Edit è oggi il protagonista dell'editing immagini open source: i tutorial ComfyUI sono frequenti e spesso serializzati, con più visibilità dei nuovi tutorial su Stable Diffusion. I risultati relativi a Stable Diffusion sono soprattutto guide standard su installazione e liste di modelli, con minore rilevanza da notizia.
- La generazione video open source tende a organizzarsi in tre filoni: Wan 2.2 di Alibaba, Apache 2.0; HunyuanVideo 1.5 di Tencent; LTX-2 di Lightricks, pubblicato il 6/1/2026, primo modello aperto a generare insieme audio e video in 4K/50fps. Durante la ricerca sono emerse più pagine che affermavano la pubblicazione di open weight Wan 2.7, ma non esisteva sui repository ufficiali HuggingFace/GitHub di Wan-AI: è stata considerata informazione SEO falsa e Wan 2.2 resta l'open weight ufficiale più recente.
- I canali stanno attraversando i confini tra ecosistemi: il canale "StableDiffusion等 チュートリアル&自作アニメ", nato per tutorial Stable Diffusion, tratta anche la chiusura closed source di Sora2; questo suggerisce che il pubblico segua entrambi i fronti.
Limiti
youtube.com/resultseyoutube.com/watchrendono i contenuti lato client tramite JavaScript; WebFetch restituisce soltanto link di navigazione del footer e non consente di leggere direttamente titoli, canali, visualizzazioni o data di pubblicazione. La scoperta dei video dipende quindi dagli snippet WebSearch e dall'API YouTube oEmbed, che restituisce soltanto titolo e canale.- Per questo vincolo, non è stato possibile recuperare in modo affidabile le visualizzazioni e le date di pubblicazione precise. Per evitare invenzioni, il report non indica alcun numero di visualizzazioni. Le date restano stime basate su snippet o date pubbliche di rilascio dei modelli.
- Non è stato possibile applicare con rigore l'istruzione del playbook di privilegiare upload entro gli ultimi 60 giorni. Un solo video, il confronto VEO3.1×SORA2, sembra risalire al periodo del lancio di Sora 2, intorno a ottobre 2025, e supera la finestra, ma è stato incluso come premessa alle notizie di chiusura.
- Il criterio di brief.md di circa 20 post analizzati per social differisce formalmente da quello YouTube del playbook, pari a 5–12 video; questa sezione è stata quindi considerata completata secondo il playbook.
- Il contenuto dei commenti è stato verificabile solo nei frammenti comparsi nei risultati di ricerca; non sono state svolte lettura dei commenti principali né analisi del sentiment.
- I canali cinesi non sono stati inclusi. Qwen di Alibaba e Kling di Kuaishou sono entrambi modelli cinesi, quindi le reazioni delle community in cinese non sono rappresentate.
Bluesky
Bluesky — Notizie sull'IA per la generazione di immagini e video
Account
Sono state cercate le stringhe "Stable Diffusion", "Sora 2", "Midjourney", "Grok Imagine", "ComfyUI", "Veo 3" e "Nano Banana" tramite l'API pubblica di Bluesky (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts), estraendo gli account che parlavano effettivamente di IA per immagini o video.
| Account | Profilo | Relazione con il tema |
|---|---|---|
| @xai-bot.bsky.social | Bot ufficiale xAI | Annuncia novità su Grok Imagine, closed source |
| @codename.cc | Bot di tracciamento degli aggiornamenti app | Annuncia aggiornamenti alla funzione Imagine di Grok iOS |
| @drewkav.bsky.social | Artista indipendente | Condivide lavori con Gemini 3.1 Nano Banana 2 + Kling 3.0 |
| @triflingtree.bsky.social | Artista indipendente | Pubblica opere realizzate con Nano Banana Pro |
| @gentile-of-hope.bsky.social(希望の異邦人) | Privato, critico dell'IA generativa | Critica etica e ambientale a Stable Diffusion/ChatGPT/Gemini |
| @samperson.bsky.social | Privato, lato artisti | Amplifica il sostegno alla posizione anti-IA di Procreate |
| @ecutruin.bsky.social | Utente di generazione locale | Sostiene il vantaggio funzionale di strumenti locali come ComfyUI |
| @digitalhowl.bsky.social(Fenris) | Privato, creatore video | Condivide produzioni professionali con ComfyUI + Minimax H3 |
| @kerzefasta.bsky.social | Illustratore di fanart | Pubblica continuamente personaggi di 艦これ con Stable Diffusion WebUI reForge, ROCm |
| @aichina.news | Bot automatico | Pubblica in massa LoRA basati su FLUX, Apache-2.0, con engagement quasi nullo |
Nel complesso, chi pubblica effettivamente sul tema in Bluesky non è costituito da fonti di notizie, ma da due poli: creatori individuali che usano gli strumenti e persone critiche verso l'IA generativa. Non sono state trovate né community specialistiche né account di news comparabili a X o Reddit.
Post
-
@xai-bot.bsky.social (2026-09-05 · 0 like) https://bsky.app/profile/xai-bot.bsky.social/post/3mus2woiczo2w — "Grok Imagine Video 1.5 agent è ora disponibile. Alimentato dal nostro nuovissimo modello Image 2.0...". Annuncio ufficiale xAI del nuovo agente video Grok Imagine, closed source, ma senza like né repost visibili in questa ricerca.
-
@codename.cc (2026-09-06 · 0 like) https://bsky.app/profile/codename.cc/post/3muspbmaiq22n — "RILASCIATO: Grok iOS aggiornato alla 1.4.33 con miglioramenti a Chat, Voice e Imagine.". Registro di aggiornamento da un account personale che monitora le differenze delle app.
-
@drewkav.bsky.social (2026-09-06 · 9 like) https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k — Opera intitolata "Persistent Dream", realizzata usando Gemini 3.1 Nano Banana 2 per l'immagine fissa e Kling 3.0 per la conversione in video. Esempio di workflow che combina due strumenti closed source, Google × Kling.
-
@triflingtree.bsky.social (2026-09-06 · 15 like · 1 repost) https://bsky.app/profile/triflingtree.bsky.social/post/3mutz2tm3bc2m — Pubblicazione di un'"icona madre e figlio alieni" in stile bizantino, generata con Nano Banana Pro. È il post relativo a Nano Banana con più like in questa raccolta.
-
coah80.com (2026-09-06 · 0 like) https://bsky.app/profile/coah80.com/post/3muulvyomz72c — "SORA 2 ERA DAVVERO COSÌ SCARSO, COME ABBIAMO POTUTO DEFINIRLO BUONO". Stroncatura di Sora 2, closed source, coerente con il clima negativo e con la chiusura di Web/app il 26/4/2026 e delle API prevista per il 24/9/2026 osservate su YouTube.
-
@gentile-of-hope.bsky.social (2026-09-05 · 100 like · 42 repost) https://bsky.app/profile/gentile-of-hope.bsky.social/post/3murgar5zys2j — "Non solo Stable Diffusion: le funzioni di generazione immagini di IA come ChatGPT e Gemini si fondano su raccolta di dati non etica e su larga scala. (...) La generazione di immagini consuma enormi quantità di elettricità e acqua, distruggendo l'ambiente." È il post con più like nella raccolta e mostra come la critica all'IA generativa in sé, indipendentemente dall'essere closed o open source, generi il maggior engagement.
-
@samperson.bsky.social (2026-09-05 · 121 like · 11 repost) https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b — Amplificazione del sostegno alla posizione anti-IA generativa di Procreate, app di illustrazione. È il post con il maggior numero di like dell'intera raccolta.
-
@ecutruin.bsky.social (2026-09-06 · 1 like) https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t — "I software locali come ComfyUI hanno più funzioni della maggior parte delle soluzioni ospitate." Valutazione positiva del vantaggio funzionale dell'ambiente open source locale.
-
@digitalhowl.bsky.social (2026-09-06 · 0 like) https://bsky.app/profile/digitalhowl.bsky.social/post/3muuu24tqf22g — Dichiara di usare ComfyUI e Minimax H3 per "lavori video di livello professionale". Esempio di gestione ibrida, con base open source e modello commerciale.
-
@kerzefasta.bsky.social (2026-09-05–06 · più post, massimo 29 like · 10 repost) https://bsky.app/profile/kerzefasta.bsky.social/post/3muroxdlm4k2j — Pubblica in serie illustrazioni di personaggi di 艦これ con Stable Diffusion WebUI reForge e ROCm su GPU AMD. Non è un tema di notizie, ma è l'account che ha ottenuto l'engagement più continuativo nella ricerca "Stable Diffusion".
-
@aichina.news (2026-09-06 · 0 like, oltre 20 post simili all'ora) https://bsky.app/profile/aichina.news/post/3muup3wwiad2i — "LoRA Apache-2.0 per Flux, abbastanza piccolo da essere inserito in ComfyUI o Diffusers." Bot che pubblica meccanicamente grandi quantità di LoRA FLUX per Huawei Ascend/Modelers.cn senza parole chiave di attivazione né esempi. Aumenta il volume dei risultati open source, ma non alimenta discussione reale.
Segnali
- Closed source: Nano Banana, Gemini 3.1/Nano Banana Pro, è il nome più frequente nelle produzioni reali di creatori individuali. Più post confermano un workflow specializzato: immagine fissa con Nano Banana e video con un altro strumento, Kling 3.0.
- Closed source: il nuovo modello Grok Imagine, Video 1.5 / Image 2.0, è stato annunciato dall'account ufficiale ma ha ottenuto zero like e repost; gli annunci in stile comunicato stampa sembrano perdersi su Bluesky.
- Closed source: gli unici riferimenti a Sora 2 erano pesantemente negativi, senza post difensivi. Questo è coerente con la chiusura osservata nella sezione YouTube.
- Open source: gli utenti che usano davvero ComfyUI lo valutano positivamente per un vantaggio concreto: i sistemi locali offrono più funzioni dei servizi hosted.
- Open source / rumore: gran parte dei risultati per "Stable Diffusion", "Flux" e termini simili consistevano in tre categorie: fanart, link esterni a contenuti NSFW e bot automatici di annunci LoRA senza reazioni come @aichina.news. Le discussioni con vero valore informativo erano poche.
- Il massimo engagement è la critica all'IA generativa: i due post con più like, 121 e 100, criticano o rifiutano l'IA generativa in generale, superando di gran lunga i post sull'uso degli strumenti, il cui massimo era 15 like. La base utenti Bluesky sembra far emergere voci anti-IA più forti rispetto a X e Reddit.
Limiti
- Limiti API: l'endpoint
public.api.bsky.appha restituito 403 per tutte le richieste. L'alternativaapi.bsky.appfunzionava, ma ha restituito frequentemente 403 per rate limit dopo più nuove query ravvicinate; quasi metà delle query tentate, come "Kling AI", "Wan2.2", "HunyuanVideo", "Qwen Image", "Krea" e "Sora shutdown", non ha prodotto dati. - Impossibile recuperare la UI Web:
bsky.app/searchè una SPA renderizzata in JavaScript; WebFetch restituisce solo il meta titolo e, in pratica, l'API è stata l'unica fonte dei post. - Numero insufficiente: a fronte dell'obiettivo di circa 20 post, sono stati verificati nel contenuto solo circa 11. I risultati API contenevano molto rumore non pertinente, per esempio personaggi di Kingdom Hearts per la ricerca "Sora" e post di bot che aggregano hashtag.
- Limiti delle metriche di engagement: l'API pubblica restituisce like, repost e risposte, ma non le visualizzazioni come X. La reale portata delle pubblicazioni resta sconosciuta.
- Fallimento nel recupero dei dettagli: tentando di ottenere il contenuto completo del post di samperson.bsky.social con
app.bsky.feed.getPostThreadè stato ricevuto un errore 400; oltre allo snippet nei risultati di ricerca non è stato possibile verificarne il testo integrale. - Bias degli account: i risultati erano concentrati in account specifici — fanart di 艦これ da @kerzefasta.bsky.social e annunci LoRA automatici di @aichina.news — e non possono rappresentare l'opinione di un'ampia base utenti.
Lemmy
Lemmy — Tendenze più recenti dell'IA per immagini e video
Community
- !«メールアドレス» — 5.708 iscritti, 1.386 post. Principale punto di aggregazione reale per IA open source di immagini e video: modelli, nodi ComfyUI, LoRA e altro. Quasi ogni giorno vengono pubblicati nuovi strumenti o modelli. https://lemmy.dbzer0.com/c/stable_diffusion
- !«メールアドレス» — 2.361 iscritti, 3.500 post. Luogo per opere realizzate con Stable Diffusion/modelli open weight; ha minore valore di notizia e un taglio più da galleria. https://lemmy.dbzer0.com/c/stable_diffusion_art
- !«メールアドレス» — 4,82K iscritti, circa 1,8K iscritti locali su lemmy.world. Dedicata all'IA libera/open source nel suo complesso, con pochi post specifici su immagini e video. https://lemmy.world/c/fosai
- !«メールアドレス», !«メールアドレス», !«メールアドレス» — Qui arrivano notizie sulle aziende IA closed source come Midjourney. Non sono community dedicate alle "notizie sull'IA di generazione immagini", ma community generiche tech/news dove questi argomenti appaiono saltuariamente.
Post
Più orientati all'open source (soprattutto !«メールアドレス»)
- MiniMax-H3_Singularity — Modello di fusione fine-tuned per il modello video MiniMax-H3. Score 3, 2026-09-06. https://lemmy.dbzer0.com/post/75088455 (origine: https://huggingface.co/WarmBloodAban/Minimax-h3_Singularity)
- Qwen3.8-Flash-Next-NVFP4 — Versione quantizzata NVFP4 del modello Qwen di NVIDIA. Score 3, 2026-09-06. https://lemmy.dbzer0.com/post/75088454 (https://huggingface.co/nvidia/Qwen3.8-Flash-Next-NVFP4)
- ComfyUI-AetherScale — Nuova estensione per ComfyUI. Score 5, 2026-09-05. https://lemmy.dbzer0.com/post/75036491 (https://github.com/vizart-vj/ComfyUI-AetherScale)
- Viggle-Animate — Modello di editing video che sostituisce un personaggio in un video a partire da una sola immagine ridipinta. Score 9, il massimo in questo gruppo, 2026-09-05. https://lemmy.dbzer0.com/post/75036488 (https://huggingface.co/Viggle/Viggle-Animate)
- FastH3-Ref2V-Stream-Controller — Controller ComfyUI per la generazione continua di video. Score 2, 2026-09-04. https://lemmy.dbzer0.com/post/74988027 (https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller)
- ComfyUI-Majoor-OmniCam — Strumento per layout e animazione della camera in ComfyUI. Score 4, 2026-09-04. https://lemmy.dbzer0.com/post/74988020 (https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam)
- H3-World — Presentato come "il primo modello di mondo interattivo basato su MiniMax-H3". Score 3, 2026-09-02. https://lemmy.dbzer0.com/post/74893520 (https://huggingface.co/DANNY621/H3-World)
- ComfyUI-MiniMaxH3-CLSS — Nodo che permette generazione video con audio di durata arbitraria con 16GB di VRAM. Score 0, 2026-09-01. https://lemmy.dbzer0.com/post/74843957 (https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)
- Trellis.2 and Pixal3D Now Native in ComfyUI — I modelli 3D generativi Trellis.2 e Pixal3D sono integrati nativamente in ComfyUI. Score 4, 2026-09-01. https://lemmy.dbzer0.com/post/74843948 (https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native)
- ComfyUI-DLSS5-NR — Supporto sperimentale ComfyUI per il neural rendering di NVIDIA DLSS 5. Score 2, 2026-09-01. https://lemmy.dbzer0.com/post/74843949 (https://github.com/lisitskyaa/ComfyUI-DLSS5-NR)
- LLaDA-Image — Articolo di ricerca arXiv sulla generazione immagini con modelli di diffusione. Score 3, 2026-09-04. https://lemmy.dbzer0.com/post/74988021 (https://arxiv.org/abs/2609.03796)
Più orientati al closed source
- Midjourney passa dalla generazione di immagini IA alla body scan medical spa — Secondo quanto riportato, Midjourney passa dalla generazione immagini IA a un'attività di body scan medico a ultrasuoni, "Midjourney Medical". Score 58, 2026-06-18, !«メールアドレス». https://lemmy.zip/post/66397234 (articolo originale: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/)
- Midjourney AI passa a Theranos: CT a ultrasuoni — Commento critico alla stessa notizia. Score 40, 2026-06-19, !«メールアドレス». https://awful.systems/post/8731127 (https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
- Midjourney Medical / Midjourney Ultrasonic CT Scanner — Due post con link diretto alla pagina ufficiale Midjourney. Score 3 e 2, 2026-06-18, !«メールアドレス». https://lemmy.bestiver.se/post/1175129 / https://lemmy.bestiver.se/post/1175130
- Midjourney chiede agli studi di Hollywood di rendere pubblici i dettagli dell'uso dell'IA — Articolo su Midjourney che chiede agli studi hollywoodiani trasparenza nell'uso dell'IA. Score 73, 2026-07-05, !«メールアドレス». https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
Segnali
- L'energia relativa all'IA di immagini e video su Lemmy è quasi interamente concentrata nell'open source. Il centro è
!«メールアドレス», dove gli strumenti vengono pubblicati quasi ogni giorno, da 3 a 9 al giorno, attorno all'ecosistema video "MiniMax-H3": LoRA, nodi ComfyUI, accelerazione VAE, motion cache e così via. Nella stessa community compaiono versioni quantizzate di Qwen e articoli come LLaDA-Image. - Sul lato closed source, l'unico blocco coerente di discussione riguarda la notizia di giugno 2026 secondo cui Midjourney sarebbe passata dalla generazione immagini alle scansioni mediche a ultrasuoni. Ripubblicata su più istanze — lemmy.zip, awful.systems e lemmy.bestiver.se — ha generato punteggi da 40 a 73, relativamente alti per il tema. Al contrario, non risultano quasi tracce su Lemmy delle principali release 2026 di Sora, Veo, Kling, Runway, Nano Banana o Flux.2 come notizie in sé.
- Le ricerche Lemmy per "Veo 3" e "Kling AI" non hanno prodotto alcun post; anche la query combinata "Runway/Kling/Veo/Gemini image" non ha trovato risultati. Gli utenti Lemmy sembrano reagire più agli strumenti concretamente utilizzabili in ComfyUI — nodi, LoRA e ottimizzazioni — che agli annunci dei nuovi modelli.
Limiti
- Lemmy ha pochi utenti e post e non esiste una community specialistica che tratti le "notizie" sull'IA di immagini/video. La fonte reale è una sola community,
!«メールアドレス», per l'open source, insieme ad articoli sporadici su aziende closed source in community tech generiche. - L'obiettivo di circa 20 post analizzati non è stato raggiunto: 11 post di strumenti open source e 4 articoli Midjourney closed source, per un totale di 15. Le ricerche tramite API lemmy.world e Web non hanno trovato post su Sora, Veo, Kling, Runway, Nano Banana, Flux.2 e altre release principali del 2026; il fatto che non siano stati trovati viene riportato esplicitamente.
- La pagina della community
/c/stablediffusiondi lemmy.world restituiva errore HTTP 500 e non è stata visualizzabile direttamente, anche se l'API di ricerca ha fornito un'alternativa.
Pinterest — Notizie sull'IA per la generazione di immagini e video
Sono stati esaminati tutti i 50 pin (output/pinterest.pins.md / images/pinterest/manifest.json). Non c'era suddivisione per genere e la raccolta deriva dalla singola query "Image and Video Generation AI News".
Temi visivi
- Il look cyber navy × neon, blu, viola e rosa è diventato un template: sfondi pieni di linee circuitali, bagliori di particelle e sfere/nodi da rete neurale, nelle miniature più tipiche dell'IA. [1, 2, 5, 7, 11, 13, 14, 17, 18, 20, 26, 30, 38, 40]
- Ripetizione del visual "presentatore di notizie IA": ricorre più volte l'inquadratura di un androide bianco, o di un volto per metà umano e metà macchina, in abito da presentatore dietro un desk. L'impressione è quella di una produzione in serie con solo il brand sostituito. [4, 32, 34, 37, 42]
- Le infografiche di confronto e ranking di strumenti sono il formato più frequente: liste "Best AI Video Generators" con Runway, Pika, Kling AI, Luma (Dream Machine), Canva AI, Hailuo AI, Synthesia, InVideo AI, HeyGen, Vidu AI, PixVerse, Google Veo, OpenAI Sora e Adobe Firefly, quasi sempre gli stessi nomi. [9, 19, 28, 33, 36, 46]
- Griglie demo che trasformano una singola immagine/video in più stili: la stessa persona, un panda in costume o una Tesla vengono trasformati in blocchi di legno, origami, Lego o fiori, in composizioni prima/dopo che promuovono la coerenza. [8, 25, 44]
- Contenuti su ansie e rilevamento dei deepfake: immagini di gatti con timbro "FAKE", quiz "Which is AI?", presentazioni di strumenti per rilevare immagini/testo IA e infografiche che avvertono che vedere non significa più credere. [4, 12, 18, 26, 47]
- Schede datate di notizie "AI News Roundup": formato rapido che riunisce più temi con titolo e punti elenco, ad esempio Google I/O 2026, IA per le chiamate al 911 e stack IA nordcoreano. [21, 29, 31, 35]
- Vetrina di arte IA generica, fuori tema: compaiono anche pin promozionali di sole opere senza valore di notizia — una scultura di marmo che suona il violoncello, ritratto di un anziano pescatore e simili — pensati per pubblicizzare gli strumenti. [49, 50]
- Lo sfondo scuro con testo neon è la norma, mentre le infografiche aziendali su fondo bianco, blu corporate e design piatto sono minoritarie. [3, 10, 27, 33]
Pin degni di nota
- [11] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Presentazione di prodotto concreto che promuove generazione immagine→video e audio nativo con Veo 3 tramite Gemini API.
- [16] Google Unveils Veo 2 — Griglia promozionale di Veo 2 dal tono ufficiale Google, con molti esempi generati: scienziata al microscopio, nuoto, ragazza in stile anime e altro.
- [25] Google announces Veo 3 — Demo di un mostro viola coerente in ambienti diversi. La composizione, con un'immagine d'origine e tre video generati, sottolinea la coerenza del personaggio.
- [29] Today's AI News: MAY 20, 2026 — Speciale Google I/O 2026. Elenca Gemini 3.5 Flash, Gemini Omni, Gemini Spark, l'IA di accessibilità Apple e la competizione sugli smart glasses Android XR.
- [35] The Latest AI Developments — Notiziario in tre parti: IA che risponde alle chiamate 911 a New Orleans, Meta che pubblica il modello offline Muse Glimmer e il gruppo nordcoreano Kimsuky che automatizza phishing con il proprio stack IA.
- [44] Microsoft Unveils VASA-1 — Presentazione del modello che genera video di un volto parlante da una singola immagine fissa, un clip audio e, facoltativamente, segnali di controllo, illustrata con una griglia di molti volti.
- [48] ShengShu Technology Unveils Vidu S1 — Vidu S1, presentato come modello all'avanguardia per interazioni IA in tempo reale, con visual multi-volto in stile cyberpunk.
- [8] Demo di trasformazione stilistica coerente, tipo Luma — Griglia di confronto di cinque varianti dello stesso soggetto, animale o automobile: blocchi di legno, origami, Lego e fiori. È una demo tecnicamente convincente.
- [46] Future of Video Creation: Best AI Video Generators of 2026 — Ranking aggiornato che cita anche le versioni: Pika 2.5, HeyGen, Google Veo 3.1, Runway Gen 4.5, Kling 3.0, Adobe Firefly e Seedance 1.5 Pro.
- [20] More than 20% of YouTube is now AI-generated — Pin semplice, formato da un titolo con una statistica specifica, che simboleggia la penetrazione dei contenuti IA.
Segnali
- È visibile la corsa tra generazioni di modelli: Veo 2→3→3.1, Kling AI→3.0, Runway Gen-3→Gen 4.5, Pika 2.5 e Seedance 1.5 Pro ricorrono spesso, indicando un ciclo di miglioramento molto rapido nell'IA video. [16, 25, 11, 46]
- I prossimi fuochi sono agenti, tempo reale e offline: strumenti a pipeline che automatizzano con un clic scouting→sceneggiatura→generazione→editing ([24]), Vidu S1 per interazioni in tempo reale ([48]) e Meta Muse Glimmer offline ([35]) mostrano il passaggio dal semplice "generare" a agenti, real time e on-device.
- L'impiego pratico e l'abuso dell'IA stanno diventando temi ricorrenti: compaiono notizie su IA nei sistemi di emergenza ([35]) e sull'abuso da parte di attori statali, come la Corea del Nord ([35]), oltre la sola generazione di contenuti.
- Esposizione oligopolistica di strumenti commerciali closed source: nei pin di ranking ricorrono Google Veo, OpenAI Sora, Runway, Kling AI, Adobe Firefly, Pika, Luma, HeyGen e Synthesia; i modelli open source — Stable Diffusion, AnimateDiff, Open-Sora e workflow ComfyUI — sono quasi assenti. "Amuse 3.0" ([50]), che promuove l'esecuzione locale su AMD Ryzen AI, è una rara eccezione.
- Debole collegamento alle fonti primarie: solo una piccola parte dei 50 pin suggerisce un link diretto a blog ufficiali o paper tecnici, come i pin dal tono ufficiale Veo [16][25] e Microsoft VASA-1 [44]. La maggioranza proviene da blog affiliati, articoli SEO o miniature commerciali Fiverr come [45]; Pinterest funziona più come luogo dove vendere strumenti che dove seguire notizie.
- L'ansia da deepfake è diventata contenuto standardizzato: strumenti di rilevamento e quiz per distinguere le immagini formano un genere indipendente; l'ansia sulla fiducia nei contenuti viene consumata più dei progressi tecnici stessi. [4, 12, 18, 26, 47]
Limiti
- Questa fase ha previsto soltanto la lettura delle immagini raccolte in anticipo dal worker via browser headless; non sono state eseguite ulteriori ricerche o scroll direttamente su Pinterest, secondo la procedura del playbook.
- La raccolta usa un'unica query senza suddivisione per genere: non sono state cercate separatamente soluzioni closed source e open source. Il fatto che quasi non compaiano pin open source potrebbe riflettere Pinterest, ma non si può escludere che una ricerca mirata ne avrebbe trovati.
- Due pin hanno titolo
(untitled); per [12] si poteva comunque leggere sostanzialmente il contenuto "Which is AI?", mentre altri restavano difficili da identificare. - Non sono stati aperti i singoli URL dei pin,
pinterest.com/pin/...; l'analisi deriva soltanto da immagini e titoli e non ha verificato testo delle pagine di destinazione, commenti o metriche come salvataggi. - [49], la scultura di marmo che suona il violoncello, è un pin promozionale di arte IA generica con scarsa attinenza al tema e non è stato trattato come conoscenza informativa.
Azioni consigliate
- Per workflow dipendenti da Sora2, pianificare la migrazione a Kling 3.0 o Veo 3.1 prima della chiusura dell'API il 24/9/2026.
- Monitorare ComputerUse di GPT-6 Astra come strumento per automatizzare l'intera pipeline produttiva, non come IA generativa isolata.
- Per ridurre i costi, testare l'editing locale con Qwen-Image-Edit + ComfyUI prima di pagare strumenti closed source.
- Preparare regole di disclosure sull'uso dell'IA nei contenuti pubblici, in vista dei rischi di etichettatura dell'autenticità e polemiche sui falsi timelapse.
- Verificare il workflow specializzato Nano Banana per le immagini fisse + Kling 3.0 per la video-conversione.
- Continuare a seguire la diversificazione di Midjourney dalla generazione immagini ai dispositivi medici, come possibile indicatore anticipatore di mosse analoghe tra aziende closed source.
Immagini raccolte


















































Nota sulla qualità dei dati
Nessuna delle sei piattaforme ha raggiunto il criterio di completamento di brief.md, circa 20 contenuti per social. In particolare, X ha prodotto quattro elementi pertinenti su 40 post; Bluesky si è fermato a 11 per rate limit 403; Lemmy a 15 per l'assenza di una community specialistica di notizie. Tuttavia, le principali tendenze — GPT-6 Astra, la fine di Sora2 e l'espansione dell'ecosistema ComfyUI — sono confermate indipendentemente da più piattaforme.



