Notizie sull’IA per la generazione di immagini e video — 2026-09-05
GPT-6 "Astra" ha dominato questa settimana il dibattito sui modelli closed-source su X e Bluesky, mentre i modelli open-source per video e immagini (LTX-2.5, MiniMax H3, Qwen-Image-3.0) hanno tenuto il passo quasi interamente nell’ecosistema ComfyUI. La notizia più rilevante in assoluto è stata però Midjourney, che ha abbandonato la generazione di immagini per orientarsi verso hardware per ecografie mediche.
Riepilogo delle notizie sull’IA per immagini e video — closed vs open — 2026-09-05
Ciao! Questa settimana il mondo dell’IA per immagini e video è stato davvero caotico www🔥 Sul fronte closed-source, GPT-6 "Astra" di OpenAI ha fatto il pieno di attenzione su X (ex Twitter), superando 100 milioni di visualizzazioni😳 Nel frattempo, anche l’open source non è rimasto a guardare: modelli potentissimi come LTX-2.5, MiniMax H3 e Qwen-Image-3.0 sono usciti uno dopo l’altro come open weights, e ComfyUI si sta affermando come una vera nave madre🛠️ Un’altra notizia sottotraccia ma clamorosa: Midjourney avrebbe lasciato la generazione di immagini per trasformarsi in un’azienda di scanner ecografici medicali😱 Davvero sorprendente. Questa volta è emerso anche che, su Reddit, le discussioni sul trattamento legale dei contenuti generati dall’IA hanno colpito più delle innovazioni tecniche.
Tra le piattaforme
- Festa per GPT-6 Astra: è diventato subito un tema di conversazione sia su X sia su Bluesky, inclusa l’abituale prova con l’immagine del pellicano di Simon Willison. X: https://x.com/OpenAI/status/2095595741528125780 / Bluesky: https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c . È curioso che, pur non essendo commercializzato come IA per immagini/video, tutti lo stiano testando per modellazione 3D e animazione😂
- ComfyUI come base di fatto dell’open source: su YouTube e Lemmy, Wan, FLUX, Qwen-Image, LTX-2.5, MiniMax H3 e Trellis.2 vengono tutti discussi insieme a ComfyUI. YouTube: https://www.youtube.com/watch?v=3BFDcO2Ysu4 / Lemmy: https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
- Il problema di MiniMax H3: “aperto”, ma commerciale a pagamento: se ne parla anche su Lemmy: pur essendo un modello video eseguibile persino su una RTX 3060, richiede una licenza a pagamento tramite Comfy https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller . Il confine tra open e closed si sta davvero sfumando🤔
- Le polemiche e le svolte attirano più della tecnologia: fenomeno visibile sia su Reddit, dove una sentenza sull’abuso sessuale infantile generato dall’IA ha ricevuto oltre 800 commenti https://www.reddit.com/r/news/comments/1w5k6pr/ , sia su Lemmy, dove il pivot di Midjourney verso dispositivi medici ha ottenuto punteggi fra 58 e 73 https://lemmy.zip/post/66397234 .
Piattaforma per piattaforma
Reddit: il riepilogo mensile di r/StableDiffusion, con moltissimi rilasci di modelli open come Qwen3.8, DeepSeek-V4-Pro, Ling-3.0 e Gemma-4-31B, è un thread imperdibile https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/ . Da segnalare anche Atlas di World Labs, che genera immediatamente mondi 3D da video o fotografie, con possibili applicazioni nella robotica https://www.reddit.com/r/accelerate/comments/1w5ye9s/ . Ma il thread con più trazione non era tecnico: riguardava la sentenza secondo cui la pornografia infantile generata dall’IA sarebbe costituzionalmente protetta. Reddit sembra accendersi più per diritto ed etica che per la tecnologia.
X: la ricerca ha restituito soltanto quattro post su Astra, rendendo GPT-6 Astra il protagonista assoluto🎤 Il post tecnicamente più concreto è il demo di uno sviluppatore, @Dimillian, su una pipeline 3D da Blender a UE5 https://x.com/Dimillian/status/2095596700815516004 . Nel perimetro di ricerca non è emerso neppure un post su open source come Stable Diffusion, Flux o Wan: una lacuna importante.
YouTube: sul lato closed-source abbondano recensioni comparative di Nano Banana 2, Kling 3.0 vs Veo 3.1 vs Sora 2 e Seedance 2.5/Seedream 5.0 Pro https://www.youtube.com/watch?v=AAD7wJ3DWiA . Sul lato open, LTX-2.5, capace di generare 10 secondi a 720p in 6,8 secondi https://www.youtube.com/watch?v=RjlbDhs1MPk , e HunyuanImage 3.0, un MoE da 80 miliardi di parametri https://www.youtube.com/watch?v=U-8RjjU7x14 , mostrano che gli open weights vengono ormai confrontati con i sistemi closed subito dopo l’annuncio. Si è parlato anche della chiusura della Sora API da parte di OpenAI e della concentrazione delle risorse sul modello successivo, “Spud” (il video YouTube non è stato verificato direttamente; informazione emersa tramite notizie).
Bluesky: l’immancabile “benchmark dell’immagine del pellicano” di Simon Willison è diventato un osservatorio costante della qualità dei modelli closed-source https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c . L’account ufficiale di Replicate funziona da hub per annunci rapidi di modelli video come Kling 3.0, Seedance 2.0, Runway Gen-4.5 e Vidu Q3 https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c . Le fonti primarie open source sono quasi assenti; persino ostris, sviluppatore di strumenti LoRA, afferma che la comunità AI/ML è rimasta quasi tutta su X😅 In giapponese si trova soprattutto la condivisione dell’articolo GIGAZINE su Qwen-Image-3.0 https://gigazine.net/news/20260722-qwen-image-3/ .
Lemmy: !«メールアドレス» è la comunità con la maggiore densità informativa sull’open source. I contenuti su MiniMax H3, inclusa la rivendita commerciale da parte di Comfy https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller e gli strumenti per farlo funzionare con 16 GB di VRAM, rappresentavano quasi metà dei post. È interessante anche LLaDA-Image, con ricetta di addestramento interamente pubblica https://arxiv.org/abs/2609.03796 . Sul fronte closed, non sono i nuovi modelli ma il presunto pivot di Midjourney da generazione di immagini a scanner ecografici medici ad aver ottenuto punteggi eccezionalmente alti (58–73), diventando il principale interesse degli utenti Lemmy.
Pinterest: visivamente prevalgono nettamente i prodotti closed-source: Google Veo 2/3, Microsoft VASA-1, Grok 4.6 e Gemini oltre il miliardo di utenti sono il materiale delle immagini-riepilogo. Tra i nomi open specifici è comparso quasi solo lo strumento locale di AMD, “Amuse 3.0”. Molto frequenti anche gli usi legati al viso — lip sync, ricostruzione dell’espressione e generazione di ritratti — probabilmente perché ben allineati con il pubblico Pinterest, interessato a bellezza e idee per post sui social.
Da tenere d’occhio
- Novità su GPT-6 Astra orientate a immagini/video — X, https://x.com/flowith/status/2095750768204877858 (anteprima di un confronto di animazione GPT-6 Astra vs GPT-5.6)
- Chiusura della Sora API → modello successivo “Spud” — secondo YouTube, chiusura prevista per il 24 settembre 2026. Nessuno ha ancora verificato immagini o funzionalità reali.
- Evoluzione delle licenze commerciali di MiniMax H3 — Lemmy, https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller (si consoliderà un modello ibrido: open weights, ma uso commerciale a pagamento?)
- Pivot di Midjourney nei dispositivi medici — Lemmy, https://lemmy.zip/post/66397234 (un importante attore closed-source lascerà davvero la generazione di immagini?)
- Ricetta di addestramento completamente aperta di LLaDA-Image — Lemmy/arXiv, https://arxiv.org/abs/2609.03796 (fino a che punto verrà replicato un modello open ai vertici di Qwen-Image-Bench?)
- Atlas di World Labs — Reddit, https://www.reddit.com/r/accelerate/comments/1w5ye9s/ (come la generazione video→mondo 3D sarà riutilizzata per dati di addestramento robotico?)
Raccomandazioni
- Conviene ripetere la raccolta su X non basandosi sui trend, ma con termini specifici come “Stable Diffusion”, “ComfyUI”, “Flux”, “Wan”, “Kling” e “Sora”.
- Poiché l’API
searchPostsdi Bluesky ha restituito 403, la prossima volta sarebbe più efficiente ampliare in anticipo un elenco di account noti tramite ricerca Google. - I modelli come MiniMax H3, con open weights ma licenze commerciali a pagamento, dovrebbero essere annotati esplicitamente anziché classificati semplicemente come “open”.
- Notizie di disimpegno o riconversione dei grandi operatori, come il pivot di Midjourney e la fine di Sora, meritano una sezione di monitoraggio ricorrente: attirano l’interesse dei lettori più delle sole novità tecniche.
- Pinterest ha poche fonti primarie: è più utile come termometro della percezione dei consumatori che come fonte per seguire trend tecnici.
- La tendenza emersa su Reddit e Lemmy — decisioni giudiziarie e controversie etiche che fanno più rumore delle notizie tecniche — merita di essere raccolta come segnale separato anche nei prossimi briefing.
Qualità dei dati
- X: i post raccolti erano basati su trend geolocalizzati nell’area croata; oltre ai quattro post su GPT-6 Astra, il resto era rumore irrilevante, come criptovalute, contenuti su Elon e sport. Non ci sono riferimenti open source e il requisito di analizzare 20 post non è stato raggiunto.
- Bluesky: l’API di ricerca ufficiale ha restituito 403, quindi il metodo è stato cambiato controllando singolarmente i feed di account noti. I post direttamente rilevanti sono stati circa 12 e le fonti primarie open source quasi non sono emerse.
- Reddit: con un solo termine di ricerca sono stati trovati 12 thread in 9 subreddit, meno della soglia di 20. Sono stati tuttavia registrati fino a sei commenti principali per thread.
- YouTube: poiché risultati di ricerca e pagine video sono renderizzati in JavaScript, non è stato possibile verificare direttamente visualizzazioni, iscritti e date di pubblicazione esatte; le date sono stimate dalle diciture relative negli snippet.
- Lemmy: essendo federato, la ricerca su una singola istanza può perdere post provenienti da altre istanze. Le ricerche dirette di servizi video closed come Sora, Kling e Veo hanno dato quasi nessun risultato.
- Pinterest: sono state aperte e verificate soltanto 24 immagini su 50; per le restanti sono stati letti solo i titoli. I dati raccolti non includono metriche di coinvolgimento come like e salvataggi.
Riepilogo per piattaforma
Reddit — Notizie sull’IA per la generazione di immagini e video
Dove
I 12 thread raccolti provengono da 9 subreddit. È stato utilizzato un solo termine di ricerca: “Image and Video Generation AI News”.
| Subreddit | Iscritti | Thread raccolti |
|---|---|---|
| r/generativeAI | 150,575 | 4 |
| r/GrokAiDiscussion | 4,883 | 1 |
| r/freetoolsAI | 7,616 | 1 |
| r/StableDiffusion | 1,000,814 | 1 |
| r/accelerate | 77,800 | 1 |
| r/news | 31,531,475 | 1 |
| r/antiai | 313,317 | 1 |
| r/allthequestions | 127,064 | 1 |
| r/teenagers | 3,673,210 | 1 |
r/generativeAI è il subreddit con più elementi (4), principale luogo per post informali sulla ricerca e il confronto di strumenti. Gli altri subreddit contribuiscono un post ciascuno; è rilevante che l’argomento sia arrivato anche in comunità non specializzate in immagini/video, come r/news e r/teenagers.
Cosa dicono le persone
- #4 r/StableDiffusion “Local AI News You Missed - August 2026” (201 pt, 22 commenti, 2026-08-31, https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/) — riepilogo mensile che segnala moltissimi rilasci open source in agosto, fra cui Qwen3.8, DeepSeek-V4-Pro-0813, la serie Ling-3.0 e Gemma-4-31B. I commenti aggiungono continuamente modelli: u/Narutobirama(20) scrive “You probably missed Qwen3.8 Flash Next.” e u/MoJaKF(14) “Anima-3.8B its already on its 1.1 release that just released 3h ago”, mostrando un ritmo troppo rapido persino per il post di riepilogo.
- #5 r/accelerate “…They built an AI that looks at a few casual real-world videos or photos and instantly turns them into a full 3D playground” (763 pt, 76 commenti, 2026-09-03, https://www.reddit.com/r/accelerate/comments/1w5ye9s/) — Atlas di World Labs genera mondi 3D interattivi da video/foto. Le reazioni, come u/stainless_steelcat(48), “Matrix bullet time comes to real life...now I know it wasn't ambitious enough.”, sono entusiaste; si discute della possibilità di trasformare la generazione video in dati di addestramento per la robotica.
- #6 r/generativeAI “Same prompt. Same 30 seconds. Two different AI video models.” (98 pt, 30 commenti, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) — confronto fra Seedance 2.5 e Wan 3.0 con lo stesso prompt. u/SpecialistDragonfly9(5) considera Seedance “by FAR superior”, mentre u/Positive-Key6640(4) obietta che confronti con lo stesso prompt misurano più l’affinità di un modello con uno stile di prompt che la sua qualità generale.
- #2 r/GrokAiDiscussion “Have they loosened the image to video generation moderation” (14 pt, 28 commenti, 2026-08-29, https://www.reddit.com/r/GrokAiDiscussion/comments/1w1w0e8/) — le esperienze degli utenti con la moderazione di Grok Imagine sono discordanti: u/Miserable_Appeal515(2) sostiene “it has gotten better”, mentre u/joderrelldalejr(2) risponde “Hell no it gets worse and then they start to limit how many images you can even do in a week”.
- #1 r/generativeAI “List of daily AI video generative websites” (38 pt, 27 commenti, 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/) — scambio di informazioni per chi sfrutta le quote gratuite. Kling AI offre “66 free credits every 24 hours”; u/Murky-Race-3443(1) segnala che CapCut offre crediti giornalieri gratuiti, mentre u/Julia_Leeds94(1) presenta YalleryLabs, con video da 5 secondi in 720p a partire da $0.18 con un budget di $3.
- #3 r/freetoolsAI “Free AI Image Generator” (31 pt, 31 commenti, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) — un post promozionale per un generatore di immagini senza registrazione ha attirato commenti; u/Odd-Lingonberry1516(2) elenca alternative come Deepany, Aifun e Perchance. u/thecragmire(1) chiede anche quale sia il modello di ricavi: “How do you maintain this? It's got to cost you something, right?”.
- #11 r/generativeAI “GOOD image-to-video ??” (1 pt, 13 commenti, 2026-08-29, https://www.reddit.com/r/generativeAI/comments/1w20rq1/) — Kling AI viene definito “practically king of the hill for realistic human motion”, Runway “The gold standard for creative control”; per l’esecuzione locale, u/Ok-Addition1264(2) consiglia ComfyUI + WAN22/LTX2.3.
- #7 r/generativeAI “Any good Ai video site ? Even if it paid ?” (0 pt, 15 commenti, 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3kptg/) — u/Previous-Course-5160(1) valuta Runway gen-3 positivamente perché “actually handles motion pretty well compared to a lot of the jank”, ma considera Pika divertente per brevi loop, con risultati ripetitivi nel tempo.
- #8/#10 r/news “Federal Judge rules AI generated child sex abuse material is protected by First Amendment.” (1.379 pt, 545 commenti, 2026-09-02, https://www.reddit.com/r/news/comments/1w5k6pr/) e r/allthequestions “Why did a federal judge declare the creation of AI generated child porn as legal?” (31 pt, 277 commenti, 2026-08-31, https://www.reddit.com/r/allthequestions/comments/1w3hf3o/) — il dibattito sulla qualificazione legale dei contenuti IA ottiene un coinvolgimento nettamente superiore. u/Ntroepy(414) nota che il titolo è fuorviante e vincolato da una sentenza della Corte Suprema del 2002; u/TheGracefulCrane(31) spiega che i giudici non fanno leggi e che la legge non è stata aggiornata per rendere illegale la condotta.
- #9 r/antiai “AI generated images are becoming harder to detect” (113 pt, 30 commenti, 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/) — contrariamente al titolo, i commenti si concentrano su errori nelle mani e nei piedi, come “why are her feet her hands” di u/GurInside278(31), creando un ironico scarto fra premessa e reazione.
- #12 r/teenagers “To all AI image/video generator users” (7 pt, 41 commenti, 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/) — post in risposta all’idea che l’arte IA non implichi lavoro da parte dell’artista. Commenti come quello di u/LiterallyGarbage_0(5), “people who use ai to make "art" genuinely make me so upset...pick up a pencil”, mostrano una forte ostilità verso l’IA tra gli adolescenti.
Segnali
- In crescita: il ritmo di rilascio dei modelli locali open source — LLM, immagini e video — è così rapido che persino i commenti del thread #4 non riescono a seguirlo. Atlas di World Labs (#5), che potrebbe trasferire la generazione video nei dati per la robotica, indica una nuova direzione d’interesse.
- Opinioni divise: sulla moderazione di Grok Imagine (#2), le segnalazioni “è migliorata” e “è peggiorata” sono quasi speculari. Anche Seedance vs Wan (#6) divide fra chi dichiara una netta vittoria di Seedance e chi contesta il valore del confronto a prompt identico.
- Messo in dubbio: il formato classico del confronto fra modelli con lo stesso prompt (#6) viene criticato da u/Positive-Key6640 come metodo di valutazione.
- Elemento sorprendente: il thread #9, intitolato “le immagini IA stanno diventando più difficili da rilevare”, diventa invece una fonte di battute sugli arti deformi. Inoltre, le decisioni giudiziarie (#8 e #10, oltre 800 commenti complessivi) superano ampiamente le notizie di prodotto: su Reddit, il trattamento legale ed etico dei contenuti IA sembra più esplosivo del progresso tecnico.
Limiti
- È stato usato un solo termine di ricerca, “Image and Video Generation AI News”, e sono stati raccolti 12 thread in 9 subreddit: meno dei circa 20 post richiesti per rete da brief.md.
- In questa fase è stato letto soltanto il materiale pre-raccolto dal worker in
output/reddit.threads.md/.threads.json; non sono state effettuate nuove raccolte con altre query né accessi diretti a thread o commenti, secondo le istruzioni del playbook. - Per ciascun thread sono stati registrati al massimo sei commenti principali, quindi reazioni minori e opinioni di minoranza non compaiono nel rapporto.
X
X — Notizie sull’IA per la generazione di immagini e video
Account
Dei 34 account presenti nella raccolta, soltanto quattro hanno pubblicato contenuti relativi all’IA per immagini/video: tutti sullo stesso lancio, nelle stesse 24 ore (2026-09-03).
- @OpenAI (OpenAI) — un solo post, ma è l’intera storia: 309.095 like, 55.587 repost, circa 108.000.000 visualizzazioni. L’account ha pubblicato il minimo indispensabile — un annuncio con immagine — lasciando che il volume parlasse da sé.
- @MatthewBerman (Matthew Berman) — account da influencer AI, un post (4.054 like, circa 1.500.000 visualizzazioni) presentato come thread di primo contatto con “accesso anticipato”, che lo posiziona come tester e non come fonte.
- @Dimillian (Thomas Ricouard) — un post (7.199 like, circa 2.300.000 visualizzazioni), con una pipeline concreta Blender → Unreal Engine 5 invece dell’hype generico: la rivendicazione tecnica più tangibile dell’insieme.
- @flowith (Flowith) — l’account più piccolo (947 like, circa 115.000 visualizzazioni), che sfrutta il lancio per un confronto diretto con il modello precedente.
Tutti gli altri account della raccolta (34 account, 40 post) — crypto/meme (@songoncardano, @nmkr_io, @legsdotfun, @robincatonhood), fan di Elon/Tesla (@LunarOptimus, @Optimus_RH, @HeavyMetalShip), influencer di cybersecurity (@corewarrior, @hackerzspace), account di notizie e meme polacchi, africani e bosniaci, fan di Ariana Grande (@vodolove ha pubblicato 3 dei suoi 4 elementi) e concorsi di marchi di birra (@naturallight, @ChinookCi) — non hanno alcuna relazione con l’IA per immagini o video. Sono citati solo perché sono ciò che la raccolta ha realmente restituito; vedi Limiti.
Post
1. Lancio di GPT-6 "Astra" — @OpenAI
- 309.095 like · 55.587 repost · 7.713 risposte · circa 108.000.000 visualizzazioni · 2026-09-03
- https://x.com/OpenAI/status/2095595741528125780
"Questo è GPT-6 Astra. Tutto ciò che puoi fare su un computer, Astra può farlo per te. Velocemente."
Il singolo post più grande dell’intera raccolta, di un ordine di grandezza superiore agli altri. È presentato come agente generale per l’uso del computer, non come modello specifico per immagini/video; tuttavia i demo pubblicati successivamente da altri account sono tutti visivi o 3D, suggerendo che i punti di forza mostrati da Astra siano orientati in quella direzione.
2. Astra contro il modello precedente, incentrato sull’animazione — @flowith
- 947 like · 69 repost · 19 risposte · circa 115.000 visualizzazioni · 2026-09-04
- https://x.com/flowith/status/2095750768204877858
"GPT-6 Astra VS GPT-5.6 sull’animazione, in arrivo su flowith.io"
Un account di prodotto terzo annuncia esplicitamente un confronto di animazione fra Astra e la generazione precedente: un segnale concreto che Astra viene testato e promosso specificamente per capacità di generazione di animazioni, non solo per uso generale del computer.
3. Thread pratico con accesso anticipato — @MatthewBerman
- 4.054 like · 494 repost · 210 risposte · circa 1.500.000 visualizzazioni · 2026-09-03
- https://x.com/MatthewBerman/status/2095595892464333065
"Astra (GPT-6) è qui!!! Ho avuto accesso anticipato e l’ho testato a fondo con giochi, codice, scrittura, controllo del browser, presentazioni e lavoro sulla conoscenza generale. È il miglior modello che abbia mai usato. Punto."
È significativo ciò che non menziona: nell’elenco delle capacità non compaiono esplicitamente immagini o video, nonostante il thread prometta “demo incredibili qui sotto”.
4. Procedura da Blender a Unreal Engine 5 — @Dimillian
- 7.199 like · 1.145 repost · 259 risposte · circa 2.300.000 visualizzazioni · 2026-09-03
- https://x.com/Dimillian/status/2095596700815516004
"Astra è molto bravo nella modellazione 3D e non vedo l’ora che tutti possiate provarlo; per ora ecco una piccola procedura su come ho costruito la casa demo per il nostro post di lancio. Da una scena Blender a un’esperienza esplorabile in Unreal Engine 5."
La rivendicazione più concreta e specifica sugli strumenti della raccolta: Astra viene usato in una vera pipeline di contenuti 3D, Blender → UE5, più vicina a un flusso di generazione visiva/video di qualsiasi altro elemento emerso su X.
Segnali
- In crescita: GPT-6 "Astra" è l’unica storia collegata a immagini/video emersa dalla raccolta, e domina il coinvolgimento (circa 108 milioni di visualizzazioni nel solo post di lancio, contro poche centinaia di migliaia per quasi tutto il resto). Il gruppo di reazioni — confronto di prodotto, prova pratica dell’influencer e demo della pipeline 3D dello sviluppatore — entro 24 ore sembra un lancio coordinato più che una scoperta organica.
- Assente: nella raccolta non compare alcun modello open source per immagini o video — Stable Diffusion, Flux, Wan, HunyuanVideo, Kling, ComfyUI e così via. Se su X c’è attività open source in questo settore, questa ricerca non l’ha raggiunta.
- Sorprendente: il discorso sul lancio AI nomina pochissimo immagini o video come funzionalità. L’elenco dell’accesso anticipato di Matthew Berman li omette del tutto, e Astra è promosso come agente generale (“tutto ciò che puoi fare su un computer”). L’angolazione immagini/video è dedotta da ciò che i primi tester hanno scelto di mostrare — modellazione 3D e confronto di animazione — non dal posizionamento di OpenAI.
Limiti
- Le ricerche raccolte non miravano a questo tema. I dieci termini cercati — “Astra”, “$SONG”, “Robinhood”, “Elon”, “#CyberSecurity”, “Poland”, “Africa”, “Bosnia”, “ariana”, “#Sweepstakes” — sono la lista dei trend di X in questa sessione, non query scelte per l’IA di generazione immagini/video. Solo “Astra” ha prodotto risultati pertinenti; gli altri 36 post sono rumore irrilevante.
- I criteri di completamento non sono soddisfatti. Il brief richiede circa 20 post per piattaforma analizzati sul tema; qui ci sono solo 4 post utilizzabili, tutti su un singolo lancio closed-source, GPT-6 Astra, e zero sull’open source. Sarebbe necessario cercare termini come “Stable Diffusion”, “ComfyUI”, “Flux”, “Kling AI”, “Runway”, “Sora”, “Midjourney”, “Wan 2.x” o “HunyuanVideo”.
- Avvertenza sulla geolocalizzazione: i trend Explore di X erano geolocalizzati in Croazia, come indicato esplicitamente per la maggior parte delle voci. È il motivo per cui token crypto, calcio bosniaco e notizie/meme balcanici dominano la lista: rappresentano i trend di una localizzazione server, non un quadro globale.
- Nessuna copertura open source. Nessun contenuto della raccolta riguarda notizie, strumenti o rilasci open source per immagini/video: la lacuna è totale, non parziale.
YouTube
YouTube — Notizie sull’IA per immagini e video (closed source / open source)
Canali
Canali trovati tramite ricerca YouTube e ricerca di notizie. Per molti non è stato possibile verificare direttamente gli iscritti, perché le pagine video sono renderizzate in JavaScript (dettagli in ## Limiti).
- Theoretically Media — canale di riferimento che verifica regolarmente IA generativa open source, come Wan / FLUX / Qwen-Image, in ComfyUI. (“Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial...” https://www.youtube.com/watch?v=3BFDcO2Ysu4)
- Matt Wolfe / The Next Wave — noto per confronti tra strumenti AI closed-source, tra cui Runway, Kling, Veo e Sora.
- Vari canali individuali di strumenti IA con recensioni di modelli specifici come LTX-2.5, MiniMax H3 e Nano Banana 2; i nomi dei canali non sono comparsi nei risultati, ma sono stati confermati i titoli dei video.
Video
Closed-source
- “Nano Banana 2 Is INSANE – Full Test of Google's New Image Model!” — circa 2026-02-26 — https://www.youtube.com/watch?v=k0dujOUePeU — test pratico di Gemini 3.1 Flash Image di Google, noto come Nano Banana 2, che sostiene di risolvere il compromesso fra velocità e qualità.
- “Nano Banana 2 vs Nano Banana Pro: I Tested Both So You Don't Have To” — fine febbraio 2026 — https://www.youtube.com/watch?v=B1d3SIfoQLk — confronto degli output della versione standard e Pro per stabilire quale usare.
- “Kling 3.0 Surprised Me! Compared To Veo 3.1 & Sora 2” — circa 2026-02-05 — https://www.youtube.com/watch?v=AAD7wJ3DWiA — confronto diretto tra Kling 3.0 di Kuaishou, Veo 3.1 e Sora 2; Kling viene valutato positivamente per realismo e movimenti di camera.
- “Is Kling 3.0 Actually Good? (I Spent $500 Testing For You)” — circa 2026-02-04 — https://www.youtube.com/watch?v=Rme22R7a9O8 — test a pagamento di Kling 3.0, inclusi multi-shot e output 4K a 60 fps.
- “Seedream 5.0 Tested & Seedance 2.5 Leaks Are Unreal!” — circa 2026-07-15 — https://www.youtube.com/watch?v=pn-YwWn3kkM — prova del modello di immagini Seedream 5.0 Pro di ByteDance e dell’ancora inedito Seedance 2.5; viene menzionato che ByteDance ha saltato Seedance 2.1.
- “Seedance 2.5 Is Insane — 30 Seconds In ONE Shot?” — circa 2026-06-23 — https://www.youtube.com/watch?v=8sGVhuoPOXI — verifica della capacità di Seedance 2.5 di creare 30 secondi di filmato continuo in una sola ripresa.
- “MiniMax H3 Review | Testing Hailuo's New 2K AI Video Model” — inizio agosto 2026 — https://www.youtube.com/watch?v=67CCQBAwZiA — prova pratica di MiniMax H3, Hailuo 3.0, rilasciato il 31 luglio 2026, con video 2K di 15 secondi e audio stereo nativo.
- “Hailuo AI's NEW MiniMax H3 Model Is INCREDIBLE! (Full Test)” — circa agosto 2026 — https://www.youtube.com/watch?v=la0iBk8g8_g — test completo delle funzioni omnimodali di MiniMax H3, con input simultanei di testo, immagini, video e audio.
- “FLUX 3 Sneak Peek” — 2026-07-23 — https://www.youtube.com/watch?v=PCPhl8qMF_Y — anteprima di FLUX 3 di Black Forest Labs, modello multimodale per immagini, video di 20 secondi, audio e azioni; la componente Video è diventata GA il 2026-08-04.
- “Gen-4.5 Updates — Research Demo Day 2025 | Runway” — 2025-12-16 — https://www.youtube.com/watch?v=yNXxuzmiwEo — spiegazione tecnica ufficiale di Runway sugli aggiornamenti di Gen-4.5, compresi controllo della camera e coerenza dei personaggi.
- “All in one AI | Text to Image & Video AI | Kling, Veo, Sora, Nano Banana Pro | Daily Free Credits!” — recente — https://www.youtube.com/watch?v=SnmRpf_VfgU — guida all’uso delle quote gratuite di molte IA closed-source, fra cui Kling, Veo, Sora e Nano Banana Pro.
Open source
- “LTX 2.5 In ComfyUI — Setup, First Gens, And The Catch” — metà agosto 2026, circa tre settimane dopo la pubblicazione open weights di LTX-2.5 dell’11 agosto 2026 — https://www.youtube.com/watch?v=RjlbDhs1MPk — implementazione nativa in ComfyUI del modello world da 22B di Lightricks, con generazione di 10 secondi a 720p in 6,8 secondi.
- “LTX 2.5 ComfyUI: Physics Test vs MiniMax H3 + Free Workflows” — circa tre settimane prima — https://www.youtube.com/watch?v=WpKNXZZqQEU — confronto diretto fra LTX-2.5 open weights e MiniMax H3 non pubblico su fisica e multi-shot.
- “New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local)” — circa tre settimane prima — https://www.youtube.com/watch?v=pA2BQw9LY8A — test incentrato sulla velocità di esecuzione locale.
- “Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models” — Theoretically Media — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — guida in ComfyUI per Wan 2.2, FLUX, FLUX Krea e Qwen Image. Wan 2.2 viene valutato vicino a Sora per coerenza, mentre FLUX eccelle nei dettagli.
- “HunyuanImage 3.0 — The Most Powerful Open-Source Image Generator Yet” — 2025-09-30 — https://www.youtube.com/watch?v=U-8RjjU7x14 — presentazione del modello immagini MoE da 80B di Tencent, con una lieve superiorità nelle vittorie rispetto a Seedream 4.0, Nano Banana e GPT-Image.
- “Flux.2 Dev: Full Review, Pros & Cons, ComfyUI Setup!” — circa 2025-11-26 — https://www.youtube.com/watch?v=MoAwonm53hQ — recensione e installazione ComfyUI di FLUX.2 di Black Forest Labs, inclusa la versione open weights; viene evidenziata la coerenza del soggetto con fino a dieci immagini di riferimento.
- “FLUX 2 Released! 🤯 ComfyUI Install, Workflow & The "Active Parameter" Secret” — circa 2025-11-26 — https://www.youtube.com/watch?v=nfeDS_EoblE — istruzioni per installare FLUX.2 in ComfyUI e spiegazione delle nuove funzioni.
- “Qwen Image First Look & LOCAL Testing (The BEST New Image Model?)” — 2025-08-05 — https://www.youtube.com/watch?v=ex2YCqtTHSY — primo test locale di Alibaba Qwen-Image, predecessore di Qwen-Image-2512.
- “Qwen Image Edit 2511–Local Image Editing in ComfyUI | Multi-Reference Style Transfer & GGUF Workflow” — 2025-12-26 — https://www.youtube.com/watch?v=iFnTqZmsRIc — verifica del trasferimento di stile da più immagini di riferimento in Qwen Image Edit, tramite workflow GGUF in ComfyUI.
- “MiniMax H3: The New Open-Source Video Champ?” — circa agosto 2026 — https://www.youtube.com/watch?v=3R5GROj8Tcg — MiniMax H3 viene presentato come modello video omnimodale pubblicato in open weights e valutato al primo posto nelle classifiche di video editing.
Segnali
- Gli open weights si avvicinano rapidamente allo stato dell’arte: LTX-2.5 (2026-08-11) e MiniMax H3 (2026-07-31) sono stati entrambi pubblicati in open weights negli ultimi 60 giorni. Le miniature comparano spesso i modelli con i sistemi closed fin dall’annuncio, non più come semplici inseguitori.
- Ciclo di rilascio rapido di ByteDance: Seedream 5.0 Pro e Seedance 2.5, con il salto della versione 2.1, vengono aggiornati a distanza di pochi mesi. I video su YouTube enfatizzano l’immediatezza con formule come “Tested” e “Leaks”.
- Riorganizzazione dell’ecosistema Google: l’intera linea Imagen è prevista per la dismissione il 2026-08-17, con transizione verso Nano Banana della famiglia Gemini 3.x Image. Per Nano Banana 2, uscito il 2026-02-26, sono già disponibili vari confronti con i successori, incluso Pro.
- Ritiro di un grande attore closed-source: OpenAI dovrebbe chiudere la Sora API il 2026-09-24 e destinare le risorse computazionali al modello successivo “Spud”, secondo i risultati di ricerca; il relativo video YouTube non è stato verificato. È una svolta rilevante per l’andamento del closed source.
- ComfyUI come infrastruttura pratica per la verifica open source: le recensioni di Wan, FLUX, Qwen-Image e LTX-2.5 sono quasi tutte accompagnate da istruzioni di integrazione in ComfyUI.
Limiti
- Le pagine dei risultati YouTube (
youtube.com/results?...) e dei video (youtube.com/watch?v=...) sono renderizzate in JavaScript: anche con fetch diretto si ottengono solo link di navigazione del footer, senza dati grezzi su visualizzazioni, iscritti o data (ytInitialDatae simili). Le date sono quindi stimate dagli snippet dei motori di ricerca e da riferimenti negli articoli. - Non è stato trovato un video YouTube diretto sulla chiusura di Sora e sul successore “Spud”; questa voce si basa su articoli di notizie e non su reazioni YouTube verificate.
- Sono stati trovati video ufficiali su Runway Gen-4.5 e sugli aggiornamenti recenti di Midjourney, ma non recensioni indipendenti recenti, entro 60 giorni, nella ricerca attuale.
- Per alcune recensioni individuali di Nano Banana Pro sono stati confermati titolo e link, ma non il nome del canale né le visualizzazioni.
Bluesky
Bluesky — Ultimi sviluppi nell’IA per immagini e video
Account
- Simon Willison @simonwillison.net — sviluppatore noto per la valutazione di modelli LLM e di generazione di immagini. Pubblica il suo abituale benchmark dell’immagine del pellicano a ogni nuovo modello e costituisce una valida fonte primaria per le notizie closed-source.
- fofr @fofr.ai — esperto di prompt per immagini attivo nell’area Replicate; pubblica spesso usi pratici di Nano Banana Pro, Gemini 3 Pro Image.
- Replicate (ufficiale) @replicate.com — account ufficiale dell’azienda di hosting API per modelli AI. Annuncia i nuovi modelli disponibili su Replicate ed è un hub per le notizie di rilascio dei modelli video, open o closed.
- Amanda Silberling (giornalista TechCrunch) @amanda.omg.lol — giornalista che segue gli aspetti culturali dell’IA per immagini.
- AI News Updates @ai-latestnews.bsky.social — account bot che pubblica automaticamente notizie del settore IA.
- gigowat @gigowat.bsky.social — account che condivide su Bluesky articoli del sito giapponese di notizie tech GIGAZINE; una delle poche fonti di notizie sull’IA di generazione immagini in giapponese.
- ostris @ostris.com — sviluppatore dell’open-source LoRA training tool “AI-Toolkit”. Pubblica su modelli Flex, ma afferma che la comunità AI/ML è rimasta quasi tutta su Twitter; gli aggiornamenti su Bluesky sono pertanto rari.
Post
-
Simon Willison — ha pubblicato una griglia comparativa dell’immagine del pellicano per GPT-6 Astra e GPT-5.6 Sol/Terra/Luna (closed-source, confronto tra modelli di immagini OpenAI). 2026-09-04, 👍91 · 🔁6 · 💬12.
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
Ha poi pubblicato la versione a dimensione intera dell’immagine generata; anche il testo alternativo è stato generato da GPT-5-astra. 👍23.
https://bsky.app/profile/simonwillison.net/post/3mupxztoyqs2c -
Simon Willison — ha pubblicato un confronto dell’immagine del pellicano generata con Google Gemini 3.7 Flash. 2026-09-02, 👍6.
https://bsky.app/profile/simonwillison.net/post/3muitt5g3q22r -
fofr — ha condiviso un prompt dettagliato per ricreare un rendering in stile videogioco retrò con Nano Banana Pro, Gemini 3 Pro Image. 2026-01-19, 👍31.
https://bsky.app/profile/fofr.ai/post/3mcrt3avp222p
Lo stesso giorno ha pubblicato anche un prompt per creare screenshot in stile Street View. 👍10.
https://bsky.app/profile/fofr.ai/post/3mcrilugr5c2m -
Replicate (ufficiale) — ha annunciato la disponibilità su Replicate di “GPT Image 2” di OpenAI. Ha evidenziato fotorealismo, precisione nel rendering del testo e qualità per UI/design (closed-source). 2026-04-21.
https://bsky.app/profile/replicate.com/post/3mjzygaefs224 -
Replicate (ufficiale) — ha annunciato l’apertura a tutti gli utenti di “Seedance 2.0” di ByteDance, modello video che integra testo, immagini, video e audio nella stessa scena e genera audio stereo sincronizzato (closed-source). 2026-04-09.
https://bsky.app/profile/replicate.com/post/3mj3junhvnh26 -
Replicate (ufficiale) — ha aggiunto Runway Gen-4.5 a Replicate, modello di generazione video orientato al realismo fisico (closed-source). 2026-02-18.
https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c -
Replicate (ufficiale) — ha aggiunto Kling 3.0, più o3, di Kuaishou, con multi-shot 4K e sincronizzazione audio (closed-source). 2026-02-17.
https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q -
Replicate (ufficiale) — ha aggiunto il modello video Vidu Q3, che supporta input testo, immagini e frame iniziale/finale, fino a 16 secondi e 1080p (closed-source). 2026-03-11.
https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w -
Amanda Silberling (TechCrunch) — ha richiesto pareri di esperti su perché le immagini di cibo generate dall’IA tendano ad avere un aspetto particolare: un invito per un articolo sulle peculiarità estetiche della generazione immagini. 2026-08-28, 👍17 · 🔁5 · 💬4.
https://bsky.app/profile/amanda.omg.lol/post/3mu5itcncgc2x -
AI News Updates (bot) — ha riportato che Midjourney Inc. ha acquisito l’app astrologica Co-Star per lanciare una nuova app di generazione immagini. 2026-07-25. Il contenuto è coerente con notizie di TechCrunch e Bloomberg del 2026-07-24, che riferivano una chiusura dell’acquisizione nella primavera, e quindi è verificabile.
https://bsky.app/profile/ai-latestnews.bsky.social/post/3mrh6gdxnqy2s -
gigowat (condivisione in giapponese di un articolo GIGAZINE) — condivisione di un articolo su Qwen-Image-3.0, IA open source per la generazione di immagini, con prove della resa di illustrazioni e testo giapponese. 2026-07-22.
https://bsky.app/profile/gigowat.bsky.social/post/3mr7dvb332z2q
(articolo originale: https://gigazine.net/news/20260722-qwen-image-3/ ) -
ostris — annuncio di “Flex.2-preview”, modello open-source per immagini che unisce text-to-image, controllo universale e inpainting. Il post è piuttosto vecchio, 2025-04-22, ma è uno dei pochi esempi di sviluppatore open source che comunica direttamente su Bluesky. 👍4.
https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a
Segnali
- Prevalgono i closed-source: i post con coinvolgimento effettivo su Bluesky si concentrano su grandi modelli closed-source come GPT, Gemini/Nano Banana Pro e Midjourney. Il benchmark dell’immagine del pellicano di Simon Willison è di fatto un controllo periodico della qualità dei modelli di immagini closed-source.
- L’account Replicate come hub di notizie rapide sui video: Kling 3.0, Seedance 2.0, Runway Gen-4.5 e Vidu Q3 sono passati tutti dall’account ufficiale Replicate. Anche se ricevono pochi like, uno o due, l’account è utile per seguire in ordine temporale i principali rilasci.
- Le fonti open source sono scarse su Bluesky: non sono quasi emerse menzioni primarie per i principali modelli open weights del 2026, fra cui Wan 2.7, HunyuanVideo 1.5, Chroma e LTX-2.3. Lo stesso ostris osserva che l’ambiente AI/ML è rimasto quasi interamente su Twitter, suggerendo che il baricentro della comunità sia ancora X.
- Le pubblicazioni in giapponese passano soprattutto da GIGAZINE: i post giapponesi sono prevalentemente ripubblicazioni di articoli di siti di notizie come GIGAZINE; non sono state trovate analisi primarie indipendenti.
Limiti
- L’API ufficiale di ricerca dei post Bluesky,
app.bsky.feed.searchPosts, ha restituito sempre403 Forbiddentramite WebFetch durante questa sessione. Non è stato quindi possibile fare una raccolta esaustiva per parole chiave con like e repost; la ricerca è stata convertita nel controllo individuale digetAuthorFeedper account noti trovati con Google. - La pagina di ricerca
bsky.appè una SPA renderizzata in JavaScript e WebFetch, che converte HTML in Markdown, non ha potuto ricavare il testo dei post. - Per questi vincoli non è stato possibile verificare sistematicamente tutti i post per nomi di modelli specifici. Sono stati esaminati più di 20 post/feed di account noti, ma i post direttamente relativi alla generazione immagini/video sono circa 12.
- Per modelli open source come Wan, HunyuanVideo, Chroma, Z-Image e LTX-2.3 sono stati provati diversi account, ma non sono stati trovati post pertinenti nel 2026. huggingface.bsky.social ha il feed vuoto e civitai-bot.bsky.social è fermo a maggio 2024.
- È stato trovato un post personale di febbraio 2026 secondo cui Midjourney sarebbe entrata a far parte di Meta.ai, ma fonti esterne hanno verificato che si trattava di un accordo di licenza dell’agosto 2025 e che Midjourney restava indipendente. Essendo imprecisa, l’informazione non è stata inclusa nel rapporto.
Lemmy
Lemmy — Ultimi sviluppi nell’IA per immagini e video (closed/open source)
Comunità (Communities)
- !«メールアドレス» — 5.708 membri. Discussioni tecniche su IA per immagini e video open weights; nella presente indagine è stata la comunità con maggiore densità informativa.
- !«メールアドレス» — 2.360 membri. Spazio per opere create con modelli Stable Diffusion; poche notizie in senso stretto.
- !«メールアドレス» — 1.593 membri. Dedicata all’arte IA in stile anime; bassa rilevanza giornalistica.
- !«メールアドレス» — 50 membri. Comunità bot che ripubblica automaticamente RSS da Reddit; non rappresenta discussioni umane.
- !«メールアドレス» e !«メールアドレス» — notizie tech generiche; i pochi contenuti su IA per immagini/video sono dispersi fra articoli sull’IA in generale.
- Su Lemmy non esiste una grande comunità specializzata nell’IA di generazione immagini/video paragonabile a r/StableDiffusion; gli argomenti sono distribuiti fra le comunità più piccole elencate sopra.
Post (Posts)
Open source
- MiniMax H3, Comfy diventa rivenditore ufficiale delle licenze commerciali — !«メールアドレス», punteggio 4, 2026-08-28. Articolo originale: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller . MiniMax H3 è un modello video open weights pubblicato nell’agosto 2026, eseguibile in locale anche su GPU della classe RTX 3060, capace di generare video 2K con audio stereo nativo. Comfy è diventato rivenditore delle licenze Professional/Enterprise; Enterprise consente anche l’uso del modello non distillato.
- LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes — !«メールアドレス», punteggio 2, 2026-09-04. https://arxiv.org/abs/2609.03796 . Modello di generazione immagini con ricetta di addestramento completamente pubblica, punteggi ai vertici su Qwen-Image-Bench e una versione turbo distillata veloce.
- Trellis.2 e Pixal3D integrati nativamente in ComfyUI — !«メールアドレス», punteggio 4, 2026-09-01. https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native . Annuncio secondo cui i migliori modelli open per la generazione 3D sono diventati parte del core di ComfyUI.
- ComfyUI-MiniMaxH3-CLSS — !«メールアドレス», punteggio 0, 2026-09-01. https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS . Strumento per MiniMax H3 che consente, secondo il progetto, video con audio di lunghezza arbitraria anche su sistemi consumer con 16 GB di VRAM.
- Fizgig LoRA/LoKR Studio — !«メールアドレス», punteggio 4, 2026-08-30. https://github.com/shootthesound/Fizgig . Strumento aperto per addestrare ed estrarre LoRA/LoKR per varie famiglie di modelli, fra cui Krea 2, MiniMax e Klein 9B.
- VibeVoice-ComfyUI (integrazione dell’open TTS Microsoft in ComfyUI) — !«メールアドレス», punteggio 1, 2026-08-28. https://github.com/nikhilprasanth/VibeVoice-ComfyUI . Esempio dell’integrazione dell’audio nei flussi di generazione video.
- Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス», punteggio 5, 2026-06-17. Modello fondazionale open per immagini, leggero ed efficiente.
Closed-source
- Midjourney passa dalla generazione di immagini agli scanner ecografici medicali — !«メールアドレス», punteggio 58, 2026-06-18. https://lemmy.zip/post/66397234 . Numerosi thread correlati, compresi mirror Hacker News con punteggi da 40 in su, hanno alimentato una discussione importante su “Midjourney Medical” e “Ultrasonic CT”. È una delle maggiori notizie sulla riconversione di un servizio closed di generazione immagini.
- Midjourney chiede agli studi di Hollywood una divulgazione dettagliata dell’uso dell’IA — !«メールアドレス», punteggio 73, 2026-07-05. https://lemmy.today/post/56011946
- Rilasciato il nuovo modello di immagini Google “Nano Banana 2 Lite” — !«メールアドレス», punteggio 0, 2026-07-02. https://lemmy.world/post/48936394 (mirror Hacker News: https://lemmy.bestiver.se/post/1199483 )
- MAI-Image-2.5 di Microsoft si avvicina a Nano Banana 2 di Google nei benchmark — !«メールアドレス», punteggio 1, 2026-05-28. https://lemmy.durstig.online/post/35068
- Recensione comparativa pratica di Seedream 5.0 Pro — !«メールアドレス», punteggio 1, 2026-07-10. https://lemmy.durstig.online/post/46063
- Runway annuncia il raddoppio dell’attività enterprise e una retention netta dei ricavi oltre il 300% — !«メールアドレス», punteggio 0, 2026-08-30. https://lemmy.durstig.online/post/56937
- La funzione Earth AI di Google viene ritirata silenziosamente il giorno dopo il rilascio per problemi di generazione NSFW — !«メールアドレス», punteggio 1, 2026-08-07. https://lemmy.durstig.online/post/52162
Segnali (Signals)
- L’open source è dominato da MiniMax H3: tra fine agosto e inizio settembre 2026, quasi metà dei post della comunità stable_diffusion riguarda estensioni ComfyUI e strumenti di accelerazione per MiniMax H3, modello video locale con audio eseguibile anche su hardware della classe RTX 3060. Sta assumendo il ruolo di riferimento per il video open.
- Il confine tra open e closed è sfumato: MiniMax H3 è open weights, ma l’uso commerciale richiede licenze a pagamento tramite Comfy. Il modello ibrido — uso gratuito, commerciale a pagamento — sembra diventare più comune.
- La principale notizia closed-source è un “ritiro”: rispetto alla competizione fra nuovi modelli, la notizia del pivot di Midjourney verso apparecchiature medicali ottiene punteggi di gran lunga superiori, 58–73, e attira la maggiore attenzione degli utenti Lemmy.
- La generazione 3D entra in ComfyUI: modelli aperti text/image-to-3D come Trellis.2 e Pixal3D sono diventati funzioni centrali di ComfyUI; i workflow locali includono così asset 3D oltre a immagini e video.
- Lemmy non ha una grande comunità dedicata all’IA per immagini/video: la discussione è frammentata tra comunità tecniche stable_diffusion di poche migliaia di persone e piccole comunità bot come ai_reddit, con 50 membri.
Limitazioni (Limits)
- Lemmy è federato e l’API di ricerca di una singola istanza copre soltanto il proprio indice: la ricerca tramite
lemmy.worldpuò quindi perdere post di altre istanze, comelemmy.dbzer0.comelemmy.today. Sono state consultate API e ricerche su più istanze, ma il risultato non è esaustivo. - Il recupero diretto delle informazioni della comunità
localllamasulemmy.ml, tramite/api/v3/community, è fallito con 404 e non è stato possibile verificarne i dettagli. !«メールアドレス»è una comunità bot che ripubblica meccanicamente feed RSS Reddit; con 50 iscritti e quasi nessuna discussione umana, può essere fonte di notizie ma non misura il coinvolgimento su Lemmy.- Le ricerche dirette di servizi video closed come Sora, Kling AI, Veo e Runway Gen hanno prodotto quasi solo risultati irrilevanti, quali toponimi, nomi propri e attualità. Per Runway è stato trovato soltanto un post finanziario.
- Il numero di post è molto inferiore rispetto a Reddit e i punteggi sono perlopiù a una cifra o poche decine. Lemmy da solo non offre una base sufficiente per leggere 20 post e trarre trend robusti; qui sono state eseguite sette query su più istanze e sono stati selezionati esempi rappresentativi dei post effettivamente trovati.
Pinterest — Notizie sull’IA per la generazione di immagini e video
Temi visivi
- Dominano le miniature in stile YouTube/blog. Sfondi neri o blu scuro, gradienti al neon blu-viola-arancione e titoli sans serif molto pesanti, come “AI NEWS”, “THE FUTURE IS AI”, “BREAKING NEWS” e “AI IS CHANGING EVERYTHING!”. Più che le generazioni stesse, predominano copertine di articoli o video che parlano di IA [2, 7, 11, 38, 39, 42, 48]
- Volti e ritratti umani sono il motivo centrale. Animazione delle espressioni, lip sync, ricostruzione del viso con Microsoft VASA-1 e servizi fotografici IA con ChatGPT+Higgsfield compaiono ripetutamente [13, 14, 18, 23, 50]
- Umanoidi e robot vengono usati come simboli generici dell’IA. Molte immagini stock generiche, come profili di robot bianchi o donne in stile cyborg, non sono collegate a uno strumento concreto [2, 39]
- Griglie “prima/dopo” o “una foto in input → più stili in output”. Griglie che trasformano video reali in legno, origami, mattoncini LEGO o fiori, probabilmente con strumenti della famiglia Luma, e immagini che inseriscono un personaggio di peluche in sfondi realistici [3, 31]
- Infografiche di confronto e classificazione degli strumenti. Elenchi di loghi, tabelle “Best Quality (Paid) vs Best Free” e confronti di funzioni con segni di spunta, utili per scegliere uno strumento [7, 37]
- Miniature con volti di celebrità reali o evocative. Ritratti IA simili a Jeff Bezos, presentatori dall’aspetto di YouTuber in immagini “AI NEWS” e foto di conferenze di Jensen Huang di NVIDIA, usati per creare fiducia o attrarre attenzione [11, 36, 40]
- Overlay di mesh e wireframe facciali. Griglie e etichette numeriche su viso e collo, che richiamano analisi espressiva o biometria, usate in pin pubblicitari [23, 50]
- Palette cromatica coerente. Base scura con accenti al neon ciano, magenta e giallo: il linguaggio visivo quasi comune a tutti i pin sugli strumenti IA [2, 7, 38, 39, 42]
Pin notevoli
- [1] Image to Video AI: How It Works and Why It Matters — immagine di copertina di un articolo che illustra la generazione di una “timeline video” da una singola immagine statica.
- [3] Google announces ultra-high quality video... (in realtà demo di trasformazione di stile con preservazione dell’identità, probabilmente Luma) — griglia 3×5 che trasforma un video sorgente in legno, origami, LEGO e fiori. È una dimostrazione chiara della capacità di cambiare texture mantenendo coerenti persona e auto.
- [7] 6+ Best AI Video Generation Websites — infografica da salvare che confronta Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI e Hailuo AI per funzioni, destinatari e disponibilità di un piano gratuito.
- [10] Veo 2 — pin promozionale per VideoFX di Google, con una scena fotorealistica di una persona al microscopio, un nuotatore sott’acqua e una donna in stile animazione che danza con costellazioni.
- [14] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — immagine promozionale che comunica la generazione da immagine a video tramite Gemini API, evidenziando il supporto audio nativo.
- [23] Microsoft Unveils VASA-1 — tecnologia che genera un video parlante espressivo, quasi in tempo reale, da una foto, un clip audio e segnali di controllo opzionali. La miniatura mostra molte etnie ed espressioni.
- [27] ShengShu Technology Unveils Vidu S1 — pin di annuncio di Vidu S1 di ShengShu Technology, che promuove generazione interattiva in tempo reale, con visual cyberpunk.
- [31] Google announces video generation AI 'Veo 3' — quattro output che inseriscono un’immagine d’ingresso, un pupazzo mostro viola, in una sala server realistica, rovine sommerse e una città di caramelle.
- [33] 'Amuse 3.0', an AI art creation tool — annuncio della nuova versione dello strumento locale per arte IA di AMD, basato sulla famiglia Stable Diffusion. È uno dei pochi segnali concreti locali/open in un insieme dominato dal closed-source.
- [42] Breaking News Latest AI Developments — riepilogo di tre notizie: funzioni agente di Grok 4.6, Gemini oltre un miliardo di utenti con 150 milioni di immagini generate al giorno, e Honor AI Robot Phone; datato 12 agosto 2026.
Segnali
- I closed-source hanno una presenza nettamente superiore. Google Veo 2/Veo 3, Microsoft VASA-1, OpenAI, Grok 4.6 e Gemini oltre il miliardo di utenti diventano direttamente soggetti dei pin. Al contrario, i nomi open source classici — Stable Diffusion, ComfyUI, Flux, Wan, HunyuanVideo e LTX — quasi non compaiono nelle immagini campionate, salvo Amuse 3.0 di AMD. Pinterest sembra rivolto più a consumatori e marketer che a una comunità tecnica.
- Forte concentrazione sugli usi legati al volto. Lip sync, riproduzione delle espressioni, alternativa ai servizi fotografici e video stile presentatore ricorrono spesso. È probabilmente il punto d’incontro tra la domanda Pinterest, legata a bellezza, auto-presentazione e idee per social, e il marketing dell’IA video.
- Prevalgono i riepiloghi secondari rispetto alle fonti primarie. Le miniature con volto del presentatore e titolo o le infografiche comparative sono più comuni degli screenshot degli output dei modelli. Pinterest funziona più come porta d’ingresso verso blog, video YouTube e articoli affiliati che come luogo di diffusione di annunci primari.
- Segnale d’assenza: nel campione non sono stati trovati pin che menzionino post in giapponese, aziende giapponesi, startup IA locali o servizi nazionali di generazione video. Quasi tutto riguarda strumenti e notizie in lingua inglese.
Limiti
- Dei 50 elementi in
output/pinterest.pins.md, sono state aperte e verificate 24 immagini rappresentative. Per i restanti 26 sono stati letti soltanto i titoli; si presume che rientrino nei pattern visivi delle immagini aperte — infografiche, ritratti e confronti di strumenti. - Otto pin sono intitolati “(untitled)” ([12, 19, 20, 30, 35, 39, 46, 50]); sono state aperte le immagini [39] e [50], mentre le altre non sono state verificate.
- I dati pre-raccolti dal worker di questa fase non contengono una segmentazione per genere:
pinterest.pins.mdè un elenco piatto e non è stata calcolata una ripartizione per categoria. - Pinterest non è stato esplorato direttamente: secondo il playbook, l’analisi usa solo immagini e titoli pre-raccolti dal worker. I dati non includono metriche di engagement, come like, salvataggi e commenti.
Azioni consigliate
- Ripetere la ricerca su X con termini espliciti per modelli e strumenti — Stable Diffusion, ComfyUI, Flux, Wan, Kling e Sora — invece di affidarsi ai trend.
- Creare un elenco permanente di account Bluesky noti da interrogare con
getAuthorFeed, dato cheapp.bsky.feed.searchPostsha restituito 403 in questa raccolta. - Segnalare esplicitamente modelli ibridi open/commerciali come MiniMax H3 invece di inserirli in una sola categoria.
- Mantenere un monitoraggio ricorrente delle riconversioni o delle chiusure dei grandi operatori, come il pivot medicale di Midjourney e il fine vita della Sora API, perché hanno ottenuto più attenzione delle pure notizie di rilascio su Reddit e Lemmy.
- Trattare Pinterest come indicatore del sentiment dei consumatori e non come feed tecnico di fonti primarie, vista la quasi totale assenza di copertura open source.
Immagini raccolte


















































Nota sulla qualità dei dati
X e Bluesky sono rimasti molto sotto la soglia richiesta di circa 20 post per piattaforma: X ha restituito solo 4 post pertinenti, tutti closed-source; l’API di ricerca di Bluesky ha restituito 403, quindi la copertura si è basata su account noti. Anche Reddit, Lemmy e YouTube hanno raccolto meno elementi dell’obiettivo, e YouTube non ha potuto confermare visualizzazioni e iscritti a causa delle pagine renderizzate in JavaScript.



