Notizie sull’IA per la generazione di immagini e video — 2026-09-22
La chiusura dell’API di Sora il 2026-09-24 è la principale storia del momento nel mondo closed-source, mentre MiniMax H3 e i laboratori cinesi con pesi aperti (Alibaba/Qwen, ByteDance, Baidu, Tencent) stanno trainando l’ecosistema open source in più rapida crescita, incentrato su ComfyUI.
Notizie sull’IA per la generazione di immagini e video — 2026-09-22
La maggiore notizia closed-source è la cessazione completa dell’API di generazione video Sora di OpenAI il 2026-09-24 (due giorni dopo questo report): l’app era già stata chiusa ad aprile e, con costi operativi di circa 1 milione di dollari al giorno a fronte di ricavi cumulati di circa 2,1 milioni, il peggioramento dell’economia del servizio ne è alla base. Nel frattempo GPT Image 2.5 e Nano Banana Pro/2 di Google DeepMind competono su velocità e fotorealismo, e la corsa allo sviluppo tra gli operatori closed-source si è intensificata con aggiornamenti ogni poche settimane. Sul fronte open source, l’ecosistema ComfyUI continua a crescere attorno a MiniMax H3, con un flusso evidente di nuovi modelli dai laboratori cinesi come Alibaba (Qwen), ByteDance, Baidu e Tencent. Su più piattaforme emergono anche opinioni secondo cui il divario qualitativo percepito tra closed e open source si sta riducendo.
Tra le piattaforme
- La fine dell’API Sora (2026-09-24) è il principale tema condiviso nel closed source. Il post di Ed Zitron su Bluesky (3.572 like, il maggiore coinvolgimento dell’intera raccolta) ha dato la notizia in anteprima; lo stesso tema è apparso in un video di sintesi sullo stato dell’AI video su YouTube e in un post !ai_reddit su Lemmy. Tre piattaforme lo trattano indipendentemente come il fatto più importante, citandolo come esempio del fatto che il closed source non è necessariamente un mercato in cui il vincitore prende tutto, dati i problemi di redditività tra ricavi e costi.
- MiniMax H3 è la parola chiave comune della generazione video open source. Su Reddit si discute concretamente di come usare gratuitamente Wan e MiniMax H3; Adina Yakup su Bluesky presenta “HyperFlow”, una variante ad alta velocità di MiniMax H3 distillata in 8 passaggi; su Lemmy sono stati pubblicati più di cinque nodi dedicati a MiniMax H3 per ComfyUI tra agosto e settembre 2026. Lo stesso modello emerge indipendentemente su tre piattaforme: è probabilmente il modello video a pesi aperti con più slancio.
- GPT Image 2.5 viene citato su tre piattaforme come modello di riferimento per la generazione di immagini closed-source. Su Reddit (r/ImagineAiArt, thread da 92 punti) riceve sia grandi elogi sia commenti secondo cui non si percepisce alcuna differenza rispetto a KREA2; YouTube spiega la riduzione del 50% della latenza e la funzione Sketch; Simon Willison su Bluesky ha generato con questo modello vere immagini concettuali.
- I laboratori cinesi sono particolarmente presenti sul fronte open source. Bluesky (Adina Yakup), YouTube e Lemmy riportano ripetutamente modelli a pesi aperti con licenze in stile Apache-2.0 di aziende cinesi: Alibaba (Qwen-Image-2.1), ByteDance (Lance, Seedance), Baidu (ERNIE-Image) e Tencent (HunyuanVideo 1.5). Più piattaforme confermano un panorama in cui le realtà cinesi sono quasi le protagoniste delle tendenze open source.
- ComfyUI è diventata di fatto la base comune. Quasi tutti i video di recensione su YouTube e gran parte dei post su !«メールアドレス» trattano implementazioni e workflow su ComfyUI: l’uso pratico degli strumenti open source sta convergendo lì.
- Il divario qualitativo percepito tra closed e open source si sta restringendo. Su Reddit un commento afferma che “GPT Image 2.5 e KREA2 producono risultati che sembrano uguali”, mentre Pinterest mostra una forte predominanza del marketing closed-source e quasi nessuna menzione dell’open source. Questo probabilmente non indica che l’open source sia debole, ma che sia meno visibile presso il pubblico generalista.
Piattaforma per piattaforma
Reddit: raccolti 12 thread da 7 subreddit. La domanda di generazione gratuita di video IA e il tono sprezzante del “capisci che non è più possibile” sono la linea di frattura principale; nei commenti emergono spontaneamente numerosi suggerimenti verso modelli a pesi aperti come Wan e MiniMax H3. Anche il forte aumento degli utenti DeepSeek (+66,7%) e il divario nella capacità di calcolo sono segnalati come un indicatore chiaro. Lo stesso commento promozionale con codice referral compare in più thread, quindi occorre cautela rispetto all’infiltrazione pubblicitaria nelle discussioni organiche.
X: tra 32 post raccolti da 31 account, nessuno menzionava IA per la generazione di immagini o video. I termini usati per la ricerca (Bitcoin, Zelensky, Zagreb ecc.) riutilizzavano direttamente i trend Explore standard di X, presumibilmente trend regionali dell’area croata, e non erano pertinenti al tema. X non ha quindi fornito conoscenze sostanziali su questo argomento.
YouTube: trovati oltre 30 titoli tramite WebSearch e selezionati 13 video rappresentativi. Sul lato closed, il confronto a tre tra GPT Image 2.5, Nano Banana Pro/2, Sora 2, Veo 3.1 e Kling 3.0 è il formato ricorrente. Sul lato open, prosegue la tendenza a “ridurre il peso senza compromettere le prestazioni” con Z-Image Turbo, Qwen-Image-2.1, LTX-2 e HunyuanVideo 1.5. Poiché le pagine sono renderizzate in JavaScript, visualizzazioni e date esatte non hanno potuto essere ottenute e vanno considerate approssimative.
Bluesky: poiché l’API di ricerca (searchPosts) ha restituito 403 per tutto il tempo, è stata usata come alternativa la lettura diretta dei feed degli account pertinenti. Il post di Ed Zitron sulla fine di Sora ha avuto il maggior coinvolgimento. Le notizie open source dipendono quasi interamente da Adina Yakup di Hugging Face; gli account ufficiali di Civitai, ComfyUI e Stability AI erano in gran parte silenziosi o inattivi.
Lemmy: analizzati 16 post in 8 comunità. Le notizie closed-source arrivano quasi tutte di seconda mano attraverso mirror Reddit (!ai_reddit) o Hacker News (!hackernews), con punteggi bassi. L’unico post diventato virale riguarda la conversione del business di Midjourney dalla generazione di immagini agli scanner CT a ultrasuoni medicali (punteggio 40). Sul lato open source, i post di nodi ComfyUI per MiniMax H3 sono comparsi con continuità tra agosto e settembre.
Pinterest: analizzati 50 pin. Dominano immagini-listicle del tipo “Best AI Video Generator” e materiali generici con robot IA; Kling AI e Hailuo AI appaiono entrati nella fascia alta insieme a Runway, Pika e Luma. Le menzioni dell’open source sono di fatto zero su 50 pin, salvo una sola intestazione “Open Models. Open weights.”: un risultato importante che indica come l’open source sia quasi invisibile sulle piattaforme per consumatori.
Tra le sei piattaforme previste dal brief, X (zero risultati reali per un errore nella scelta dei termini di ricerca) e Reddit (12 thread contro l’obiettivo di 20) non soddisfano il criterio di completamento di “analizzare circa 20 post”. Questi limiti sono dichiarati esplicitamente; l’assenza di altre piattaforme non richieste dal brief è fuori ambito.
Cosa osservare
- La competizione per le migrazioni dopo la chiusura dell’API Sora (2026-09-24) — Bluesky, post di Ed Zitron: https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
- Il problema della “licenza di ricerca non commerciale” di Qwen-Image-2.1 — dibattito sul fatto che possa davvero essere definito open source. YouTube: https://www.youtube.com/watch?v=tP_gGGJzEqg
- Il ritmo di espansione dell’ecosistema MiniMax H3 × ComfyUI — Lemmy: https://lemmy.dbzer0.com/post/74279236
- Se LTX-2 diventerà il nuovo benchmark del video open source — YouTube: https://www.youtube.com/watch?v=27UAb_Tlv4E
- Le conseguenze dell’aumento della domanda DeepSeek (+66,7%) e della carenza di calcolo — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- Ulteriori notizie sulla conversione di Midjourney alle apparecchiature mediche — Lemmy: https://awful.systems/post/8731127
Raccomandazioni
- Nel prossimo ciclo di ricerca, seguire quale tra Seedance 2.5, MiniMax H3 e Kling v3 assorbirà il traffico migrato subito dopo la fine dell’API Sora.
- Monitorare continuamente gli annunci ufficiali di Hugging Face e Alibaba per capire se cambierà la licenza di Qwen-Image-2.1.
- Osservare a intervalli regolari la frequenza dei post sui nodi ComfyUI per MiniMax H3 come indicatore anticipatore dello slancio della generazione video open source.
- Nella prossima raccolta su X, abbandonare la dipendenza dai trend regionali e usare termini specifici del tema, come "AI image generation", "Sora" e "Midjourney".
- Passare anche su Reddit da una singola query a più ricerche basate sui nomi dei singoli modelli, così da raggiungere il criterio di completamento di 20 elementi.
- Verificare il passaggio di Midjourney agli ultrasuoni CT medicali sulla fonte primaria (midjourney.com/medical), separandolo dalle informazioni secondarie diventate virali.
Qualità dei dati
A causa dell’errore nella selezione dei termini di ricerca, X ha raccolto 32 post ma zero pertinenti al tema e non ha potuto offrire conoscenze sostanziali. Reddit è rimasto a 12 thread da una sola query, sotto l’obiettivo di circa 20. Poiché l’API di ricerca ufficiale di Bluesky ha restituito 403 in modo costante, il campionamento è stato effettuato con lettura diretta degli account e non con una ricerca esaustiva per parole chiave. YouTube non ha consentito di ottenere visualizzazioni e date di pubblicazione esatte per via delle pagine renderizzate in JavaScript, quindi le date sono approssimative. Lemmy non consente una ricerca trasversale tra tutte le istanze distribuite e la verifica è limitata alle sei principali istanze. Pinterest ha consentito di analizzare 50 elementi, ma con quasi nessuna menzione dell’open source, risultando quindi sbilanciato verso la prospettiva closed-source.
Riepilogo per piattaforma
Reddit — Notizie sull’IA per la generazione di immagini e video
Dove
I 12 thread raccolti provengono da 7 subreddit.
| Subreddit | Membri | Thread raccolti |
|---|---|---|
| r/generativeAI | 155.851 | 5 |
| r/ImagineAiArt | 19.415 | 1 |
| r/aivideomaking | 7.414 | 2 |
| r/DeepSeek | 140.403 | 1 |
| r/Purdue | 100.714 | 1 |
| r/aivideos | 123.539 | 1 |
| r/Instagramreality | 1.155.229 | 1 |
r/generativeAI è il più rappresentato e il centro della discussione è la domanda stessa: “voglio creare video IA gratuitamente”. I subreddit specialistici (r/aivideomaking, r/aivideos, r/ImagineAiArt) discutono strumenti e tecniche concrete; r/DeepSeek tratta notizie di un singolo modello; r/Purdue e r/Instagramreality, una comunità enorme con oltre 1,15 milioni di membri, riguardano casi in cui contenuti generati dall’IA si sono infiltrati nel mondo reale provocando polemiche.
Cosa dicono le persone
- La domanda di video IA gratuiti resta forte, ma il tono della comunità si orienta verso “capisci che non è più possibile”. Nel thread #2 “Why do so many people expect to find a free AI video generator?” (39 punti, 79 commenti, 2026-09-21, https://www.reddit.com/r/generativeAI/comments/1wm2csy/) l’autore stesso osserva che “Sora 2 è stato pubblicato gratuitamente e ha raccolto moltissimi utenti, ma OpenAI lo ha comunque interrotto”, concludendo: “AI video generation is just expensive, and free is not a sustainable model”.
- Nel medesimo thread, u/buttchuckjones (4 punti) afferma di essere passato da 10 GB di VRAM a una 5080 (16 GB) per generare in locale e auspica che più utenti del subreddit scelgano la generazione locale, sostenendo così il fronte locale/open source.
- Nel thread #1 “Which AI video generator can still be used for free?” (20 punti, 68 commenti, 2026-09-16, https://www.reddit.com/r/generativeAI/comments/1whtesl/), u/RioMetal (4 punti) raccomanda modelli a pesi aperti come Wan o Minimax: “If you can go local you have plenty of them, like Wan or Minimax”. u/tuckken2 (3 punti) condivide un metodo d’uso concreto: “Wan 2.2 and Minimax H3 are free on cnaps studio, credit resets every 5 hours”.
- Sul fronte closed-source, GPT Image 2.5 Flare è al centro dell’attenzione. Nel thread #3 “GPT Image 2.5 Flare — is this actually the best AI image generating model right now?” (92 punti, 62 commenti, 2026-09-16, https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/) u/oldboi777 (4 punti) lo definisce un aggiornamento incredibile, mentre u/Dependent_Quit_3730 (3 punti) dice che, pur essendo un modello perfetto, continuerà a usare KREA 2. u/SeaworthinessFresh16 (2 punti) rileva inoltre che “The result in Comfyui with Krea2 looks the same”, quindi non percepisce differenze rispetto agli strumenti open.
- DeepSeek, a pesi aperti, cresce rapidamente ma soffre al tempo stesso di carenze di capacità. Il thread #6 “some deepseek news, if you care” (206 punti, 36 commenti, 2026-09-21, https://www.reddit.com/r/DeepSeek/comments/1wmcgex/) riporta utenti attivi giornalieri saliti da 120 a 200 milioni (+66,7%), mentre la potenza di calcolo sarebbe aumentata solo dell’8,3%, causando cali di qualità e problemi di rigenerazione. Come risposta, sarebbe stato effettuato un ordine a Huawei di 160.000 Ascend 960DT. u/Equivalent-Grass-527 (6 punti) commenta: “The demand vs. compute mismatch is probably the most important part here”.
- Le opinioni sulla maestria necessaria per eliminare l’“aspetto IA” sono divise. Il thread #8 “I stopped prompting for clean shots and my AI video finally stopped looking like AI” (63 punti, 56 commenti, 2026-09-20, https://www.reddit.com/r/aivideos/comments/1wl6op9/、Seedance 2.5使用) condivide tecniche di prompt dettagliate, ma i commenti sono scettici. u/TCristatus (9 punti) dice: “What a load of waffle, and the video is still obviously AI”; u/Biscuits4u2 (6 punti) sostiene che servirebbero persone “5 percent uglier” per renderlo realistico, perché i volti sono troppo perfetti.
- I casi in cui immagini generate dall’IA entrano in contesti reali stanno suscitando polemiche. Nel thread #7 “AI generated image on MSEE wall” (61 punti, 13 commenti, 2026-09-21, r/Purdue, https://www.reddit.com/r/Purdue/comments/1wmq43f/) viene criticata l’assurdità del layout della scheda elettronica in un’immagine IA esposta nel campus. u/j909m (11 punti) commenta: “Whoever did the PCBA layout for that IC gets an F.”
- Anche in un subreddit enorme con oltre 1,15 milioni di membri, identificare immagini IA provoca dibattiti accesi. Il thread #12 “AI generated images on Reddit with thousands of upvotes and comments” (2.109 punti, 341 commenti, 2026-09-18, r/Instagramreality, https://www.reddit.com/r/Instagramreality/comments/1wk0euk/) è di gran lunga quello con il maggior coinvolgimento della raccolta. u/Smart-Membership-117 (405 punti) evidenzia incongruenze nei dettagli, come i battiscopa e la vegetazione esterna alla finestra; u/Negative-Raise-8286 (275 punti) lamenta di non aver potuto pubblicare queste osservazioni nel thread originale.
- Più voci sostengono anche che i crediti gratuiti siano generosi, quindi il quadro non è solo pessimista. Nel thread #9 (r/aivideomaking, 3 punti, 26 commenti, 2026-09-15, https://www.reddit.com/r/aivideomaking/comments/1wh80z3/) u/Chance-Business (2 punti) valuta positivamente i 50 crediti gratuiti giornalieri di Google Flow (Veo). Anche nel thread #4 (https://www.reddit.com/r/aivideomaking/comments/1wled0f/) u/MrBoondoggles (1 punto) afferma che Nanobanana e Veo in Google Flow dispongono di una quota giornaliera gratuita molto generosa.
- La stessa promozione con codice referral compare in più thread. u/MeatStickMcFapperton pubblica nei thread #2 (4 punti) e #5 (1 punto) commenti quasi identici per promuovere il codice referral “42JB8K” di Meta “Muse” e “un miliardo di token gratuiti”.
Segnali
- Tendenza in crescita: le menzioni della generazione video locale/a pesi aperti (Wan, MiniMax H3, FramePack, ComfyUI) emergono spontaneamente nella maggior parte dei thread sul desiderio di gratuità. Anche la crescita degli utenti DeepSeek (+66,7%) è un chiaro segnale rialzista.
- Scetticismo e durezza: vi è forte ostilità verso la richiesta stessa di video IA gratuiti. u/activematrix99 (2 punti) nel thread #4 paragona la richiesta al presentarsi in un ristorante pretendendo di mangiare gratis. Il fatto che commenti severi contro la pretesa di generazione video gratuita ricevano molti voti indica un cambiamento del clima della comunità.
- Elemento sorprendente: lo stesso codice referral (“42JB8K”) e argomentazioni promozionali quasi identiche compaiono più volte in thread diversi, rendendo molto probabile la presenza di commenti pubblicitari o auto-promozionali nelle discussioni organiche. Occorre prudenza nell’interpretare i numeri.
- Conflitto: il fronte secondo cui “la generazione video gratuita è ormai un’illusione” e quello secondo cui le quote gratuite di Google Flow/Veo/Muse/Nanobanana sono normalmente molto generose si scontrano apertamente negli stessi gruppi di subreddit. Entrambe le posizioni si basano su esperienze dirette, quindi non è possibile dichiararne una semplicemente corretta.
- Il divario percepito tra closed e open è ridotto: nel thread #3, GPT Image 2.5 Flare, closed-source, e KREA 2, che usa strumenti open, vengono descritti come capaci di risultati indistinguibili, suggerendo che il divario qualitativo nella generazione di immagini si sia quasi colmato dal punto di vista dell’utente.
Limiti
- Lo strumento di raccolta ha usato una sola query: “Image and Video Generation AI News”. A fronte del criterio del brief di analizzare circa 20 post per ogni social, sono stati trovati solo 12 thread in 7 subreddit. Ricerche aggiuntive con parole quali “Sora”, “Veo”, “Kling”, “Stable Diffusion”, “Flux”, “open source” / “closed source” avrebbero probabilmente trovato più thread mirati.
- Per il thread #9, i dati raccolti non includono il testo del post e il contenuto è stato dedotto solo dai commenti.
- Secondo le istruzioni del playbook di questa fase, Reddit non è stato esplorato o cercato autonomamente: la verifica è limitata ai file già raccolti
output/reddit.threads.md/.json. Discussioni non contenute lì, ad esempio thread dedicati a specifici modelli, restano fuori dal report.
X
X — Notizie sull’IA per immagini e video
Account
Sono stati verificati 32 post di 31 account raccolti in output/x.posts.md, ma nessun account trattava IA per la generazione di immagini o video. La composizione è sbilanciata verso aree non pertinenti:
| Genere | Account pertinenti |
|---|---|
| Criptovalute/azioni ($SDOG, $AMD, Bitcoin) | @SDOGWITHSNAP, @DeItaone, @AJM_web, @S500ALERTS, @blackwidowbtc, @0xSweep, @USronaldcarter, @TedPillows |
| Guerra Ucraina-Russia | @dystoman, @sentdefender, @Polymarket, @Alex_Oloyede2, @bayraktar_1love, @AlaskanTzar, @SomaliSasuke, @gmanredux, @idkmypronouns, @Katauroraaa, @AbotGrenfield, @jaccocharite |
| Gossip su spettacolo e politica (Lauren) | @Rach_delauren, @fvslaurs, @LimeriTweets, @karignejauregui |
| Sport e combattimenti (Muhammad) | @CylinderAnalyst, @bullyb170(2 post) |
| Religione | @TaymiFawaid |
| Account personali legati al trend geografico Zagreb | @slimey34, @AlphaGainer, @enafriedric2372, @Earldormancy |
Coesistono account che ottengono quasi tutto il coinvolgimento da un unico enorme post, come @AlaskanTzar con 34.704 like, e account che accumulano piccoli post; in ogni caso, nessuno pubblicava notizie o strumenti di IA per immagini o video.
Post
Poiché nei dati raccolti non esistono post coerenti con il tema, non è possibile riportare le normali “5–12 osservazioni” sull’IA per la generazione di immagini e video. A titolo di riferimento:
- #8 @TedPillows (2.829 like, 293 repost, circa 486.000 visualizzazioni, 2026-09-20, https://x.com/TedPillows/status/2101642897535762562) — analisi sul prezzo di Bitcoin, senza relazione con l’IA.
- #30 @AlaskanTzar (34.704 like, 1.083 repost, circa 1.500.000 visualizzazioni, 2026-09-20, https://x.com/AlaskanTzar/status/2101819330703032636) — meme sulla Russia e sull’Ucraina, il maggior coinvolgimento dell’intera raccolta ma non pertinente.
- #22 @Katauroraaa (2.840 like, circa 309.000 visualizzazioni, 2026-09-20, https://x.com/Katauroraaa/status/2101716186132087180) — battuta su Russia e Paesi baltici.
Nessuno di questi post menziona, né in ambito closed-source né open-source, la generazione di immagini o video con IA.
Segnali
- L’unico “segnale” ricavabile dai dati è che i termini di ricerca della fase non erano pertinenti al tema. Usando direttamente i trend Explore di X, la raccolta è rimasta su criptovalute, geopolitica, gossip e sport.
- Non è stata osservata neppure una discussione sostanziale che permetta di dire se l’IA per immagini e video sia in crescita o oggetto di scetticismo.
Limiti
-
Termini di ricerca non pertinenti: come riportato all’inizio di
output/x.posts.md, le query usate erano"$SDOG", "Bitcoin", "Zelensky", "Lauren", "Muhammad", "Russians", "Zagreb", "Ukraine", "Weeknd", "USSR". Erano la lista Explore di X e non includevano nessun termine come “AI image generation”, “AI video generation”, “Sora”, “Midjourney” o “Stable Diffusion”.# Trend Luogo (indicazione di X) 1 $SDOG Di tendenza in Croazia 2 Bitcoin Business e finanza · Di tendenza 3 Zelensky Politica · Di tendenza 4 Lauren Di tendenza in Croazia 5 Muhammad Politica · Di tendenza 6 Russians Politica · Di tendenza 7 Zagreb Di tendenza in Croazia 8 Ukraine Politica · Di tendenza 9 Weeknd Di tendenza in Croazia 10 USSR Di tendenza in Croazia Questa lista Explore sembra collegata geograficamente al luogo del server usato dalla sessione, presumibilmente nell’area croata, e non ai trend mondiali.
-
Criterio di completamento non soddisfatto: il brief richiede di analizzare circa 20 post per ciascun social, ma dei 32 raccolti nessuno riguarda IA per immagini o video. X non può quindi fornire conoscenze sostanziali sul tema nel presente report.
-
La sessione era valida: sono state effettuate raccolte autenticata e non sono comparsi messaggi di assenza di post. Il problema non era la ricerca o la navigazione di X, bensì la scelta delle query in fase di raccolta.
-
Nel prossimo ciclo occorrerà raccogliere nuovamente usando termini pertinenti come “AI image generation”, “AI video generation”, “Sora 2”, “Midjourney”, “Stable Diffusion”, “Nano Banana” e “Veo”.
YouTube
YouTube — Notizie sull’IA per immagini e video (closed source/open source)
Canali
- Matt Wolfe (@mreflow) — canale di notizie IA con oltre 925.000 iscritti, che pubblica costantemente recensioni rapide di novità closed-source come Nano Banana Pro e Nano Banana 2. (https://www.youtube.com/@mreflow)
- Theoretically Media — canale specializzato in recensioni e test pratici di strumenti video IA open source, tra cui LTX-2 / LTX-2.3 e la famiglia HunyuanVideo. (https://theoreticallymedia.com/videos/)
- Aitrepreneur — particolarmente forte nelle spiegazioni di workflow ComfyUI e nell’installazione locale dei più recenti modelli video open source, come LTX-2.3. (Collegamento Patreon: https://www.patreon.com/aitrepreneur)
- Altri canali di recensione IA di medie dimensioni trattano Z-Image Turbo, Flux.2 e HunyuanVideo 1.5; sono stati identificati dai titoli dei video, ma iscritti e nomi dei canali non sono stati confermati — vedere Limiti.
Video
-
Google won image generation (it's not even close) — NANO BANANA PRO BREAKDOWN
data: 2025-11-26 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=UV9GqinedQ8
Recensione closed-source che sostiene come Nano Banana Pro (Gemini 3 Pro Image) di Google DeepMind superi i generatori di immagini esistenti a un livello “senza confronto”, evidenziando accuratezza del rendering testuale e fotorealismo. -
Google's Nano Banana Pro is raising concerns over realistic AI image generation
data: fine novembre 2025 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=RmmrVCUGYp8
Video di notizie sulle preoccupazioni per deepfake e disinformazione dovute a un fotorealismo troppo elevato. -
GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model
data: circa 2026-09-08 (pubblicato due settimane prima) | visualizzazioni: non confermate | https://www.youtube.com/watch?v=DY6TkI8XtkQ
Spiegazione completa di GPT Image 2.5 di OpenAI: latenza di generazione ridotta del 50% e funzione Sketch che converte disegni a mano in immagini IA. -
Sketch with ChatGPT Images 2.5
data: inizio settembre 2026 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=imPtIEAEHSU
Demo della nuova funzione di ChatGPT che trasforma un disegno manuale in immagine IA digitando “@Sketch”. -
State of AI Video in 2026: Sora 2, Veo 3.1, Kling 3.0 & Cinematic Prompting Workflows
data: 2026-03-20 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=vtJzDgmWVWc
Video di sintesi che confronta Sora 2, Veo 3.1 e Kling 3.0, i tre principali generatori video closed-source, includendo tecniche di prompting cinematografico. -
Seedance 2.5 REVIEW: ByteDance's New AI Video Model Explained
data: 2026-08-01 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=LTAOvsH6cjM
Seedance 2.5 di ByteDance supporta generazioni in piano sequenza da 30 secondi e fino a 50 immagini di riferimento; è oggetto di interesse per una durata superiore a Sora 2 e Veo 3.1. Closed-source. -
Kling 2.6 Pro DESTROYS Competition - Veo 3.1 & Sora 2 Pro
data: 2025-12-19 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=-vRsjX9seUU
Benchmark secondo cui Kling 2.6 Pro superava già Veo 3.1 e Sora 2 Pro prima dell’arrivo di Kling 3.0. Lo slancio sarebbe poi continuato con Kling 3.0, pubblicato il 2026-02-05 e primo con un punteggio ELO di 1.243. -
Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro)
data: 2025-11-27 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=sPQQPpQ9X4E
Modello da 6 miliardi di parametri, con licenza Apache-2.0, del team Tongyi-MAI di Alibaba. Offre inferenza veloce in 8 passaggi su GPU consumer da 16 GB ed è presentato come comparabile a Nano Banana Pro. -
New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial
data: 2025-12-11 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=JF4Q5hXh-_Q
Tutorial e confronto che presenta Z-Image come superiore a Flux.2. -
FLUX.2 EL MEJOR MODELO OPEN SOURCE, EN LOCAL Y GGUF
data: circa novembre-dicembre 2025 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=t4eVxZPP0b0
Guida all’esecuzione locale in ComfyUI di FLUX.2 di Black Forest Labs, inclusa la serie con Klein, Apache-2.0. I punti di forza sono output fino a 4 MP e coerenza multiriferimento fino a 10 immagini. -
The "Holy Grail" of Open Source AI Video is Here (LTX-2)
data: inizio gennaio 2026 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=27UAb_Tlv4E
LTX-2, pubblicato da Lightricks il 2026-01-06, è lodato come il primo modello video open source “di qualità produttiva” con 4K nativo, sincronizzazione audio, pesi completamente aperti e persino codice di addestramento. -
Tencent HunyuanVideo 1.5 has been officially open-sourced!
data: prima metà del 2026 | visualizzazioni: non confermate | https://www.youtube.com/watch?v=MJShdc8tkkA
Tencent ha pubblicato HunyuanVideo 1.5, riducendo i parametri da 13B a 8,3B senza compromettere le prestazioni. È apprezzato perché gira su GPU consumer. -
Qwen-Image 2.1 | Early Access Showcase
data: circa 2026-09-20 (pubblicato due giorni prima) | visualizzazioni: non confermate | https://www.youtube.com/watch?v=tP_gGGJzEqg
Demo in accesso anticipato di Qwen-Image-2.1 di Alibaba Qwen, pubblicato il 2026-09-20: generatore visivo compresso a 7B, generazione e modifica unificate, output RGBA trasparente. La licenza è tuttavia esclusivamente per ricerca non commerciale.
Segnali
- La competizione closed-source su “velocità e fotorealismo” è molto intensa: GPT Image 2.5 (2026-09-08, latenza ridotta del 50%) e Nano Banana Pro → Nano Banana 2 (2026, velocità raddoppiata) mostrano OpenAI e Google in gara con aggiornamenti a poche settimane di distanza. Nel video, i confronti a tre tra Sora 2, Veo 3.1 e Kling 3.0 sono diventati il formato standard.
- Sora verrà chiuso insieme alla sua API: Sora Web/app è già terminato il 2026-04-26 e anche l’API è prevista in chiusura il 2026-09-24, due giorni dopo la redazione del report. Vengono citati costi operativi di circa 1 milione di dollari al giorno contro ricavi cumulati di circa 2,1 milioni: un esempio dei limiti del paradigma “il vincitore prende tutto” nel video closed-source.
- Il fronte open source si sposta verso modelli leggeri e veloci: Z-Image Turbo (6B, Apache-2.0), Qwen-Image-2.1 (generatore visivo compresso a 7B) e HunyuanVideo 1.5 (13B → 8,3B) seguono tutti la direzione di ridurre i parametri senza ridurre le prestazioni, per poter girare su GPU consumer.
- Il confine tra pesi aperti e licenza commerciale è un tema centrale: parte di Flux.2, inclusa Klein, è pienamente aperta in Apache 2.0, mentre Qwen-Image-2.1 pubblica i pesi con una licenza solo per ricerca non commerciale. Sia nei commenti sia nei video di recensione appare il dibattito: si può davvero chiamare open source?
- LTX-2 diventa un benchmark del video open source: la combinazione di 4K nativo, sincronizzazione audio e pubblicazione del codice di addestramento è descritta come una prima assoluta, e più canali confrontano LTX-2 con Wan 2.2 e HunyuanVideo 1.5 nella generazione locale.
- ComfyUI è di fatto l’infrastruttura comune: per Flux.2, Z-Image, LTX-2, Wan e HunyuanVideo sono comparsi molti video di supporto Day-0 e workflow in ComfyUI; quasi tutte le recensioni open source includono test pratici su ComfyUI.
Limiti
- Le pagine dei risultati YouTube (
/results?search_query=...) e dei video (/watch?v=...) sono renderizzate in JavaScript e WebFetch ha ottenuto solo i link di navigazione nel piè di pagina. Non è stato possibile recuperare direttamente conteggi di visualizzazioni, nomi precisi dei canali, date di pubblicazione o testi di sottotitoli/commenti. Le date del report sono quindi stime basate su snippet dei risultati e articoli correlati, mentre le visualizzazioni sono tutte segnate come non confermate. - Per tali limitazioni non è stato possibile eseguire il processo ideale del playbook, cioè aprire e analizzare una ventina di post singolarmente. È stato adottato un metodo alternativo basato su titoli, indizi sui canali e periodo di pubblicazione ottenuti via WebSearch. Sono stati trovati oltre 30 titoli, dei quali i 13 sopra riportati sono esempi rappresentativi.
- I video su Qwen-Image-2.1 erano online da appena due giorni, quindi il numero assoluto di recensioni era ancora limitato; è probabile che aumenti nelle settimane successive.
Bluesky
Bluesky — Notizie sull’IA per la generazione di immagini e video
Account
- Ed Zitron (
edzitron.com) — critico dell’industria tech/IA (Where's Your Ed At); ha diffuso su Bluesky la notizia della chiusura di Sora con un picco enorme di coinvolgimento. - Simon Willison (
simonwillison.net) — ricercatore IA indipendente; testa regolarmente nuovi modelli, inclusi generatori di immagini, con i suoi test del “pellicano” e pubblica le immagini concettuali che genera. - Adina Yakup (
adinayakup.bsky.social) — sostenitrice del ML open source presso Hugging Face; è di gran lunga la cronista più attiva su Bluesky delle nuove uscite di modelli a pesi aperti per immagini e video, con post quasi settimanali. - useapi.net (
useapi.bsky.social) — rivenditore di API REST per generazione IA di video, immagini e musica (Veo, Kling, Seedance, Runway, MiniMax ecc.); pubblica frequenti confronti diretti fra modelli. - GPT Image Prompt (
gptimageprompt.bsky.social) — account di condivisione prompt incentrato sullo strumento ChatGPT/GPT Image di OpenAI. - Stable Diffusion online AI (
stablediffusion.bsky.social) — storico account di comunità per prompt Stable Diffusion e sfide di arte IA. - Stability AI (ufficiale) — è diventato silenzioso su immagini/video da circa novembre 2025; i post recenti riguardano quasi tutti Stable Audio e partnership con etichette musicali, non Stable Diffusion.
Post
-
Ed Zitron — OpenAI chiude Sora (2026-03-24, 👍 3.572 · 🔁 984)
"Sia il Wall Street Journal sia The Information confermano che OpenAI sta chiudendo Sora: sia l’app sia l’accesso al suo modello di generazione video per gli sviluppatori. È una mossa enorme che suggerisce una situazione piuttosto disperata."
https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
(Questo è coerente con notizie secondo cui l’app Sora è stata chiusa il 26 aprile 2026 e l’API è programmata per il tramonto il 24 settembre 2026, due giorni dopo questa ricerca.) -
Simon Willison — sviluppo con ChatGPT Images 2.5 (2026-09-10, 👍 56 · 🔁 5)
"Ecco un modello Blender di un uovo Fabergé a tema Pluribus che GPT-6 Astra ha realizzato per me: ho generato l’immagine concettuale con ChatGPT Images 2.5."
https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24 -
Adina Yakup — HyperFlow (distillazione video open) (2026-09-19, 👍 6 · 🔁 1)
"HyperFlow⚡ Nuova variante MiniMax-H3 di Video Rebirth — LoRA a pesi aperti in 8 passaggi — 3× più veloce tramite distillazione autonoma senza dati — video + audio stereo intatti."
https://bsky.app/profile/adinayakup.bsky.social/post/3mvunely5222b -
Adina Yakup — Lance di ByteDance (2026-05-19, 👍 48 · 🔁 5)
"ByteDance ha pubblicato Lance👀 — Questo modello da 3B può generare immagini, modificare immagini, generare video, modificare video e comprendere sia immagini sia video."
https://bsky.app/profile/adinayakup.bsky.social/post/3mm6xqsryf22b -
Adina Yakup — ERNIE-Image di Baidu (2026-04-14, 👍 1)
"Baidu ha appena pubblicato ERNIE-Image su Hugging Face🔥 — DiT da 8B - Image/Image Turbo — Apache 2.0."
https://bsky.app/profile/adinayakup.bsky.social/post/3mjhrc3y7u22i -
Adina Yakup — Matrix-Game 3.0 di Skywork (2026-03-27, 👍 13 · 🔁 2)
"Matrix-Game 3.0🔥 modelli di mondi interattivi in tempo reale di Skywork — ✨ 720p a 40 FPS con un modello da 5B."
https://bsky.app/profile/adinayakup.bsky.social/post/3mi2efsyp7k2x -
Adina Yakup — LongCat-Video-Avatar 1.5 (2026-05-22, 👍 16 · 🔁 3)
"LongCat-Video-Avatar 1.5🐱 un modello di generazione video per avatar guidato dall’audio."
https://bsky.app/profile/adinayakup.bsky.social/post/3mmglm72zn22i -
Adina Yakup — HiDream-O1-Image (2026-05-19, 👍 10 · 🔁 2)
"HiDream-O1-Image sta attirando molta attenzione🔥"
https://bsky.app/profile/adinayakup.bsky.social/post/3mm73u27jek26 -
useapi.net — alternative API a Sora 2 (2026-09-21, 👍 0)
"Confronto, con codice, tra alternative API a Sora 2: Seedance 2.5, Omni Flash, MiniMax H3, Kling v3 #sora2 #seedance #kling #aivideo"
https://bsky.app/profile/useapi.bsky.social/post/3mvyugq6wgz27 -
useapi.net — MiniMax H3 contro Seedance 2.0 (2026-07-31, 👍 0)
"MiniMax H3 testa a testa con Seedance 2.0 usando identici riferimenti omni #minimax #seedance #ai #api"
https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x -
GPT Image Prompt — condivisione di prompt per meme (2026-05-07, 👍 0)
"Tema: Text to Meme — Prompt nei commenti — Benvenuti sul nostro sito: gptimageprompt.io #Chatgpt2 #GPTImagePropmt #AIPrompts"
https://bsky.app/profile/gptimageprompt.bsky.social/post/3mlaa6swzc226
Segnali
- La chiusura di Sora è la storia closed-source di cui Bluesky parla davvero. Il post di Ed Zitron è l’elemento con il maggior coinvolgimento dell’intera ricerca (3,5k like), molto superiore a qualsiasi lancio di modello. La comunità IA di Bluesky qui appare più orientata a narrativa e critica dell’industria che al marketing dei laboratori.
- Le notizie open source su Bluesky sono quasi il settore di una sola persona. Quasi tutte le uscite concrete di pesi aperti trovate — Baidu ERNIE-Image, ByteDance Lance, Skywork Matrix-Game 3.0, LongCat-Video-Avatar, HyperFlow e HiDream-O1-Image — provengono da Adina Yakup di Hugging Face. Il modello è fortemente trainato da laboratori cinesi, fra cui Baidu, ByteDance, Alibaba/Qwen, Ant Group, Skywork e Tencent, con licenze in stile Apache-2.0.
- Nessun grande laboratorio closed-source ha una presenza Bluesky attiva per lanci di immagini/video. Non sono emersi account ufficiali di OpenAI, Google DeepMind, Adobe o Midjourney. La copertura closed-source arriva invece indirettamente da tester indipendenti, come Simon Willison, o da rivenditori API terzi, come useapi.net.
- I post tecnici sugli strumenti ricevono quasi nessun coinvolgimento — 0–13 like per i confronti useapi.net e per gran parte delle uscite pubblicate da Adina Yakup — rispetto ai post narrativi sul destino di un’azienda, come la storia Sora con migliaia di like. Il coinvolgimento su questa piattaforma segue la narrativa industriale, non la novità tecnica.
- Diversi hub evidenti dell’arte IA sono morti o inattivi su Bluesky: gli account ufficiali e bot di Civitai, l’account ComfyUI e l’account stesso di Stability AI, che ha virato verso Stable Audio e partnership musicali e non pubblica più sui modelli di immagini Stable Diffusion dalla metà del 2025.
Limiti
- L’API pubblica di ricerca per parole chiave è bloccata.
app.bsky.feed.searchPostsha restituitoHTTP 403 Forbiddena ogni tentativo via WebFetch, con query di più parole, singole parole e formulazioni diverse; anche l’interfaccia webbsky.app/searchè interamente JavaScript client-rendered e non ha restituito contenuti dei post. Non è stato quindi possibile cercare davvero “X in questo momento”. Il materiale è stato ottenuto trovando handle pertinenti via ricerca website:bsky.appe leggendo poi direttamente le cronologiegetAuthorFeeddell’API AT Protocol pubblica, che invece funzionava. - Diversi account promettenti erano vuoti o inattivi:
civitai.bsky.social(feed vuoto),civitai-bot.bsky.social(ultimo post maggio 2024),real-comfyui.bsky.social(feed vuoto),runwayml.bsky.social(risolve a un account personale non correlato con un post del 2024),midjourney-api.bsky.social(rivenditore non ufficiale con un post da novembre 2024),qwen1.bsky.social(account fan con un post da febbraio 2025). - Qwen-Image-2.1 di Alibaba, modello unificato a pesi aperti da 7B per generazione e modifica di immagini, pubblicato secondo fonti esterne il 2026-09-20, non era ancora emerso nei post Bluesky trovati: potrebbe non essere stato ancora ripreso dagli account seguiti o trovarsi fuori da ciò che avrebbe restituito la ricerca bloccata.
- Ethan Mollick (
emollick.bsky.social) e Tanishq Abraham (iscienceluvr.bsky.social) sono stati verificati ma si sono rivelati concentrati rispettivamente su notizie LLM generali e vecchi articoli accademici, non su notizie attuali di generazione immagini/video. - Poiché la ricerca era bloccata, l’obiettivo di un campione di circa 20 post è stato raggiunto in aggregato leggendo cronologie complete: circa 30 post di Adina Yakup, circa 15 di useapi.net, circa 20 di Stable Diffusion, oltre ai feed recenti di Simon Willison ed Ed Zitron. Si tratta quindi di un campione mirato basato su account, non di una scansione esaustiva per parole chiave.
Lemmy
Lemmy — Ultime tendenze dell’IA per immagini e video
Comunità
- !«メールアドレス» (5.713 persone) — principale comunità di discussione tecnica per generazione di immagini e video IA open source; le novità di strumenti GitHub/HuggingFace arrivano quasi quotidianamente.
- !«メールアドレス» (2.361 persone) — spazio per opere create con Stable Diffusion e altri modelli a pesi aperti.
- !«メールアドレス» (1.599 persone) — dedicata all’arte IA anime, solo SFW.
- !«メールアドレス» (52 persone, 157 attive mensili) — comunità che replica direttamente thread IA di Reddit. Molte notizie closed-source, incluse quelle su Sora e Midjourney, arrivano da qui.
- !«メールアドレス» (204 persone, con post misti anche dall’istanza lemmy.bestiver.se) — mirror di Hacker News, dove confluiscono articoli su lanci come Qwen-Image e Nano Banana.
- !«メールアドレス» — comunità satirica sull’industria IA; qui ha avuto origine la storia sull’apparente smarrimento di Midjourney.
- !«メールアドレス» (8.265 persone) — grande comunità critica dell’IA generativa. Non è fonte di notizie in senso stretto, ma utile per misurare il clima generale di Lemmy.
- !stable_diffusion_furry / _witches / _mycology / «メールアドレス» — comunità di opere SD per generi di nicchia. Hanno post, ma punteggi quasi sempre a una cifra o negativi.
Post
Relativi al closed source
- OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !«メールアドレス», 2026-09-20, punteggio 1. Post che contrappone la fine dell’API Sora a una raccolta miliardaria di un concorrente cinese.
- Midjourney AI pivots to Theranos: Ultrasonic CT — !«メールアドレス», 2026-06-19, punteggio 40. La notizia secondo cui Midjourney avrebbe virato dalla generazione di immagini alle apparecchiature mediche CT a ultrasuoni: il post su Midjourney più seguito su Lemmy.
- Midjourney Ultrasonic CT Scanner — !hackernews, 2026-06-18, punteggio 2. Mirror HN della fonte primaria indicata sopra (midjourney.com/medical).
- Midjourney wants Hollywood studios to reveal AI usage details tramite post — !«メールアドレス», 2026-07-05, punteggio 73. Presentazione di un articolo TechCrunch, con un punteggio relativamente alto per una comunità tecnologica.
- Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images — !ai_reddit, 2026-08-07, punteggio 1.
- Seedream 5.0 Pro is here: an honest comparison and technical breakdown — !ai_reddit, 2026-07-10, punteggio 1. Analisi del modello di immagini closed-source di ByteDance.
- Nano Banana 2 Lite — !hackernews, 2026-06-30, punteggio 1. Annuncio del modello leggero per immagini di Google DeepMind.
- Microsoft's MAI-Image-2.5 Pulls Even With Google's Nano Banana 2 on Benchmarks — !ai_reddit, 2026-05-28, punteggio 1.
Relativi all’open source
- Qwen-Image-2.1: Compact, efficient, and unified image creation — !hackernews, 2026-09-20, punteggio 1. Ultima versione del modello di immagini a pesi aperti di Alibaba Qwen.
- supElement/ComfyUI_MinimaxH3_AutoContext — !«メールアドレス», 2026-09-16, punteggio 1. Nodo per MiniMax H3 dedicato a video lunghi, aggirando limiti di memoria.
- Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder — stessa comunità, 2026-09-16, punteggio 3. Generatore di prompt per MiniMax H3.
- nazgut/ComfyUI-MiniMaxH3-CLSS — stessa comunità, 2026-09-01, punteggio 0. Generazione di video con audio di lunghezza arbitraria su 16 GB di VRAM.
- filliptm/ComfyUI-FL-MiniMaxH3 — stessa comunità, 2026-08-30, punteggio 5.
- Luisacaotica/ComfyUI-MiniMaxH3Mod — stessa comunità, 2026-08-20, punteggio 7. Adattatore di compressione di immagini/video di riferimento, senza addestramento.
- I've been testing Wan for AI video generation — !«メールアドレス», 2026-09-10, punteggio -9 (impopolare/discusso). Recensione della generazione video con il modello a pesi aperti Wan.
- Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス», 2026-06-17, punteggio 5. Nuovo modello fondazionale aperto per immagini.
Segnali
- L’ecosistema ComfyUI incentrato su MiniMax H3 cresce con continuità tra agosto e settembre. Dal 2026-08-07 al 09-16 sono stati pubblicati almeno cinque nodi o strumenti correlati su !«メールアドレス», senza interruzioni nella frequenza. In questa comunità, “MiniMax H3” è la principale parola chiave dello slancio del video open source.
- Le notizie closed-source hanno poca discussione nativa su Lemmy e arrivano quasi tutte di seconda mano da mirror Reddit (!ai_reddit) o Hacker News (!hackernews), con punteggi generalmente tra 1 e 3. Quasi non esistono dibattiti primari nati su Lemmy.
- L’unico grande tema closed-source è stato il passaggio di Midjourney dalla generazione di immagini agli scanner CT medicali a ultrasuoni (!techtakes, punteggio 40), diventato virale in una comunità dal tono fortemente satirico e critico.
- Le comunità di condivisione opere, come stable_diffusion_art e share_anime_art, pubblicano frequentemente contenuti — quasi ogni giorno più elementi — ma con punteggi a una cifra o poco superiori; l’attenzione è sulla condivisione di creazioni, non sulle notizie.
- !«メールアドレス» (8.265 persone) supera in dimensioni la comunità favorevole alla generazione IA stable_diffusion (5.713 persone), suggerendo una struttura complessivamente ostile alla tecnologia generativa nell’ecosistema Lemmy.
Limiti
- L’API di ricerca Lemmy offre solo ricerca testuale per parole chiave e una debole classificazione per rilevanza. Cercando termini comuni come “Sora” o “Veo”, apparivano molti risultati politici non pertinenti (latam, pravda_news ecc.). Per filtrare la pertinenza sono stati esaminati oltre 100 risultati, 15–20 per parola chiave, ma i post effettivamente pertinenti sono rimasti poco più di una decina.
- Lemmy è distribuito tra istanze e non esiste un modo per cercare trasversalmente tutte le istanze. Sono state esplorate soprattutto lemmy.world, lemmy.dbzer0.com, lemmy.durstig.online, awful.systems, lemmy.bestiver.se e lemmy.today; discussioni in piccole istanze chiuse potrebbero non essere visibili.
- Per altri nomi di modelli rilevanti su altre piattaforme — Runway, Kling, Ideogram, Recraft, Grok Imagine, Flux.2, HunyuanImage — non sono stati trovati post significativi su Lemmy: risultati zero oppure irrilevanti.
- Nel complesso, Lemmy è un ambiente piccolo per le notizie in tempo reale sull’IA di immagini e video: dipende dai mirror Reddit/HackerNews per l’attualità e concentra il proprio contenuto originale sulla condivisione di strumenti pratici per eseguire modelli a pesi aperti in ComfyUI.
Pinterest — Notizie sull’IA per la generazione di immagini e video
Temi visivi
- La grafica “AI” al neon e le immagini di robot/circuiti sono la scorciatoia visiva predefinita di Pinterest per “IA”: chip luminosi, teste e mani robotiche o circuiti di particelle usati come copertine generiche, non per illustrare uno strumento o una notizia specifica
[1, 2, 8, 22, 25, 28, 29, 31, 39, 49]. - Miniature-listicle numerate “Best AI Video/Image Generator” — grandi titoli e griglie di loghi di Runway, Pika, Kling AI, Luma Dream Machine, Canva, Hailuo AI, Synthesia, HeyGen, D-ID, CapCut, InVideo e Adobe Firefly — sono il formato più frequente dell’intera raccolta
[7, 13, 20, 30, 32, 33, 41, 43]. - Miniature da YouTuber senza volto e con faccia di reazione — uomo barbuto stupito, cuffie, sfondo sfocato di esplosione, insieme a loghi big-tech — usate per vendere video-riepilogo di “AI NEWS”
[6, 19, 40]. - Schede riassuntive datate “Today’s/This Week’s AI News”, stilizzate come mini-prime pagine o caroselli Instagram che riassumono più titoli reali
[17, 35, 44, 47]. - Demo “Spot the AI” / di realismo — un tennista fotorealistico con didascalia “This is AI”, una foto di gatto con timbro “FAKE” — che vendono il realismo dei media generati più che un prodotto specifico
[5, 23]. - Demo di trasferimento di stile a personaggio coerente — un pin Lumalabs trasforma un unico video sorgente in quattro stili: blocchi di legno, origami, mattoncini giocattolo e fiori; è il formato virale “trasforma questo in materiale X” visto anche altrove
[10]. - Pubblicità di servizi freelance/side hustle che offrono “video IA per il tuo brand”, con numero WhatsApp e indirizzo Gmail integrati direttamente nella grafica
[24]. - Infografiche per principianti che scompongono il processo in prompt → spazio latente → denoising → fotogrammi → output, rivolte a chi non sa ancora come funziona la generazione
[3, 36].
Pin degni di nota
- #9 — pagina ufficiale del prodotto Veo 2 (“Il nostro modello di generazione video all’avanguardia”, invito all’iscrizione a VideoFX). Marketing reale di un prodotto closed-source, non una listicle. https://www.pinterest.com/pin/716705728243313502/
- #10 — Lumalabs: “Made of wooden blocks / origami folded paper art / colorful toy bricks / flowers”: un video sorgente rirenderizzato in quattro stili coerenti. https://www.pinterest.com/pin/308144799526598925/
- #17 — “4 Major AI Updates: Real News. Real Impact.” riunisce GPT-6 Astra di OpenAI, Gemini più agentico in Gmail/Drive/Docs/Slides/Chat, video/audio generativi integrati nella timeline di Adobe Premiere e il Series E da 2 miliardi di dollari di Cognition a una valutazione di 48 miliardi. https://www.pinterest.com/pin/982558843745608433/
- #20 — diagramma decisionale “AI Image Video: Best Quality vs Best Free”, la mappa a immagine singola più chiara di strumenti a pagamento — ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia — contro quelli gratuiti — Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut, Pika Free, Runway Free. https://www.pinterest.com/pin/37295503160959330/
- #26 — scheda notizia: “ByteDance and Hollywood reach global deal on AI copyright” — ByteDance e la Motion Picture Association concordano di rafforzare la protezione IP negli strumenti di generazione immagini/video di ByteDance. https://www.pinterest.com/pin/1074530792376376121/
- #27 — infografica su etica IA e rilevamento voci che segnala un risultato “97% likely AI-generated”, insieme a pannelli “AI video generators” e “AI ethics & prompt engineering”: ansia diffusa riguardo alla fiducia nei media generati. https://www.pinterest.com/pin/951104015101996491/
- #32 — “22 Best & Free AI Video Generators”, la raccolta di strumenti più grande del set; i suoi “Top 5 Picks” classificano Kling AI e Hailuo AI sopra Runway e Pika per realismo. https://www.pinterest.com/pin/128493395623874987/
- #35 — “Today’s AI News, May 20 2026”: sintesi di Google I/O 2026 con Gemini 3.5 Flash, Gemini Omni, l’agente Gemini Spark e gli occhiali smart Android XR. https://www.pinterest.com/pin/652670171044638578/
- #44 — finto giornale “This Week in AI News” del 15 agosto 2026, con filoni “Open Models / Open weights”, “Sovereign AI” e “Agent Harness”: l’unico pin dell’intero set che nomina anche modelli a pesi aperti, e solo come intestazione teaser, non come demo. https://www.pinterest.com/pin/644577765463965693/
- #48 — lancio di “Amuse 3.0”, strumento locale per creazione artistica IA sostenuto da AMD: uno dei pochi pin che nomina il lancio di un prodotto specifico, anziché una listicle generica o una scheda con logo di notizie. https://www.pinterest.com/pin/4601060441986715264/
Segnali
- Kling AI e Hailuo AI sono entrati nella fascia alta insieme a Runway, Pika e Luma in quasi tutte le listicle raccolte (
[7, 13, 30, 32, 41, 43]): un insieme di strumenti “top pick” più ampio del duopolio Runway/Pika di un anno prima. - La spinta Veo/Gemini di Google è la storia closed-source più visibile su Pinterest, ricorrendo fra pin indipendenti di notizie IA — lancio di Veo 2, Gemini 3.5/Omni/Spark, occhiali Android XR a I/O 2026 — e non attraverso un singolo post virale.
- OpenAI appare soprattutto come insieme indistinto di loghi, con una sola menzione concreta di Sora-2 (#4, una registrazione schermo sfocata di uno strumento terzo, “zeely.ai”, in modalità “sora-2-video-ad”): presenza debole rispetto al suo peso abituale su altre piattaforme.
- L’ansia per deepfake e autenticità è un sottofondo ricorrente, non un caso isolato: un pin di contenuto marcato “FAKE”, una valutazione vocale al 97% IA e una grafica “Human Journalism vs. Machine-Generated Media” compaiono indipendentemente (
[5, 16, 27]). - Il framing su monetizzazione e side hustle è esplicito: pubblicità di servizi video IA freelance con contatti inclusi (#24), proposte di canali senza volto e content marketing (#23, #25). Il pubblico Pinterest del video IA sembra formato più da creatori che vogliono vendere o scalare contenuti che da ricercatori.
- L’open source è praticamente assente. Tra tutti i 50 pin non compaiono Stable Diffusion, Flux, ComfyUI, Wan, HunyuanVideo, LTX, Mochi né link GitHub/HuggingFace. L’unica traccia del concetto è la frase “Open Models. Open weights.” come titolo in una prima pagina di notizie IA simulata (#44), mai come pin, logo di strumento o demo a sé. Per questo tema, Pinterest è quasi interamente marketing SaaS closed-source e listicle SEO: chi si affidasse solo a questa piattaforma non scoprirebbe neppure l’esistenza della scena open source della generazione immagini/video.
Limiti
- La tabella del worker
pinterest.pins.mdnon aveva sezioni per genere — un singolo elenco di 50 pin sotto un genere implicito — quindi tutti i pin sono stati analizzati insieme, anziché per genere come previsto dal playbook per esecuzioni multi-genere. - Per alcuni pin, il titolo non corrispondeva a ciò che mostrava effettivamente l’immagine e questa fase non esplora Pinterest direttamente per verificarlo. Sono pertanto indicati come non confermati e non come risultati: #42 (“Nvidia #NEW AI Tools”) mostra solo una foto generica di Jensen Huang senza testo visibile sugli strumenti; #45 (“Grok 5: Elon Musk's AI Revolution”) e #50 (“Discover how Grok is revolutionizing video”) mostrano immagini stock/giornalistiche generiche senza elementi specifici di Grok; #40 (“GPT 5.2, realtime video editor...”) mostra solo una miniatura generica di reazione a “huge AI news”.
- Diversi pin sono quasi duplicati di grafiche stock generiche senza contenuto informativo distinto (
[2, 8, 22, 29, 39, 45, 49]): sono conteggiati nei 50 ma non trattati come segnali separati. - Non è stato trovato contenuto open source sulla generazione IA di immagini/video su Pinterest. Questa assenza è il risultato principale della piattaforma, non una lacuna della ricerca: vedere Segnali sopra.
Azioni consigliate
- Seguire dove migra il traffico dell’API Sora dopo il 2026-09-24: Seedance 2.5, MiniMax H3 o Kling v3.
- Monitorare cambiamenti nella licenza di ricerca non commerciale di Qwen-Image-2.1, dato l’attuale dibattito su “è davvero open source?”.
- Usare la frequenza dei post di nodi MiniMax H3 per ComfyUI su Lemmy come indicatore anticipatore dell’adozione del video a pesi aperti.
- Rieseguire la raccolta X con termini specifici del tema, anziché trend regionali.
- Rieseguire la raccolta Reddit con ricerche per singolo modello, per raggiungere l’obiettivo di circa 20 thread.
- Verificare il passaggio di Midjourney agli ultrasuoni CT medicali sulla fonte primaria prima di considerarlo confermato.
Immagini raccolte


















































Nota sulla qualità dei dati
X ha prodotto zero post pertinenti al tema su 32 per via di un disallineamento dei termini di ricerca; Reddit ha raccolto solo 12 dei circa 20 thread previsti da un’unica query; l’API di ricerca Bluesky era bloccata (403) ed è stata aggirata con campionamento dei feed degli account; visualizzazioni e date esatte di YouTube non hanno potuto essere confermate a causa delle pagine renderizzate in JavaScript.



