Notizie sull'AI per la generazione di immagini e video — 2026-09-12
Il fronte open source, soprattutto cinese con Z-Image, Qwen-Image e MiniMax-H3, si avvicina ai modelli closed source nelle valutazioni alla cieca. Google attacca su tutti i fronti con Nano Banana, Veo e Gemini Omni, mentre Sora di OpenAI mostra segnali di rallentamento: modelli rimossi dalla pagina prezzi e uscita del responsabile.
Riepilogo delle notizie sull'AI per immagini e video — 2026-09-12
Ciao! Questa volta ho fatto una ricerca approfondita nel mondo dell'AI per immagini e video su sei piattaforme: Reddit, X, YouTube, Bluesky, Lemmy e Pinterest 🔥 In sintesi, sul fronte closed source Google sta spingendo al massimo sia sulle immagini sia sui video, mentre Sora di OpenAI sembra un po' in calo 😳. Nell'open source, i player cinesi (Qwen, Z-Image, MiniMax, Wan) stanno davvero raggiungendo i modelli proprietari nelle valutazioni alla cieca: uno sviluppo super interessante 🔥🔥 La ricerca su X, però, è stata un buco nell'acqua totale: non è emersa neanche una conversazione sull'AI per immagini o video, e lo segnalo onestamente come una lacuna seria 💦 Inoltre, su tutte le piattaforme si è parlato moltissimo di autenticità e affidabilità, con contenuti del tipo «ma è davvero AI?»; sorprendentemente, hanno avuto più diffusione delle discussioni sulle prestazioni dei modelli 👀
Across platforms
- I protagonisti dell'open source sono ormai i player cinesi🇨🇳: in modo indipendente su YouTube, Bluesky e Lemmy, Qwen-Image, Z-Image (Turbo), MiniMax (H3/Hailuo 3.0) e Alibaba Wan vengono celebrati come i «nuovi re». Nella classifica blind di Bluesky, Qwen-Image-3.0-Pro sarebbe a soli 92 punti Elo da GPT Image 2 (high): davvero impressionante (https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t).
- Google attacca con immagini e video insieme: tra la recensione di Veo 3.1 su YouTube (https://www.youtube.com/watch?v=sTOFXi2eY_k), la presentazione di Nano Banana 2 di Teacher's Tech (https://www.youtube.com/watch?v=nikIxHM_AQY) e la notizia su Bluesky di un'app desktop Windows con «Gemini Omni» (https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n), la sua offensiva a tutto campo è davvero forte 💪
- I contenuti su come riconoscere l'AI sono davvero popolari: sia i thread di identificazione su Reddit (r/isthisAI) (https://www.reddit.com/r/isthisAI/comments/1wbspxo/) sia le infografiche Pinterest sul rilevamento di deepfake e voci AI si sono animate indipendentemente. L'ansia sull'autenticità è diventata un tema trasversale; è sorprendente che diffonda più delle notizie sulle capacità dei modelli.
- Gli slogan su «illimitato» e affiliazioni sono guardati con sospetto ovunque: il commento Reddit secondo cui i siti che promettono «unlimited» sono quasi sempre borderline truffaldini (#4, r/generativeAI) e lo spam ripetuto di circuitai.bsky.social per WAN 3.0 su Bluesky mostrano lo stesso schema. Gli utenti restano giustamente scettici 😤
- Gli utenti comuni distinguono poco tra open e closed source: nei thread Reddit sulle richieste di strumenti, Qwen, Flux, Seedream, Veo e GPT Image vengono elencati insieme come modelli disponibili; quasi nessuno sottolinea la distinzione. C'è quindi un divario rilevante tra la struttura a due assi richiesta dal brief e il modo in cui gli utenti percepiscono gli strumenti.
Platform by platform
Reddit — Raccolti 12 thread, meno dell'obiettivo di circa 20. Il contenuto con più engagement non riguardava un nuovo modello, ma GPT-6 usato per creare falsi timelapse di disegni a mano (r/antiai, 7.146 pt, https://www.reddit.com/r/antiai/comments/1w81kdd/): un post di rabbia per la «deception» dell'AI. In più thread è emersa indipendentemente una domanda per piattaforme integrate non censurate e NSFW (WildOwl.ai, cyberbara, Tensor.art e altre).
X — Buco nell'acqua totale 😭 I 40 post raccolti parlavano di Yemen, memecoin $SONG e Chelsea FC; zero post riguardavano l'AI per immagini o video. Il problema è che le query usate, basate sui trend, erano fuori tema: la prossima volta serviranno ricerche per nomi specifici come Midjourney, Sora e Runway.
YouTube — La piattaforma con più informazioni questa volta ✨ Sul fronte closed source, GPT Image 2/2.5 è primo nell'Artificial Analysis Image Arena (Elo 1.339, il maggior distacco storico tra primo e secondo, https://www.youtube.com/watch?v=DY6TkI8XtkQ); Veo 3.1 migliora il lip-sync, mentre ByteDance Seedream 5.0 Pro viene giudicato superiore ai modelli esistenti (https://www.youtube.com/watch?v=WpcxwSNT3X4). Sul fronte open, FLUX.2 di Black Forest Labs è indicato come possibile «nuovo re» (https://www.youtube.com/watch?v=YQuTkPVkCS8), Alibaba Z-Image Turbo come re dei modelli locali (https://www.youtube.com/watch?v=K0FgDU-9uik), e Lightricks LTX-2 persino come il «Santo Graal dei video open source».
Bluesky — Sora potrebbe essere in seria fase di rallentamento 👀 Oltre a un post che ha rilevato la rimozione silenziosa di sora-2 e sora-2-pro dalla pagina prezzi (https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23), è emerso uno scoop: l'ex responsabile Sora Bill Peebles avrebbe avviato una startup indipendente con importanti figure di Hollywood (https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n). Sul lato open source, Qwen, Z-Image, MiniMax, WAN 3.0 e SenseNova-U1.5 dominano la conversazione.
Lemmy — Piattaforma più piccola, di fatto dipendente dalla curation di una sola persona, Even_Adder 😅 Ma la principale notizia closed source è davvero scioccante: Midjourney avrebbe virato dalla generazione di immagini a un'attività di medical spa con scansioni CT a ultrasuoni (https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429), venendo ironicamente definita «il ritorno di Theranos». Sul fronte open source, l'ecosistema di strumenti ComfyUI e quantizzazione intorno a MiniMax-H3 sta esplodendo, con oltre sette rilasci in una settimana.
Pinterest — Esaminati visivamente tutti i 50 pin 👀 Gli strumenti commerciali closed source (Runway, Pika, Kling AI, Luma, Canva, Hailuo e Synthesia) compaiono quasi sempre nelle infografiche di classifica; i pin open source sono quasi assenti. Ci sono anche notizie reali, come materiali promozionali ufficiali di Google Veo 2/3 e l'accordo sul copyright tra ByteDance e Hollywood/MPA (#31), ma la maggior parte sono miniature prodotte in massa per SEO e affiliazioni. Un pin (#44) afferma anche che oltre il 20% di YouTube è generato dall'AI.
What to watch
- Se il rallentamento di Sora sia reale — Bluesky, rilevamento della rimozione dei modelli dalla pagina prezzi (https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23)
- Quanto Qwen-Image-3.0-Pro riuscirà a ridurre il divario con GPT Image 2 — Bluesky, classifica delle valutazioni blind (https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t)
- Il ritmo di crescita dell'ecosistema MiniMax-H3 — Lemmy, strumenti nell'ecosistema ComfyUI (https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA)
- Gli sviluppi dell'attività medical spa di Midjourney — Lemmy, articolo TheRegister (https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429)
- L'esito della sfida per il «re locale» fra FLUX.2 e Z-Image Turbo — YouTube (https://www.youtube.com/watch?v=YQuTkPVkCS8, https://www.youtube.com/watch?v=K0FgDU-9uik)
- L'evoluzione e il consolidamento delle piattaforme integrate non censurate e NSFW, come WildOwl.ai — Reddit (https://www.reddit.com/r/AItips101/comments/1w9yftp/)
Recommendations
- La prossima ricerca su X dovrebbe usare nomi specifici — Midjourney, Sora, Runway, Kling, Flux e ComfyUI — invece dei trend del giorno.
- Bisognerebbe continuare a seguire gli account Bluesky che monitorano la pagina prezzi per verificare l'andamento di Sora.
- L'indicatore più chiaro del divario tra open e closed source è seguire nel tempo gli Elo di Qwen-Image-3.0Pro contro GPT Image 2.
- Il pivot sanitario di Midjourney merita di essere seguito più come notizia di strategia aziendale che come notizia tecnica.
- La raccolta Reddit dovrebbe ampliare le query per arrivare a 20 thread, non fermarsi a 12.
- Le infografiche di classifica su Pinterest e le raffiche di post affiliati su Bluesky non dovrebbero essere considerate affidabili da sole: vanno adottate soltanto dopo conferme da altre piattaforme.
Data quality
Su X, per una scelta errata delle query, non sono emersi post sull'AI per immagini o video: per questo tema i dati sono di fatto assenti. Reddit ha fornito solo 12 thread, meno dell'obiettivo di circa 20, e il contenuto è più vicino alle richieste di consigli sugli strumenti che alle notizie. Pinterest non classificava i dati originali in open/closed source, quindi è stata necessaria una riclassificazione manuale. Lemmy è una piattaforma piccola, sostanzialmente dipendente dalla curation di un solo account, Even_Adder. Su YouTube, a causa del rendering JavaScript, WebFetch non ha potuto ottenere il testo delle pagine video; nemmeno visualizzazioni e iscritti sono stati ottenibili tramite oEmbed. Su Bluesky, alcuni termini (Runway, Kling, Black Forest Labs) hanno prodotto persistenti errori 403 e la raccolta è stata abbandonata; inoltre, le conversazioni su WAN 3.0 erano sommerse dallo spam ripetitivo.
Riepilogo per piattaforma
Reddit — Notizie sull'AI per la generazione di immagini e video
Dove
I 12 thread raccolti provengono dai seguenti 9 subreddit.
| Subreddit | Membri | Thread raccolti |
|---|---|---|
| r/isthisAI | 408.823 | 1 |
| r/antiai | 322.973 | 1 |
| r/GetNoted | 298.488 | 1 |
| r/generativeAI | 152.415 | 3 |
| r/aiwars | 167.809 | 1 |
| r/hatethissmug | 134.660 | 1 |
| r/aivideomaking | 6.823 | 2 |
| r/GoogleFlow | 1.884 | 1 |
| r/AItips101 | 1.299 | 1 |
Spiccano i grandi subreddit che discutono l'AI generativa in sé (r/antiai, r/aiwars, r/isthisAI, r/GetNoted), mentre i subreddit medi dedicati a strumenti e raccomandazioni (r/generativeAI, r/aivideomaking) raccontano le tendenze d'uso concrete.
Cosa dicono le persone
- 【#6, r/antiai, 7.146 pt / 1.025 commenti, 2026-09-05】Post secondo cui a un LLM, indicato come GPT-6, sono stati concessi mouse e tastiera per «disegnare a mano» su una tavoletta digitale e falsificare persino il timelapse. Il commento più votato (2.511 pt, u/Nayutantantan) esprime rabbia: non ha più voglia di registrare timelapse neanche delle proprie opere, perché i falsi timelapse stanno diventando normali. È di gran lunga il thread con più reazioni nella raccolta. https://www.reddit.com/r/antiai/comments/1w81kdd/
- 【#11, r/GetNoted, 4.470 pt / 325 commenti, 2026-09-10】Esempio di un post su X con immagine generata dall'AI, contenente testo deformato come "Handloags" in un'immagine di programma, diventato oggetto di derisione. I commenti principali ridono proprio della scarsa qualità dell'immagine AI. https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
- 【#1, r/AItips101, 145 pt / 83 commenti, 2026-09-07】«Classifica 2026 dei generatori di immagini AI non censurati». Al primo posto WildOwl.ai, presentato come accesso pay-per-use a oltre 35 modelli — Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo e GPT Image — senza abbonamento mensile e con crediti senza scadenza. Un commentatore approva perché altrove i filtri gli avevano fatto sprecare crediti; altri raccomandano Perchance/Uncensored.ai. https://www.reddit.com/r/AItips101/comments/1w9yftp/
- 【#8, r/aivideomaking, 4 pt / 21 commenti, 2026-09-09】Alla richiesta di strumenti gratuiti o a crediti per immagini e video fotorealistici, vengono elencati OpenartAI, fal, dzine, pixverse, Higgsfield e RunningHub, che permette modelli OSS e closed source tramite ComfyUI. Un utente aggiunge che Seedance 2.5 su cyberbara è non censurato e supporta volti reali. https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
- 【#3, r/generativeAI, 0 pt / 7 commenti, 2026-09-11】Thread alla ricerca di generatori browser-only per immagini e video NSFW. u/MisterZan25 presenta RunDiffusion/Tensor.art per immagini e coerenza dei personaggi, PornGen/PornJourney e mirror di Pika Labs per video; u/frighten raccomanda l'app iPhone «PixelForge», on-device e non censurata. https://www.reddit.com/r/generativeAI/comments/1wdkbxv/
- 【#4, r/generativeAI, 1 pt / 11 commenti, 2026-09-07】Alla domanda sul più economico servizio illimitato per immagini→video in 1080p, Artlist.io (€550/anno) viene proposto come candidato. Diversi commenti criticano però la promessa «illimitata»: u/ai_art_is_art osserva che tali siti sono quasi sempre borderline truffaldini e che, dopo aver speso $550, si ottiene l'equivalente di soli $200 e si deve attendere 24 ore. https://www.reddit.com/r/generativeAI/comments/1wa4k88/
- 【#5, r/aivideomaking, 16 pt / 38 commenti, 2026-09-07】Alla richiesta di creare gratis un video di 45 secondi soltanto da smartphone o iPad, u/NewLifeWares risponde che 45 secondi richiedono di fatto capacità da datacenter: gratuitamente ci si può aspettare al massimo uno o due clip da 5 secondi con watermark, poi da montare. La discussione rende visibile la domanda, e l'irrealismo, della combinazione gratuito+alta qualità+lungo formato. https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
- 【#7, r/GoogleFlow, 6 pt / 2 commenti, 2026-09-10】Rilasciata AutoFlow, estensione Chrome per Google Flow (Veo): include generazione batch, continuazione dall'ultimo frame del clip precedente e montaggio automatico di video narrati con audio e sottotitoli; modello freemium con abbonamenti Pro/Ultra. https://www.reddit.com/r/GoogleFlow/comments/1wccmrg/
- 【#12, r/aiwars, 0 pt / 14 commenti, 2026-09-08】Discussione sui rischi di diritto all'immagine e uso pubblicitario quando una persona generata dall'AI assomiglia casualmente a una reale. Un utente nota che il caso più difficile è la coincidenza con un privato sconosciuto: alle aziende resta solo effettuare una ricerca inversa delle immagini e sperare. https://www.reddit.com/r/aiwars/comments/1wafe86/
- 【#10, r/hatethissmug, 59 pt / 20 commenti, 2026-09-12】Differenze interne al fronte anti-AI davanti a un video che critica l'AI ma la utilizza. Un utente, pur dichiarandosi anti-AI, sostiene che l'argomento dell'impatto ambientale sia troppo esagerato e che sia irrealistico aspettarsi che l'AI sparisca da sola. https://www.reddit.com/r/hatethissmug/comments/1wdxv6k/
- 【#2, r/isthisAI, 0 pt / 31 commenti, 2026-09-09】Thread per decidere se un video sia AI o ripresa reale. La sparizione e ricomparsa di una collana viene considerata decisiva, e un utente nota che la durata esatta di 15 secondi sembra il limite tipico dei video AI attuali. I limiti tecnici — durata e incoerenze — stanno diventando criteri di giudizio per il pubblico generale. https://www.reddit.com/r/isthisAI/comments/1wbspxo/
Segnali
- In crescita: piattaforme integrate non censurate e NSFW come WildOwl.ai, cyberbara, RunDiffusion, Tensor.art e PixelForge vengono citate indipendentemente in più thread. È forte la domanda simultanea di accesso ai modelli più recenti e minore censura.
- In crescita: nascita di ecosistemi complementari agli strumenti ufficiali, come AutoFlow (#7) per Google Flow.
- Guardati con sospetto: abbonamenti che promettono «illimitato», come Artlist.io (#4), ricevono costantemente diffidenza dalla community.
- Guardati con sospetto: anche nel fronte anti-AI, gli argomenti che enfatizzano l'impatto ambientale (#10) ricevono critiche interne per l'eccesso di enfasi; la narrativa anti-AI non è monolitica.
- Aspetto sorprendente: fra i 12 thread raccolti, l'engagement maggiore non è stato per un nuovo modello, ma per la denuncia anti-AI del timelapse falsificato (#6, 7.146 pt) e per un caso derisorio di immagine AI (#11, 4.470 pt). Su Reddit, i temi di inganno e affidabilità diffondono molto più delle notizie di prodotto.
- Aspetto sorprendente: la distinzione closed/open source non è al centro dell'interesse degli utenti. In molti thread, modelli come Qwen, Flux, Seedream, Wan, Kling, Seedance, Veo e GPT Image sono elencati in parallelo come strumenti disponibili, con pochissimi commenti che fanno caso alla differenza.
Limiti
- È stata usata una sola query, "Image and Video Generation AI News", e sono stati raccolti soltanto 12 thread, meno dei circa 20 previsti dal criterio di completamento.
- La raccolta consisteva nella lettura di contenuti già acquisiti da un worker tramite browser headless; non è stato possibile cercare o consultare ulteriormente Reddit in questa fase, poiché Reddit rifiuta le pagine via WebFetch e ricerca.
- Molti post raccolti erano Q&A del tipo «consigliatemi uno strumento», più vicini all'utilizzo reale della community che alle «notizie». Non sono emersi thread specialistici che discutessero chiaramente gli sviluppi open e closed source.
- r/AItips101 (1.299 persone) e r/GoogleFlow (1.884 persone) sono subreddit molto piccoli: le informazioni ottenute rappresentano singole voci più che l'intera community.
X
X — Tendenze delle notizie sull'AI per immagini e video
Account
I 40 post raccolti provengono da 40 account distinti, con un solo post ciascuno; nessun account ricorre. Nessuno è specializzato in AI per immagini e video (Midjourney, Stable Diffusion, Sora, Runway, Kling, Veo, ComfyUI, Flux e simili). Gli account sono raggruppati per query.
- Yemen/Saudi (Medio Oriente e OSINT): @tleilax___, @Ahmed175143, @IranTimes72, @citrinowicz, @Osinttechnical, @c14english, @Rusia_HD, @MerruX — account OSINT e news su attacchi alle infrastrutture petrolifere saudite e conflitto yemenita.
- $SONG (memecoin dell'ecosistema Cardano): @LagyADA, @EAjdarovic, @JureKaramarko, @SintoAndrej — piccoli account speculativi e promozionali.
- Charlie Kirk (anniversario della morte): @tivent_1, @TruthNetwork24, @mscaradapawjob, @rokkstarrrrrrr — commenti politici e reazioni meme.
- Britain (politica britannica): @brigantia__, @Steven41849941, @SirJBritain, @BROKENBRITAIN0 — post nazionalisti su immigrazione e sicurezza.
- Anthropic (economia AI e sicurezza): @restitutorII, @BrianRoemmele, @walterkirn, @claudecode84 — scenari economici di Anthropic, open source di Claude Code e critiche all'AI; il tema è LLM e impatto sociale, non immagini o video.
- Apple/Samsung (dibattito sugli smartphone): @FlossyCarter, @cagriozturkish, @appleinteligen, @BrandonKHill — provocazioni tra fan sui dispositivi pieghevoli.
- Sony (industria videoludica): @JayDubcity16, @Cris_Uther, @treeblazah, @ScreenCraveHQ — gossip su Hideo Kojima e film di Spider-Man.
- "one ai os" (autopromozione di startup AI): @de1lymoon, @neda_sefati, @harvey_control, @Iamanusbutt — networking per startup di agenti AI e sistemi operativi aziendali, senza riferimenti a immagini o video.
- Chelsea (calcio): @declanstar1, @TheHateCentra, @Lea_EFC, @chelcatastr0phe — post sulle partite del Chelsea FC.
Non esistono autori ricorrenti tali da consentire un confronto fra un singolo post virale e l'accumulo di molti piccoli post. @rokkstarrrrrrr (9.404 like), @TheHateCentra (19.654 like) e @Cris_Uther (17.095 like) hanno ottenuto i risultati singoli maggiori, ma sono tutti fuori tema.
Post
Non è stato trovato alcun post che menzioni direttamente l'AI per immagini e video. Ecco, a puro titolo di riferimento, i post più vicini al tema ma comunque non pertinenti.
-
#21 @restitutorII — 458 like·69 repost·41 risposte·~57.000 visualizzazioni·2026-09-10
https://x.com/restitutorII/status/2097918742571139093"Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI..."
→ Previsioni economiche di Anthropic: AI generativa in generale, non tendenze dell'AI per immagini o video. -
#24 @claudecode84 — 2.585 like·268 repost·24 risposte·~741.000 visualizzazioni·2026-09-10
https://x.com/claudecode84/status/2097959830942367747«Il responsabile di Anthropic stesso sta rendendo open source l'intero suo ambiente Claude Code»
→ Open source di Claude Code, AI per programmazione; non è un modello per immagini o video. -
#33 @de1lymoon — 49 like·6 repost·9 risposte·~3.500 visualizzazioni·2026-09-11
https://x.com/de1lymoon/status/2098428267158032841"Grok Bot + Kimi K3 is where an AI agent starts turning into an operating system..."
→ Riflessione sull'orchestrazione degli agenti AI, senza relazione con la generazione di immagini o video. -
#22 @BrianRoemmele — 792 like·187 repost·105 risposte·~100.000 visualizzazioni·2026-09-10
https://x.com/BrianRoemmele/status/2098024115231924568
→ Post in stile meme su critiche ad Anthropic e minacce dell'AI, senza riferimenti al tema. -
#23 @walterkirn — 723 like·91 repost·39 risposte·~28.000 visualizzazioni·2026-09-10
https://x.com/walterkirn/status/2098059171325427949
→ Ancora nel contesto di critiche ad Anthropic e ai media, senza immagini o video AI.
I cinque post sopra sono tutto ciò che è emerso tramite la parola chiave «AI»; non sono adottabili come notizie di AI per immagini/video né per il closed source né per l'open source.
Segnali
- I dieci trend principali di X Explore nella regione del server di questa sessione — probabilmente Croazia, dato il testo «Trending in Croatia» — erano Yemen, Saudi, $SONG, Charlie Kirk, Britain, Anthropic, Apple, Sony, one ai os e Chelsea. Nessuno riguarda Midjourney, Sora, Stable Diffusion, Runway, Kling, Veo o strumenti equivalenti.
- Il fatto che Anthropic e one ai os siano in tendenza mostra che su X è attivo il dibattito su agenti AI, LLM e impatto economico; si tratta però di un gruppo di argomenti diverso dall'AI per immagini e video.
- Nessuno dei 40 post contiene nomi di strumenti di generazione visiva, release, demo o confronti.
Limiti
- Le query usate — "Yemen", "Saudi", "$SONG", "Charlie Kirk", "Britain", "Anthropic", "Apple", "Sony", "one ai os" e "Chelsea" — erano trend di X Explore del giorno, non query sugli strumenti di AI visiva. Perciò nessuno dei 40 post riguarda notizie open o closed source su immagini e video.
- Non è quindi possibile ricavare da X le dieci osservazioni open source e le dieci closed source richieste dal brief. Più che «X non ha detto nulla», il problema è che non è stata svolta una ricerca pertinente al tema.
- La prossima esecuzione dovrebbe usare nomi di strumenti e aziende: Midjourney, Stability AI, Runway, Pika, Luma, Kling, Sora, Google Veo, Flux, ComfyUI e simili.
YouTube
YouTube — Notizie sull'AI per immagini e video (closed source/open source)
Canali
- There's An AI For That — Canale di presentazione di strumenti AI; ha pubblicato una recensione di FLUX.2.
- AI Search — Canale di notizie rapide sui nuovi modelli; video su Sora 2 e HunyuanVideo 1.5.
- Theoretically Media — Canale specializzato in AI video; recensione approfondita di Veo 3.1.
- Teacher's Tech — Canale di strumenti pratici; recensione di Nano Banana 2.
- Codebreakers — Recensioni e spiegazioni di modelli AI open source; speciale su MiniMax H3.
- Bijan Bowen — Canale molto tecnico sull'AI locale per immagini; test di Z-Image Turbo.
- Benji's AI Playground — Tutorial su ComfyUI e generazione locale; spiegazione di Ideogram 4.0.
- Curious Refuge — Storico canale educativo di produzione video AI; recensione di Midjourney V8.
- RandomAI — Notizie e confronti di nuovi modelli; spiegazione di GPT Image 2.5.
- Standarity / The AI Filmmaking Advantage — Canali di notizie e test comparativi; riepilogo dell'annuncio e test completi di Seedream 5.0 Pro.
- MattVidPro AI — Menzione in un video di prime impressioni su Runway Gen-4.
Video
- «Is FLUX 2.0 The New Open Source King?» — There's An AI For That — https://www.youtube.com/watch?v=YQuTkPVkCS8 — Valuta se FLUX.2 di Black Forest Labs possa diventare il nuovo re della generazione open source di immagini.
- «We have a new #1 open-source AI video generator!»(2025-11-25)— AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — Recensione e installazione di HunyuanVideo 1.5 in ComfyUI, presentato come eseguibile anche con poca VRAM.
- «Sora 2… wtf» — AI Search — https://www.youtube.com/watch?v=El-G4cO4x4I — Confronta OpenAI Sora 2 con Veo 3, Kling 2.5 e Hailuo 02, evidenziando miglioramenti nella sincronizzazione audio e nella fisica.
- «Veo 3.1 Is More Powerful Than You Realize!»(2025-10-16)— Theoretically Media — https://www.youtube.com/watch?v=sTOFXi2eY_k — Illustra i miglioramenti di Google Veo 3.1: lip-sync, coerenza dei personaggi e upscaling a 1080p.
- «The New Gemini Image Generator is Insane (Nano Banana 2)» — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Presenta Nano Banana 2 come nuovo predefinito dell'app Gemini.
- «MiniMax H3: The New Open-Source Video Champ?»(2026-08-03)— Codebreakers — https://www.youtube.com/watch?v=3R5GROj8Tcg — Presenta MiniMax H3 (Hailuo 3.0), modello video multimodale open-weight capace di generare video con audio stereo nativo in un solo passaggio.
- «Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models» — Bijan Bowen — https://www.youtube.com/watch?v=K0FgDU-9uik — Test locale di Z-Image Turbo con licenza Apache-2.0, proclamato KING.
- «Ideogram 4.0 Released! The New Open Model That FINALLY Gets Text Right»(2026-06-04)— Benji's AI Playground — https://www.youtube.com/watch?v=HY_e5CZfJfQ — Riferisce che il primo modello open-weight di Ideogram è primo in Design Arena e finalmente accurato nel rendering del testo.
- «I Tried Midjourney 8… Here's the Truth»(2026-03-19)— Curious Refuge — https://www.youtube.com/watch?v=i9qV9-2tzEA — Recensione onesta delle capacità di Midjourney V8.
- «GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model» — RandomAI — https://www.youtube.com/watch?v=DY6TkI8XtkQ — Spiega GPT Image 2/2.5 di OpenAI, con miglioramenti nel rendering del testo e nel supporto multilingue.
- «ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted» — Standarity — https://www.youtube.com/watch?v=g05iPef37Qs — Riassume l'annuncio di Seedream 5.0 Pro, che consente editing a livello di layer.
- «🚨BREAKING: Seedream 5.0 Pro Just SMOKED Every Image Model (Fully Tested)»(2026-07-16)— The AI Filmmaking Advantage — https://www.youtube.com/watch?v=WpcxwSNT3X4 — Confronto completo di Seedream 5.0 Pro con altri modelli, giudicato superiore agli esistenti.
Segnali
Movimenti sul fronte closed source
- OpenAI GPT Image 2 / 2.5 è primo nell'Artificial Analysis Image Arena con Elo 1.339 e, secondo le notizie, il maggior distacco storico tra primo e secondo posto a settembre 2026.
- Google Veo 3.1 e Nano Banana Pro (Gemini 3 Pro Image) si rafforzano come coppia video/immagini; lip-sync, upscaling 1080p ed editing a livelli mostrano un chiaro orientamento professionale.
- ByteDance Seedance 2.0 (2026-02) e Seedream 5.0 Pro (intorno a luglio 2026) aumentano rapidamente la loro presenza grazie al multimodale: riferimento a testo, immagini, video e audio.
- Più video sostengono che xAI Grok Imagine 1.5 superi Veo e Sora nei benchmark; il tema è diventato discusso intorno a giugno 2026.
- Anche player consolidati come Runway Gen-4/4.5 e Midjourney V8 (V8.1, V8.2) continuano ad aggiornarsi, con molti video di recensione in chiave di «difesa del trono».
Movimenti sul fronte open source
- FLUX.2 di Black Forest Labs viene definito in più recensioni il «nuovo re» come modello di immagini di alta qualità eseguibile localmente.
- Tencent HunyuanVideo 1.5 supporta nativamente ComfyUI e si afferma come nuovo standard open source per video anche su sistemi a bassa VRAM.
- Z-Image e Z-Image Turbo di Alibaba/Tongyi-MAI, pubblicati con licenza Apache-2.0, sono spesso valutati come i nuovi re dei modelli locali.
- Ideogram 4.0 è stato rilasciato come primo modello open-weight dell'azienda, primo in Design Arena e apprezzato per l'accuratezza del testo.
- MiniMax H3 (Hailuo 3.0) è emerso rapidamente nell'agosto 2026 come modello video multimodale open-weight eseguibile anche su GPU personali come RTX 3090; stanno comparendo molti video sul supporto ComfyUI.
- Lightricks LTX-2 realizza in open source video 4K a 50 fps con sincronizzazione audio, ed è definito il «Santo Graal del video open source».
- Anche Alibaba Wan 2.5/2.6 continua a essere trattato come modello open source per video capace di accettare input di testo, immagini, audio e video.
Limiti
- Le pagine dei risultati YouTube (
youtube.com/results?...) sono renderizzate via JavaScript, quindi WebFetch restituiva soltanto il footer e non titoli, visualizzazioni o dati dei canali. Anche le pagine dei singoli video (watch?v=) non erano leggibili direttamente; titoli e canali sono stati verificati tramite l'API oEmbed di YouTube (youtube.com/oembed). - L'API oEmbed non restituisce visualizzazioni, data di pubblicazione, iscritti o commenti. Visualizzazioni e iscritti non sono quindi disponibili; le date sono riportate solo quando presenti in alcuni snippet WebSearch.
- «LTX-2: Open Source AI Video, Released to the Community» (zSvCnVi181A) ha restituito 403 Forbidden tramite oEmbed e non è stato verificabile.
- Per queste ragioni, i commenti dei video non sono stati esaminati; i riassunti si basano solo su titolo e descrizione.
- Le tendenze sono state integrate con informazioni da WebSearch, ma tutti i video collegati sono stati verificati come URL YouTube esistenti.
Bluesky
Bluesky — Notizie sull'AI per immagini e video (closed source/open source)
Account
- theinformation.com / techmeme.com / mediagazer.com / lefiltech.fr — Bot informativi collegati via RSS, che diffondono scoop su OpenAI e Sora in più lingue.
- ctxwindow.kynth.studio(#TechBluesky) — Osservatore che monitora e pubblica le differenze della pagina prezzi di OpenAI.
- gen-ai.news — Account personale di notizie rapide sugli aggiornamenti di Midjourney.
- oludai.bsky.social — Gestisce una classifica indipendente di valutazioni umane alla cieca su olud.ai, che classifica ogni ora modelli di immagini open e closed source.
- aichina.news — Account quasi automatizzato che segnala quasi ogni giorno LoRA FLUX con licenza Apache-2.0 pubblicati su Modelers.cn di Huawei.
- circuitai.bsky.social — Account spam/promozionale che pubblica quasi lo stesso testo oltre una dozzina di volte al giorno con link affiliati a Alibaba WAN 3.0 (vidhapi.app).
- arxiv-cs-cv.bsky.social — Pubblicazione automatica di nuovi articoli arXiv su immagini e video generativi.
- un1v3rse.bsky.social / carlbetheav.bsky.social / stumblegirl.bsky.social / ttaships.airminded.org — Artisti individuali che pubblicano quotidianamente opere con Midjourney (#midjourney #QP #FoxyFriday).
- rin-yamami.bsky.social / satomin6.alimika.jp — Illustratori AI giapponesi che usano Qwen-Image-Edit e ComfyUI.
Post
- theinformation.com(2026-09-10, 👍1 🔁0)— Scoop: l'ex responsabile OpenAI Sora Bill Peebles avvia una startup indipendente di AI per la generazione video con Jeffrey Katzenberg, figura di spicco di Hollywood ed ex DreamWorks, e l'ex CFO di Dropbox.
https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n - ctxwindow.kynth.studio(2026-09-08, 👍0/1 🔁0)— Rilevata la rimozione silenziosa di sora-2 e sora-2-pro dalla pagina prezzi di OpenAI (prezzi precedenti: 720p $0,05–$0,30), interpretata come conferma del ridimensionamento di Sora.
https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23 - somewhattolerable.com(2026-09-06, 👍2)— Osservazione secondo cui OpenAI avrebbe interrotto Sora perché gli ingegneri interni lamentavano un consumo eccessivo di risorse.
https://bsky.app/profile/somewhattolerable.com/post/3muuuazkaf223 - itmatterss.bsky.social(2026-09-11, 👍1)— Gemini di Google diventa app desktop Windows, avviabile con Alt+Space; viene indicato Nano Banana per immagini e «Gemini Omni» per video.
https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n - dimnews.bsky.social(2026-09-11, russo)— SenseTime annuncia SenseNova-U1.5, modello multimodale da 8 miliardi di parametri, sostenendo che superi Nano-Banana-Pro nel ragionamento visivo.
https://bsky.app/profile/dimnews.bsky.social/post/3mv7u7crnzz25 - gen-ai.news(2026-08-30, 👍1)— Segnala che il modello di editing Midjourney V8.2 è stato silenziosamente corretto dopo lamentele sul peggioramento della qualità.
https://bsky.app/profile/gen-ai.news/post/3mudbgowbnz2s - futureautomationai.bsky.social(2026-09-03, 👍2)— Riepilogo «Midjourney in 2026»: V8.2, personalizzazione, moodboard, modello di editing e funzioni di riferimento.
https://bsky.app/profile/futureautomationai.bsky.social/post/3mumtnbxuv22d - oludai.bsky.social(2026-09-10/11, 👍1-2)— Nella classifica blind, il miglior modello scaricabile è Qwen-Image-3.0-Pro (#12), a soli 92 Elo da GPT Image 2 (high).
https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t - ddigitalmedia.bsky.social(2026-09-10, 👍1)— Valutazione secondo cui Qwen, Z-Image e MiniMax sono gli unici concorrenti in grado di opporsi ai prodotti LLM e immagini occidentali.
https://bsky.app/profile/ddigitalmedia.bsky.social/post/3mv6lyejx3223 - circuitai.bsky.social(2026-09-11〜12, post ripetuti)— Promuove WAN 3.0 di Alibaba come alternativa economica pay-per-use a Seedance 2.5 di ByteDance, fino a 30 secondi per clip. Nota: lo stesso testo affiliato è stato pubblicato oltre 15 volte al giorno.
https://bsky.app/profile/circuitai.bsky.social/post/3mvbvqsdvr22p - minaxlab.bsky.social(2026-09-11)— Annuncia il rilascio di ComfyUI v0.35.1; l'ambiente open source di generazione locale continua ad aggiornarsi.
https://bsky.app/profile/minaxlab.bsky.social/post/3mvasr3l72x2i - aichina.news(2026-09-08〜09, post consecutivi)— Su Modelers.cn di Huawei compaiono continuamente LoRA FLUX con licenza Apache-2.0, spesso senza trigger word né benchmark; l'account ribadisce che mancano prove per ritenerli superiori a Qwen-Image.
https://bsky.app/profile/aichina.news/post/3mv3vq3zdui24 - arxiv-cs-cv.bsky.social(2026-09-11)— Pubblicato un nuovo articolo su valutazione e miglioramento delle capacità di ragionamento «Think-with-Video» nei modelli video generativi.
https://bsky.app/profile/arxiv-cs-cv.bsky.social/post/3mvbfk6tunc2j
Segnali
- Sora è di fatto in rallentamento: rimozione di modelli dalla pagina prezzi, uscita del responsabile e fondazione di una startup concorrente, oltre all'osservazione sul consumo di risorse, sono emersi nello stesso periodo. La generazione video di OpenAI appare sulla difensiva.
- Google, al contrario, è in piena espansione: integra Nano Banana per immagini, Nano Banana Pro, Veo e Gemini Omni per video persino nell'app Windows, seguendo una strategia di inserimento dell'AI generativa ovunque.
- I protagonisti open source sono cinesi: Qwen-Image-3.0-Pro, Z-Image (Turbo), MiniMax, Alibaba WAN 3.0 e SenseTime SenseNova-U1.5 sono al centro dell'attenzione. Più account sostengono che solo i modelli open cinesi possano competere con prodotti occidentali di immagini e video.
- Il divario con il closed source si sta riducendo: secondo le misurazioni continuative di oludai.bsky.social, Qwen-Image-3.0-Pro è a 92 Elo da GPT Image 2 (high) nelle valutazioni blind.
- Attenzione a rumore e promozione: molti post su WAN 3.0 sono raffiche identiche di affiliazione da circuitai.bsky.social, non un segnale organico di interesse.
- L'ecosistema ComfyUI e LoRA continua a evolvere: oltre agli aggiornamenti di ComfyUI, avanzano anche porting come i LoRA FLUX per NPU Ascend di Huawei, cioè per hardware diversi da CUDA.
Limiti
- Le API pubbliche Bluesky (
public.api.bsky.appeapi.bsky.apptramiteapp.bsky.feed.searchPosts) hanno restituito errori 403 intermittenti, probabilmente per rate limiting. Molte query funzionavano solo riprovando dopo un intervallo. - Alcune parole chiave —
Runway Gen,Kling AI,Black Forest Labs,Wan 2.5con varianti — continuavano a produrre 403, quindi sono state abbandonate e sostituite con query alternative comeWan video. Non sono stati raccolti post diretti su Runway e Kling. - La UI web di
bsky.app/searchè una SPA JavaScript e non restituiva il testo tramite fetch; la raccolta dipende quindi interamente dal JSON dell'API pubblica. - Termini come
FluxeZ-Imagerestituiscono molti risultati irrilevanti — Aeon Flux, solar flux, Pokémon Z-A e siti video per adulti — rendendo lunga l'esclusione manuale. - Per The Information sul caso Katzenberg e per l'articolo arXiv sono stati verificati solo titolo e riassunto, non il testo completo per paywall e complessità specialistica.
Lemmy
Lemmy — Notizie sull'AI per immagini e video
Community
- !«メールアドレス» — 5.709 iscritti totali, di cui 893 locali. È il maggior hub Lemmy sul tema, ma i post recenti sono quasi tutti inseriti quotidianamente da un'unica persona,
Even_Adder, che condivide nuove release GitHub e HuggingFace. - !«メールアドレス» / lemmy.world — Community per condividere opere generate; più galleria che notizie, con punteggi da -14 a 16.
- !«メールアドレス» — Community specialistica di arte astratta con SDXL e LoRA personalizzati; oltre dieci post a settembre, attività vivace.
- !ai_reddit@[varie istanze] — Raccolta di crosspost da Reddit r/ArtificialInteligence, con poca discussione originale.
- !«メールアドレス» — Notizie tech generaliste, dove gli articoli Midjourney hanno superato 70 pt.
- !hackernews@[varie istanze] — Crosspost da Hacker News, con più post sul caso Midjourney.
- !techtakes@[varie istanze] — Community fortemente critica verso l'AI; «Midjourney pivots to Theranos» ha ottenuto 40 pt.
- !llm@[varie istanze] — Community sui LLM; il post sul rilascio di GPT-6 Astra ha ricevuto un freddo -3.
- !«メールアドレス» — Piccola community dedicata allo strumento di generazione testo/immagini Perchance.
Le API di alcune istanze restituiscono 404 per il numero di iscritti; salvo !«メールアドレス», non è stato possibile confermare cifre precise.
Post
Più vicini al closed source
- "Midjourney pivots from AI image generation to body scanning medical spa" — !«メールアドレス», 58 pt, 2026-06-18. https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429 — Notizia sorprendente: Midjourney passerebbe dalla generazione di immagini a una medical spa con CT a ultrasuoni, Midjourney Medical.
- "Midjourney AI pivots to Theranos: Ultrasonic CT" — !techtakes, 40 pt, 2026-06-19. https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — Commento ironico che definisce la vicenda il ritorno di Theranos.
- Pagina ufficiale "Midjourney Medical" — !hackernews, 3 pt, 2026-06-18. https://www.midjourney.com/medical
- "Midjourney wants Hollywood studios to reveal the details of their AI usage" — !«メールアドレス», 73 pt, 2026-07-05. https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/ — Midjourney chiede agli studi di Hollywood di rivelare i dettagli del loro uso dell'AI.
- "Behind the scenes with the Midjourney scanner"(video)— !hackernews, 1 pt, 2026-07-06. https://www.youtube.com/watch?v=4nzzpUKhj1M
- "Amnesty International's May 2026 briefing calls leading generative AI systems 'unlawful by design'" — !ai_reddit, 1 pt, 2026-06-24. https://www.reddit.com/r/ArtificialInteligence/comments/1ue64s2/ — Un'organizzazione per i diritti umani critica la raccolta dati dei principali sistemi generativi closed source, compresa la generazione di immagini, definendoli potenzialmente illegali.
- Rilascio di GPT-6 Astra — !llm, -3 pt, 2026-09-04. https://openai.com/index/gpt-6-astra/ — Il LLM non genera direttamente immagini/video: invoca strumenti attraverso Responses API. Ha quindi poca rilevanza diretta per il tema e una reazione negativa su Lemmy.
Più vicini all'open source(tutti su !«メールアドレス», pubblicati da Even_Adder)
- Strumenti nell'ecosistema del modello video MiniMax-H3 — Oltre 7 post dal 4 al 10 settembre (
ComfyUI-MiniMax-H3-W4A4-VSA,MiniMax-H3-Semantic-Bridge,ComfyUI-Ref2VA-VSA,Minimax-h3_Singularity,minimax-h3_fl2v_8Step_motion_enhancer,ComfyUI-VDN-H3,vdn-minimax-h3,FastH3-Ref2V-Stream-Controller). Quantizzazione, accelerazione e bridge semantici mostrano un ecosistema in esplosione. Esempio: https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA - "LLaDA-Image: Building Strong Image Generators" — 3 pt, 2026-09-04. https://arxiv.org/abs/2609.03796 — Paper su un Diffusion Transformer open source da 6B parametri.
- Due LoRA per Krea 2 Turbo —
F16/krea2-turbo-sda(2 pt, 10/9, https://huggingface.co/F16/krea2-turbo-sda)elvladikov/Krea2-Turbo-Distill-4step-LoRA(2 pt, 8/9, dichiara +45% di qualità tramite distillazione a 4 step). - "Viggle/Viggle-Animate" — 10 pt, 2026-09-05. https://huggingface.co/Viggle/Viggle-Animate — Tecnologia per sostituire un personaggio in un video usando un singolo fotogramma ridisegnato.
- "How a 20-year-old independent builder from Bihar created an open omni AI model" — !ai_reddit, 0 pt, 2026-09-11. https://www.reddit.com/gallery/1wdii5s — Modello omni open da 5,84B parametri che avrebbe superato il modello AFM 3B di Apple nel benchmark MATH-500.
Segnali
- Nell'open source, il campo di battaglia principale non è il modello base ma l'ecosistema circostante. In particolare, intorno a MiniMax-H3 sono stati rilasciati in una settimana oltre dieci strumenti tra quantizzazione, accelerazione, nodi ComfyUI e LoRA; qui si concentra l'entusiasmo della community.
- La comunicazione Lemmy sul tema dipende di fatto dalla curation di una persona, Even_Adder. È più simile a una raccolta di link che a thread di discussione, e quasi non ci sono commenti.
- La maggiore notizia closed source non è la gara prestazionale, ma il pivot di Midjourney verso le medical spa, percepito come scandaloso. Il tono è più da critica aziendale e ironia che da notizia tecnologica.
- Anche le critiche di organizzazioni per i diritti umani, come Amnesty International, sulla legalità e sulla raccolta dei dati dell'AI generativa emergono come tema associato al closed source.
- GPT-6 Astra, rilasciato a settembre 2026, non genera direttamente immagini o video e quindi riceve poca attenzione nel tema; su Lemmy ha persino un punteggio negativo.
Limiti
- Lemmy dipende dalla corrispondenza per parole chiave dell'API. Ricerche per
Sora,Veo,Runway,Kling,Grok ImagineeNano Banananon hanno prodotto risultati rilevanti; questi argomenti sono quasi assenti su Lemmy. !«メールアドレス», versione su un'altra istanza, non si caricava per HTTP 503; è stata usata come alternativa l'istanza dbzer0.- Le API per gli iscritti di più community (
/api/v3/community?name=...) hanno prodotto 404, rendendo impossibile verificare i numeri esatti. - Pur avendo raccolto 20 post pertinenti, Lemmy è una piattaforma molto piccola per questo argomento: le fonti effettive sono concentrate in poche community e account. Le discussioni originali sono rare; la maggior parte sono link o repost.
Pinterest — Notizie sull'AI per la generazione di immagini e video
Sono stati aperti e controllati visivamente tutti i 50 pin presenti in output/pinterest.pins.md, raccolti tramite un'unica query, "Image and Video Generation AI News", senza classificazione di genere.
Temi visivi
- Gli sfondi UI futuristici blu neon/viola sono di gran lunga i più comuni: sfondi neri con circuiti, loghi AI luminosi e sagome umane olografiche ricorrono sia nelle infografiche sia nelle miniature video
[1, 3, 4, 5, 34, 37, 39, 41, 48]. - Ricorrono miniature standard con volto in primo piano di uno YouTuber barbuto, grandi scritte «AI NEWS» e collage di loghi aziendali; espressioni stupite o sospettose e loghi Google/OpenAI/Microsoft/Meta/Anthropic
[4, 20, 21, 45]. - Sono molto frequenti infografiche di classifica «best AI video tool», con lo stesso schema: schede numerate, logo, checklist delle funzioni e «best for». Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo e Synthesia compaiono quasi in tutte
[7, 8, 13, 24, 40]. - Spicca il formato che chiede di distinguere tra reale e AI: quiz con foto di paesaggi, spiegazioni dei trend deepfake e indicatori di rilevamento della voce AI
[16, 17, 20, 37]. - L'immagine del robot umanoide come simbolo di AI viene riutilizzata spesso: robot conduttori di notiziari, robot che indicano il globo e visi metà cyborg, normalmente senza legame con il contenuto tecnico
[2, 34, 37, 39, 48]. - Un pin contiene una griglia di trasformazione dei materiali: lo stesso video di persona, cane e auto viene convertito in blocchi di legno, origami, LEGO e fiori; è una dimostrazione concreta della capacità espressiva dei modelli video
[6]. - Sono presenti pin promozionali per freelance e servizi: annunci stile Fiverr per «creo video AI», alcuni con contatti WhatsApp o immagini generate di Jeff Bezos
[15, 32, 42]. - Le vere notizie di prodotto, spesso screenshot di annunci ufficiali, sono una minoranza. Tra queste Google Veo 2/3, Microsoft VASA-1, Vidu S1 di ShengShu, il modello Adobe per upscaling, AMD Amuse 3.0 e l'accordo sul copyright ByteDance-MPA
[3, 5, 12, 29, 46, 10, 47, 31].
Pin notevoli
- #3/#5 — Google announces ultra-high quality video / promo Veo 2 — Materiale promozionale ufficiale Google con campioni di output Veo 2, come un cane che nuota sott'acqua, fenicotteri e una ragazza animata in cucina.
- #12 — Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Aggiornamento concreto: immagini→video Veo 3 e audio nativo tramite Gemini API.
- #6 — Griglia dimostrativa di trasformazione dei materiali (stile Luma) — Confronto dello stesso video sorgente trasformato in blocchi di legno, origami, LEGO e fiori; è il pin che mostra più concretamente le prestazioni del modello.
- #16 — "Why Is Trump Obama AI Video Trending?" — Infografica dettagliata su un trend di video AI virali; elenca Runway ML, Pika Labs, Kaiber, HeyGen, CapCut AI e DeepBrain AI.
- #29 — ShengShu Technology unveils Vidu S1 — Pin sull'annuncio di un modello cinese che promette «generazione interattiva in tempo reale».
- #31 — ByteDance and Hollywood reach global deal on AI copyright — Notizia legale/IP su un accordo tra ByteDance e MPA per la protezione del copyright negli strumenti AI per immagini e video.
- #44 — "More than 20% of YouTube is now AI-generated" — Uno dei pochi pin che presenta una statistica specifica.
- #46 — Microsoft VASA-1 — Demo di ricerca che genera un video parlante da una foto e un clip audio.
- #47 — "Amuse 3.0" (AMD) — Annuncio di una nuova versione dello strumento di generazione immagini AI.
- #37 — Infografica sul rilevamento della voce AI ("97% likely AI generated") — Pin divulgativo su autenticità e etica dell'AI.
Segnali
- Il centro della conversazione rimane l'insieme degli strumenti commerciali closed source — Runway, Pika, Kling AI, Luma, Canva, Hailuo, Synthesia e D-ID — i cui loghi ricorrono in quasi tutte le infografiche di classifica. Non sono emersi pin che mettano in primo piano open source, self-hosting, Stable Video Diffusion, workflow ComfyUI o Open-Sora.
- Google Veo 2/3 è la notizia ufficiale di prodotto più visibile; vengono sottolineati immagini→video e audio nativo via Gemini API.
- Tra i player cinesi compare Vidu S1 di ShengShu, presentato con l'angolo della generazione interattiva in tempo reale.
- Deepfake e ansia sull'autenticità — trend Trump-Obama, rilevamento della voce AI e quiz «which is AI?» — sono un sottotema costante su Pinterest.
- Esistono anche notizie sulla struttura del settore e sul diritto, fra cui la quota di contenuti AI su YouTube superiore al 20% e l'accordo ByteDance-MPA sul copyright.
- Mancano quasi del tutto approfondimenti tecnici su architetture, metodi di training e confronti benchmark; per natura, Pinterest privilegia presentazioni di strumenti, guide e spiegazioni di fenomeni virali.
Limiti
- Il worker ha usato una singola query,
"Image and Video Generation AI News", senza ripartizione per open/closed source; l'analisi riguarda quindi tutti i 50 pin insieme e rinvia la classificazione al successivo stadio di integrazione. - Alcuni pin sono poco pertinenti o semplici immagini stock generiche, come
#35immagine di attualità con mappa del mondo,#43statua che suona il violoncello e#22icone Adobe Stock. Il matching di Pinterest è permissivo e introduce rumore. - Pinterest non mostra la data di pubblicazione dei pin; si possono usare solo riferimenti come «2025» o «2026» nei titoli.
- I titoli testuali dei pin sono quelli memorizzati nella cache Pinterest e potrebbero divergere da data e dettagli effettivi degli articoli collegati; qui sono stati verificati solo immagine e titolo.
Azioni consigliate
- Rifare la ricerca X usando nomi propri — Midjourney, Sora, Runway, Kling, Flux e ComfyUI — invece dei trend del giorno.
- Monitorare nel tempo il divario Elo tra Qwen-Image-3.0-Pro e GPT Image 2 per tracciare il divario prestazionale open/closed source.
- Continuare a seguire l'account Bluesky che monitora la pagina prezzi per verificare la tesi del rallentamento di Sora.
- Ampliare le query Reddit per raggiungere l'obiettivo di 20 thread.
- Non fidarsi isolatamente delle infografiche di classifica Pinterest né dei post affiliati ripetuti su Bluesky; adottarli solo dopo verifiche incrociate su altre piattaforme.
Immagini raccolte


















































Nota sulla qualità dei dati
Su X non è stato raccolto alcun post relativo all'AI per immagini e video a causa della scelta errata delle query. Reddit si è fermato a 12 contenuti, meno dei circa 20 previsti; YouTube non ha consentito di ottenere visualizzazioni e iscritti a causa del rendering JavaScript; Bluesky ha richiesto l'abbandono della raccolta per alcune parole chiave dopo ripetuti errori 403.



