KEN’S CAT LOG

Notizie sull'AI per la generazione di immagini e video — 2026-09-12

Il fronte open source, soprattutto cinese con Z-Image, Qwen-Image e MiniMax-H3, si avvicina ai modelli closed source nelle valutazioni alla cieca. Google attacca su tutti i fronti con Nano Banana, Veo e Gemini Omni, mentre Sora di OpenAI mostra segnali di rallentamento: modelli rimossi dalla pagina prezzi e uscita del responsabile.

Riepilogo delle notizie sull'AI per immagini e video — 2026-09-12

Ciao! Questa volta ho fatto una ricerca approfondita nel mondo dell'AI per immagini e video su sei piattaforme: Reddit, X, YouTube, Bluesky, Lemmy e Pinterest 🔥 In sintesi, sul fronte closed source Google sta spingendo al massimo sia sulle immagini sia sui video, mentre Sora di OpenAI sembra un po' in calo 😳. Nell'open source, i player cinesi (Qwen, Z-Image, MiniMax, Wan) stanno davvero raggiungendo i modelli proprietari nelle valutazioni alla cieca: uno sviluppo super interessante 🔥🔥 La ricerca su X, però, è stata un buco nell'acqua totale: non è emersa neanche una conversazione sull'AI per immagini o video, e lo segnalo onestamente come una lacuna seria 💦 Inoltre, su tutte le piattaforme si è parlato moltissimo di autenticità e affidabilità, con contenuti del tipo «ma è davvero AI?»; sorprendentemente, hanno avuto più diffusione delle discussioni sulle prestazioni dei modelli 👀

Across platforms

  • I protagonisti dell'open source sono ormai i player cinesi🇨🇳: in modo indipendente su YouTube, Bluesky e Lemmy, Qwen-Image, Z-Image (Turbo), MiniMax (H3/Hailuo 3.0) e Alibaba Wan vengono celebrati come i «nuovi re». Nella classifica blind di Bluesky, Qwen-Image-3.0-Pro sarebbe a soli 92 punti Elo da GPT Image 2 (high): davvero impressionante (https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t).
  • Google attacca con immagini e video insieme: tra la recensione di Veo 3.1 su YouTube (https://www.youtube.com/watch?v=sTOFXi2eY_k), la presentazione di Nano Banana 2 di Teacher's Tech (https://www.youtube.com/watch?v=nikIxHM_AQY) e la notizia su Bluesky di un'app desktop Windows con «Gemini Omni» (https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n), la sua offensiva a tutto campo è davvero forte 💪
  • I contenuti su come riconoscere l'AI sono davvero popolari: sia i thread di identificazione su Reddit (r/isthisAI) (https://www.reddit.com/r/isthisAI/comments/1wbspxo/) sia le infografiche Pinterest sul rilevamento di deepfake e voci AI si sono animate indipendentemente. L'ansia sull'autenticità è diventata un tema trasversale; è sorprendente che diffonda più delle notizie sulle capacità dei modelli.
  • Gli slogan su «illimitato» e affiliazioni sono guardati con sospetto ovunque: il commento Reddit secondo cui i siti che promettono «unlimited» sono quasi sempre borderline truffaldini (#4, r/generativeAI) e lo spam ripetuto di circuitai.bsky.social per WAN 3.0 su Bluesky mostrano lo stesso schema. Gli utenti restano giustamente scettici 😤
  • Gli utenti comuni distinguono poco tra open e closed source: nei thread Reddit sulle richieste di strumenti, Qwen, Flux, Seedream, Veo e GPT Image vengono elencati insieme come modelli disponibili; quasi nessuno sottolinea la distinzione. C'è quindi un divario rilevante tra la struttura a due assi richiesta dal brief e il modo in cui gli utenti percepiscono gli strumenti.

Platform by platform

Reddit — Raccolti 12 thread, meno dell'obiettivo di circa 20. Il contenuto con più engagement non riguardava un nuovo modello, ma GPT-6 usato per creare falsi timelapse di disegni a mano (r/antiai, 7.146 pt, https://www.reddit.com/r/antiai/comments/1w81kdd/): un post di rabbia per la «deception» dell'AI. In più thread è emersa indipendentemente una domanda per piattaforme integrate non censurate e NSFW (WildOwl.ai, cyberbara, Tensor.art e altre).

X — Buco nell'acqua totale 😭 I 40 post raccolti parlavano di Yemen, memecoin $SONG e Chelsea FC; zero post riguardavano l'AI per immagini o video. Il problema è che le query usate, basate sui trend, erano fuori tema: la prossima volta serviranno ricerche per nomi specifici come Midjourney, Sora e Runway.

YouTube — La piattaforma con più informazioni questa volta ✨ Sul fronte closed source, GPT Image 2/2.5 è primo nell'Artificial Analysis Image Arena (Elo 1.339, il maggior distacco storico tra primo e secondo, https://www.youtube.com/watch?v=DY6TkI8XtkQ); Veo 3.1 migliora il lip-sync, mentre ByteDance Seedream 5.0 Pro viene giudicato superiore ai modelli esistenti (https://www.youtube.com/watch?v=WpcxwSNT3X4). Sul fronte open, FLUX.2 di Black Forest Labs è indicato come possibile «nuovo re» (https://www.youtube.com/watch?v=YQuTkPVkCS8), Alibaba Z-Image Turbo come re dei modelli locali (https://www.youtube.com/watch?v=K0FgDU-9uik), e Lightricks LTX-2 persino come il «Santo Graal dei video open source».

Bluesky — Sora potrebbe essere in seria fase di rallentamento 👀 Oltre a un post che ha rilevato la rimozione silenziosa di sora-2 e sora-2-pro dalla pagina prezzi (https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23), è emerso uno scoop: l'ex responsabile Sora Bill Peebles avrebbe avviato una startup indipendente con importanti figure di Hollywood (https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n). Sul lato open source, Qwen, Z-Image, MiniMax, WAN 3.0 e SenseNova-U1.5 dominano la conversazione.

Lemmy — Piattaforma più piccola, di fatto dipendente dalla curation di una sola persona, Even_Adder 😅 Ma la principale notizia closed source è davvero scioccante: Midjourney avrebbe virato dalla generazione di immagini a un'attività di medical spa con scansioni CT a ultrasuoni (https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429), venendo ironicamente definita «il ritorno di Theranos». Sul fronte open source, l'ecosistema di strumenti ComfyUI e quantizzazione intorno a MiniMax-H3 sta esplodendo, con oltre sette rilasci in una settimana.

Pinterest — Esaminati visivamente tutti i 50 pin 👀 Gli strumenti commerciali closed source (Runway, Pika, Kling AI, Luma, Canva, Hailuo e Synthesia) compaiono quasi sempre nelle infografiche di classifica; i pin open source sono quasi assenti. Ci sono anche notizie reali, come materiali promozionali ufficiali di Google Veo 2/3 e l'accordo sul copyright tra ByteDance e Hollywood/MPA (#31), ma la maggior parte sono miniature prodotte in massa per SEO e affiliazioni. Un pin (#44) afferma anche che oltre il 20% di YouTube è generato dall'AI.

What to watch

Recommendations

  • La prossima ricerca su X dovrebbe usare nomi specifici — Midjourney, Sora, Runway, Kling, Flux e ComfyUI — invece dei trend del giorno.
  • Bisognerebbe continuare a seguire gli account Bluesky che monitorano la pagina prezzi per verificare l'andamento di Sora.
  • L'indicatore più chiaro del divario tra open e closed source è seguire nel tempo gli Elo di Qwen-Image-3.0Pro contro GPT Image 2.
  • Il pivot sanitario di Midjourney merita di essere seguito più come notizia di strategia aziendale che come notizia tecnica.
  • La raccolta Reddit dovrebbe ampliare le query per arrivare a 20 thread, non fermarsi a 12.
  • Le infografiche di classifica su Pinterest e le raffiche di post affiliati su Bluesky non dovrebbero essere considerate affidabili da sole: vanno adottate soltanto dopo conferme da altre piattaforme.

Data quality

Su X, per una scelta errata delle query, non sono emersi post sull'AI per immagini o video: per questo tema i dati sono di fatto assenti. Reddit ha fornito solo 12 thread, meno dell'obiettivo di circa 20, e il contenuto è più vicino alle richieste di consigli sugli strumenti che alle notizie. Pinterest non classificava i dati originali in open/closed source, quindi è stata necessaria una riclassificazione manuale. Lemmy è una piattaforma piccola, sostanzialmente dipendente dalla curation di un solo account, Even_Adder. Su YouTube, a causa del rendering JavaScript, WebFetch non ha potuto ottenere il testo delle pagine video; nemmeno visualizzazioni e iscritti sono stati ottenibili tramite oEmbed. Su Bluesky, alcuni termini (Runway, Kling, Black Forest Labs) hanno prodotto persistenti errori 403 e la raccolta è stata abbandonata; inoltre, le conversazioni su WAN 3.0 erano sommerse dallo spam ripetitivo.

Riepilogo per piattaforma

Reddit

Reddit — Notizie sull'AI per la generazione di immagini e video

Dove

I 12 thread raccolti provengono dai seguenti 9 subreddit.

Subreddit Membri Thread raccolti
r/isthisAI 408.823 1
r/antiai 322.973 1
r/GetNoted 298.488 1
r/generativeAI 152.415 3
r/aiwars 167.809 1
r/hatethissmug 134.660 1
r/aivideomaking 6.823 2
r/GoogleFlow 1.884 1
r/AItips101 1.299 1

Spiccano i grandi subreddit che discutono l'AI generativa in sé (r/antiai, r/aiwars, r/isthisAI, r/GetNoted), mentre i subreddit medi dedicati a strumenti e raccomandazioni (r/generativeAI, r/aivideomaking) raccontano le tendenze d'uso concrete.

Cosa dicono le persone
  • 【#6, r/antiai, 7.146 pt / 1.025 commenti, 2026-09-05】Post secondo cui a un LLM, indicato come GPT-6, sono stati concessi mouse e tastiera per «disegnare a mano» su una tavoletta digitale e falsificare persino il timelapse. Il commento più votato (2.511 pt, u/Nayutantantan) esprime rabbia: non ha più voglia di registrare timelapse neanche delle proprie opere, perché i falsi timelapse stanno diventando normali. È di gran lunga il thread con più reazioni nella raccolta. https://www.reddit.com/r/antiai/comments/1w81kdd/
  • 【#11, r/GetNoted, 4.470 pt / 325 commenti, 2026-09-10】Esempio di un post su X con immagine generata dall'AI, contenente testo deformato come "Handloags" in un'immagine di programma, diventato oggetto di derisione. I commenti principali ridono proprio della scarsa qualità dell'immagine AI. https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
  • 【#1, r/AItips101, 145 pt / 83 commenti, 2026-09-07】«Classifica 2026 dei generatori di immagini AI non censurati». Al primo posto WildOwl.ai, presentato come accesso pay-per-use a oltre 35 modelli — Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo e GPT Image — senza abbonamento mensile e con crediti senza scadenza. Un commentatore approva perché altrove i filtri gli avevano fatto sprecare crediti; altri raccomandano Perchance/Uncensored.ai. https://www.reddit.com/r/AItips101/comments/1w9yftp/
  • 【#8, r/aivideomaking, 4 pt / 21 commenti, 2026-09-09】Alla richiesta di strumenti gratuiti o a crediti per immagini e video fotorealistici, vengono elencati OpenartAI, fal, dzine, pixverse, Higgsfield e RunningHub, che permette modelli OSS e closed source tramite ComfyUI. Un utente aggiunge che Seedance 2.5 su cyberbara è non censurato e supporta volti reali. https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
  • 【#3, r/generativeAI, 0 pt / 7 commenti, 2026-09-11】Thread alla ricerca di generatori browser-only per immagini e video NSFW. u/MisterZan25 presenta RunDiffusion/Tensor.art per immagini e coerenza dei personaggi, PornGen/PornJourney e mirror di Pika Labs per video; u/frighten raccomanda l'app iPhone «PixelForge», on-device e non censurata. https://www.reddit.com/r/generativeAI/comments/1wdkbxv/
  • 【#4, r/generativeAI, 1 pt / 11 commenti, 2026-09-07】Alla domanda sul più economico servizio illimitato per immagini→video in 1080p, Artlist.io (€550/anno) viene proposto come candidato. Diversi commenti criticano però la promessa «illimitata»: u/ai_art_is_art osserva che tali siti sono quasi sempre borderline truffaldini e che, dopo aver speso $550, si ottiene l'equivalente di soli $200 e si deve attendere 24 ore. https://www.reddit.com/r/generativeAI/comments/1wa4k88/
  • 【#5, r/aivideomaking, 16 pt / 38 commenti, 2026-09-07】Alla richiesta di creare gratis un video di 45 secondi soltanto da smartphone o iPad, u/NewLifeWares risponde che 45 secondi richiedono di fatto capacità da datacenter: gratuitamente ci si può aspettare al massimo uno o due clip da 5 secondi con watermark, poi da montare. La discussione rende visibile la domanda, e l'irrealismo, della combinazione gratuito+alta qualità+lungo formato. https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
  • 【#7, r/GoogleFlow, 6 pt / 2 commenti, 2026-09-10】Rilasciata AutoFlow, estensione Chrome per Google Flow (Veo): include generazione batch, continuazione dall'ultimo frame del clip precedente e montaggio automatico di video narrati con audio e sottotitoli; modello freemium con abbonamenti Pro/Ultra. https://www.reddit.com/r/GoogleFlow/comments/1wccmrg/
  • 【#12, r/aiwars, 0 pt / 14 commenti, 2026-09-08】Discussione sui rischi di diritto all'immagine e uso pubblicitario quando una persona generata dall'AI assomiglia casualmente a una reale. Un utente nota che il caso più difficile è la coincidenza con un privato sconosciuto: alle aziende resta solo effettuare una ricerca inversa delle immagini e sperare. https://www.reddit.com/r/aiwars/comments/1wafe86/
  • 【#10, r/hatethissmug, 59 pt / 20 commenti, 2026-09-12】Differenze interne al fronte anti-AI davanti a un video che critica l'AI ma la utilizza. Un utente, pur dichiarandosi anti-AI, sostiene che l'argomento dell'impatto ambientale sia troppo esagerato e che sia irrealistico aspettarsi che l'AI sparisca da sola. https://www.reddit.com/r/hatethissmug/comments/1wdxv6k/
  • 【#2, r/isthisAI, 0 pt / 31 commenti, 2026-09-09】Thread per decidere se un video sia AI o ripresa reale. La sparizione e ricomparsa di una collana viene considerata decisiva, e un utente nota che la durata esatta di 15 secondi sembra il limite tipico dei video AI attuali. I limiti tecnici — durata e incoerenze — stanno diventando criteri di giudizio per il pubblico generale. https://www.reddit.com/r/isthisAI/comments/1wbspxo/
Segnali
  • In crescita: piattaforme integrate non censurate e NSFW come WildOwl.ai, cyberbara, RunDiffusion, Tensor.art e PixelForge vengono citate indipendentemente in più thread. È forte la domanda simultanea di accesso ai modelli più recenti e minore censura.
  • In crescita: nascita di ecosistemi complementari agli strumenti ufficiali, come AutoFlow (#7) per Google Flow.
  • Guardati con sospetto: abbonamenti che promettono «illimitato», come Artlist.io (#4), ricevono costantemente diffidenza dalla community.
  • Guardati con sospetto: anche nel fronte anti-AI, gli argomenti che enfatizzano l'impatto ambientale (#10) ricevono critiche interne per l'eccesso di enfasi; la narrativa anti-AI non è monolitica.
  • Aspetto sorprendente: fra i 12 thread raccolti, l'engagement maggiore non è stato per un nuovo modello, ma per la denuncia anti-AI del timelapse falsificato (#6, 7.146 pt) e per un caso derisorio di immagine AI (#11, 4.470 pt). Su Reddit, i temi di inganno e affidabilità diffondono molto più delle notizie di prodotto.
  • Aspetto sorprendente: la distinzione closed/open source non è al centro dell'interesse degli utenti. In molti thread, modelli come Qwen, Flux, Seedream, Wan, Kling, Seedance, Veo e GPT Image sono elencati in parallelo come strumenti disponibili, con pochissimi commenti che fanno caso alla differenza.
Limiti
  • È stata usata una sola query, "Image and Video Generation AI News", e sono stati raccolti soltanto 12 thread, meno dei circa 20 previsti dal criterio di completamento.
  • La raccolta consisteva nella lettura di contenuti già acquisiti da un worker tramite browser headless; non è stato possibile cercare o consultare ulteriormente Reddit in questa fase, poiché Reddit rifiuta le pagine via WebFetch e ricerca.
  • Molti post raccolti erano Q&A del tipo «consigliatemi uno strumento», più vicini all'utilizzo reale della community che alle «notizie». Non sono emersi thread specialistici che discutessero chiaramente gli sviluppi open e closed source.
  • r/AItips101 (1.299 persone) e r/GoogleFlow (1.884 persone) sono subreddit molto piccoli: le informazioni ottenute rappresentano singole voci più che l'intera community.

X

X — Tendenze delle notizie sull'AI per immagini e video

Account

I 40 post raccolti provengono da 40 account distinti, con un solo post ciascuno; nessun account ricorre. Nessuno è specializzato in AI per immagini e video (Midjourney, Stable Diffusion, Sora, Runway, Kling, Veo, ComfyUI, Flux e simili). Gli account sono raggruppati per query.

  • Yemen/Saudi (Medio Oriente e OSINT): @tleilax___, @Ahmed175143, @IranTimes72, @citrinowicz, @Osinttechnical, @c14english, @Rusia_HD, @MerruX — account OSINT e news su attacchi alle infrastrutture petrolifere saudite e conflitto yemenita.
  • $SONG (memecoin dell'ecosistema Cardano): @LagyADA, @EAjdarovic, @JureKaramarko, @SintoAndrej — piccoli account speculativi e promozionali.
  • Charlie Kirk (anniversario della morte): @tivent_1, @TruthNetwork24, @mscaradapawjob, @rokkstarrrrrrr — commenti politici e reazioni meme.
  • Britain (politica britannica): @brigantia__, @Steven41849941, @SirJBritain, @BROKENBRITAIN0 — post nazionalisti su immigrazione e sicurezza.
  • Anthropic (economia AI e sicurezza): @restitutorII, @BrianRoemmele, @walterkirn, @claudecode84 — scenari economici di Anthropic, open source di Claude Code e critiche all'AI; il tema è LLM e impatto sociale, non immagini o video.
  • Apple/Samsung (dibattito sugli smartphone): @FlossyCarter, @cagriozturkish, @appleinteligen, @BrandonKHill — provocazioni tra fan sui dispositivi pieghevoli.
  • Sony (industria videoludica): @JayDubcity16, @Cris_Uther, @treeblazah, @ScreenCraveHQ — gossip su Hideo Kojima e film di Spider-Man.
  • "one ai os" (autopromozione di startup AI): @de1lymoon, @neda_sefati, @harvey_control, @Iamanusbutt — networking per startup di agenti AI e sistemi operativi aziendali, senza riferimenti a immagini o video.
  • Chelsea (calcio): @declanstar1, @TheHateCentra, @Lea_EFC, @chelcatastr0phe — post sulle partite del Chelsea FC.

Non esistono autori ricorrenti tali da consentire un confronto fra un singolo post virale e l'accumulo di molti piccoli post. @rokkstarrrrrrr (9.404 like), @TheHateCentra (19.654 like) e @Cris_Uther (17.095 like) hanno ottenuto i risultati singoli maggiori, ma sono tutti fuori tema.

Post

Non è stato trovato alcun post che menzioni direttamente l'AI per immagini e video. Ecco, a puro titolo di riferimento, i post più vicini al tema ma comunque non pertinenti.

  1. #21 @restitutorII — 458 like·69 repost·41 risposte·~57.000 visualizzazioni·2026-09-10
    https://x.com/restitutorII/status/2097918742571139093

    "Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI..."
    → Previsioni economiche di Anthropic: AI generativa in generale, non tendenze dell'AI per immagini o video.

  2. #24 @claudecode84 — 2.585 like·268 repost·24 risposte·~741.000 visualizzazioni·2026-09-10
    https://x.com/claudecode84/status/2097959830942367747

    «Il responsabile di Anthropic stesso sta rendendo open source l'intero suo ambiente Claude Code»
    → Open source di Claude Code, AI per programmazione; non è un modello per immagini o video.

  3. #33 @de1lymoon — 49 like·6 repost·9 risposte·~3.500 visualizzazioni·2026-09-11
    https://x.com/de1lymoon/status/2098428267158032841

    "Grok Bot + Kimi K3 is where an AI agent starts turning into an operating system..."
    → Riflessione sull'orchestrazione degli agenti AI, senza relazione con la generazione di immagini o video.

  4. #22 @BrianRoemmele — 792 like·187 repost·105 risposte·~100.000 visualizzazioni·2026-09-10
    https://x.com/BrianRoemmele/status/2098024115231924568
    → Post in stile meme su critiche ad Anthropic e minacce dell'AI, senza riferimenti al tema.

  5. #23 @walterkirn — 723 like·91 repost·39 risposte·~28.000 visualizzazioni·2026-09-10
    https://x.com/walterkirn/status/2098059171325427949
    → Ancora nel contesto di critiche ad Anthropic e ai media, senza immagini o video AI.

I cinque post sopra sono tutto ciò che è emerso tramite la parola chiave «AI»; non sono adottabili come notizie di AI per immagini/video né per il closed source né per l'open source.

Segnali
  • I dieci trend principali di X Explore nella regione del server di questa sessione — probabilmente Croazia, dato il testo «Trending in Croatia» — erano Yemen, Saudi, $SONG, Charlie Kirk, Britain, Anthropic, Apple, Sony, one ai os e Chelsea. Nessuno riguarda Midjourney, Sora, Stable Diffusion, Runway, Kling, Veo o strumenti equivalenti.
  • Il fatto che Anthropic e one ai os siano in tendenza mostra che su X è attivo il dibattito su agenti AI, LLM e impatto economico; si tratta però di un gruppo di argomenti diverso dall'AI per immagini e video.
  • Nessuno dei 40 post contiene nomi di strumenti di generazione visiva, release, demo o confronti.
Limiti
  • Le query usate — "Yemen", "Saudi", "$SONG", "Charlie Kirk", "Britain", "Anthropic", "Apple", "Sony", "one ai os" e "Chelsea" — erano trend di X Explore del giorno, non query sugli strumenti di AI visiva. Perciò nessuno dei 40 post riguarda notizie open o closed source su immagini e video.
  • Non è quindi possibile ricavare da X le dieci osservazioni open source e le dieci closed source richieste dal brief. Più che «X non ha detto nulla», il problema è che non è stata svolta una ricerca pertinente al tema.
  • La prossima esecuzione dovrebbe usare nomi di strumenti e aziende: Midjourney, Stability AI, Runway, Pika, Luma, Kling, Sora, Google Veo, Flux, ComfyUI e simili.

YouTube

YouTube — Notizie sull'AI per immagini e video (closed source/open source)

Canali
  • There's An AI For That — Canale di presentazione di strumenti AI; ha pubblicato una recensione di FLUX.2.
  • AI Search — Canale di notizie rapide sui nuovi modelli; video su Sora 2 e HunyuanVideo 1.5.
  • Theoretically Media — Canale specializzato in AI video; recensione approfondita di Veo 3.1.
  • Teacher's Tech — Canale di strumenti pratici; recensione di Nano Banana 2.
  • Codebreakers — Recensioni e spiegazioni di modelli AI open source; speciale su MiniMax H3.
  • Bijan Bowen — Canale molto tecnico sull'AI locale per immagini; test di Z-Image Turbo.
  • Benji's AI Playground — Tutorial su ComfyUI e generazione locale; spiegazione di Ideogram 4.0.
  • Curious Refuge — Storico canale educativo di produzione video AI; recensione di Midjourney V8.
  • RandomAI — Notizie e confronti di nuovi modelli; spiegazione di GPT Image 2.5.
  • Standarity / The AI Filmmaking Advantage — Canali di notizie e test comparativi; riepilogo dell'annuncio e test completi di Seedream 5.0 Pro.
  • MattVidPro AI — Menzione in un video di prime impressioni su Runway Gen-4.
Video
  1. «Is FLUX 2.0 The New Open Source King?» — There's An AI For That — https://www.youtube.com/watch?v=YQuTkPVkCS8 — Valuta se FLUX.2 di Black Forest Labs possa diventare il nuovo re della generazione open source di immagini.
  2. «We have a new #1 open-source AI video generator!»(2025-11-25)— AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — Recensione e installazione di HunyuanVideo 1.5 in ComfyUI, presentato come eseguibile anche con poca VRAM.
  3. «Sora 2… wtf» — AI Search — https://www.youtube.com/watch?v=El-G4cO4x4I — Confronta OpenAI Sora 2 con Veo 3, Kling 2.5 e Hailuo 02, evidenziando miglioramenti nella sincronizzazione audio e nella fisica.
  4. «Veo 3.1 Is More Powerful Than You Realize!»(2025-10-16)— Theoretically Media — https://www.youtube.com/watch?v=sTOFXi2eY_k — Illustra i miglioramenti di Google Veo 3.1: lip-sync, coerenza dei personaggi e upscaling a 1080p.
  5. «The New Gemini Image Generator is Insane (Nano Banana 2)» — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Presenta Nano Banana 2 come nuovo predefinito dell'app Gemini.
  6. «MiniMax H3: The New Open-Source Video Champ?»(2026-08-03)— Codebreakers — https://www.youtube.com/watch?v=3R5GROj8Tcg — Presenta MiniMax H3 (Hailuo 3.0), modello video multimodale open-weight capace di generare video con audio stereo nativo in un solo passaggio.
  7. «Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models» — Bijan Bowen — https://www.youtube.com/watch?v=K0FgDU-9uik — Test locale di Z-Image Turbo con licenza Apache-2.0, proclamato KING.
  8. «Ideogram 4.0 Released! The New Open Model That FINALLY Gets Text Right»(2026-06-04)— Benji's AI Playground — https://www.youtube.com/watch?v=HY_e5CZfJfQ — Riferisce che il primo modello open-weight di Ideogram è primo in Design Arena e finalmente accurato nel rendering del testo.
  9. «I Tried Midjourney 8… Here's the Truth»(2026-03-19)— Curious Refuge — https://www.youtube.com/watch?v=i9qV9-2tzEA — Recensione onesta delle capacità di Midjourney V8.
  10. «GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model» — RandomAI — https://www.youtube.com/watch?v=DY6TkI8XtkQ — Spiega GPT Image 2/2.5 di OpenAI, con miglioramenti nel rendering del testo e nel supporto multilingue.
  11. «ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted» — Standarity — https://www.youtube.com/watch?v=g05iPef37Qs — Riassume l'annuncio di Seedream 5.0 Pro, che consente editing a livello di layer.
  12. «🚨BREAKING: Seedream 5.0 Pro Just SMOKED Every Image Model (Fully Tested)»(2026-07-16)— The AI Filmmaking Advantage — https://www.youtube.com/watch?v=WpcxwSNT3X4 — Confronto completo di Seedream 5.0 Pro con altri modelli, giudicato superiore agli esistenti.
Segnali

Movimenti sul fronte closed source

  • OpenAI GPT Image 2 / 2.5 è primo nell'Artificial Analysis Image Arena con Elo 1.339 e, secondo le notizie, il maggior distacco storico tra primo e secondo posto a settembre 2026.
  • Google Veo 3.1 e Nano Banana Pro (Gemini 3 Pro Image) si rafforzano come coppia video/immagini; lip-sync, upscaling 1080p ed editing a livelli mostrano un chiaro orientamento professionale.
  • ByteDance Seedance 2.0 (2026-02) e Seedream 5.0 Pro (intorno a luglio 2026) aumentano rapidamente la loro presenza grazie al multimodale: riferimento a testo, immagini, video e audio.
  • Più video sostengono che xAI Grok Imagine 1.5 superi Veo e Sora nei benchmark; il tema è diventato discusso intorno a giugno 2026.
  • Anche player consolidati come Runway Gen-4/4.5 e Midjourney V8 (V8.1, V8.2) continuano ad aggiornarsi, con molti video di recensione in chiave di «difesa del trono».

Movimenti sul fronte open source

  • FLUX.2 di Black Forest Labs viene definito in più recensioni il «nuovo re» come modello di immagini di alta qualità eseguibile localmente.
  • Tencent HunyuanVideo 1.5 supporta nativamente ComfyUI e si afferma come nuovo standard open source per video anche su sistemi a bassa VRAM.
  • Z-Image e Z-Image Turbo di Alibaba/Tongyi-MAI, pubblicati con licenza Apache-2.0, sono spesso valutati come i nuovi re dei modelli locali.
  • Ideogram 4.0 è stato rilasciato come primo modello open-weight dell'azienda, primo in Design Arena e apprezzato per l'accuratezza del testo.
  • MiniMax H3 (Hailuo 3.0) è emerso rapidamente nell'agosto 2026 come modello video multimodale open-weight eseguibile anche su GPU personali come RTX 3090; stanno comparendo molti video sul supporto ComfyUI.
  • Lightricks LTX-2 realizza in open source video 4K a 50 fps con sincronizzazione audio, ed è definito il «Santo Graal del video open source».
  • Anche Alibaba Wan 2.5/2.6 continua a essere trattato come modello open source per video capace di accettare input di testo, immagini, audio e video.
Limiti
  • Le pagine dei risultati YouTube (youtube.com/results?...) sono renderizzate via JavaScript, quindi WebFetch restituiva soltanto il footer e non titoli, visualizzazioni o dati dei canali. Anche le pagine dei singoli video (watch?v=) non erano leggibili direttamente; titoli e canali sono stati verificati tramite l'API oEmbed di YouTube (youtube.com/oembed).
  • L'API oEmbed non restituisce visualizzazioni, data di pubblicazione, iscritti o commenti. Visualizzazioni e iscritti non sono quindi disponibili; le date sono riportate solo quando presenti in alcuni snippet WebSearch.
  • «LTX-2: Open Source AI Video, Released to the Community» (zSvCnVi181A) ha restituito 403 Forbidden tramite oEmbed e non è stato verificabile.
  • Per queste ragioni, i commenti dei video non sono stati esaminati; i riassunti si basano solo su titolo e descrizione.
  • Le tendenze sono state integrate con informazioni da WebSearch, ma tutti i video collegati sono stati verificati come URL YouTube esistenti.

Bluesky

Bluesky — Notizie sull'AI per immagini e video (closed source/open source)

Account
  • theinformation.com / techmeme.com / mediagazer.com / lefiltech.fr — Bot informativi collegati via RSS, che diffondono scoop su OpenAI e Sora in più lingue.
  • ctxwindow.kynth.studio(#TechBluesky) — Osservatore che monitora e pubblica le differenze della pagina prezzi di OpenAI.
  • gen-ai.news — Account personale di notizie rapide sugli aggiornamenti di Midjourney.
  • oludai.bsky.social — Gestisce una classifica indipendente di valutazioni umane alla cieca su olud.ai, che classifica ogni ora modelli di immagini open e closed source.
  • aichina.news — Account quasi automatizzato che segnala quasi ogni giorno LoRA FLUX con licenza Apache-2.0 pubblicati su Modelers.cn di Huawei.
  • circuitai.bsky.social — Account spam/promozionale che pubblica quasi lo stesso testo oltre una dozzina di volte al giorno con link affiliati a Alibaba WAN 3.0 (vidhapi.app).
  • arxiv-cs-cv.bsky.social — Pubblicazione automatica di nuovi articoli arXiv su immagini e video generativi.
  • un1v3rse.bsky.social / carlbetheav.bsky.social / stumblegirl.bsky.social / ttaships.airminded.org — Artisti individuali che pubblicano quotidianamente opere con Midjourney (#midjourney #QP #FoxyFriday).
  • rin-yamami.bsky.social / satomin6.alimika.jp — Illustratori AI giapponesi che usano Qwen-Image-Edit e ComfyUI.
Post
  1. theinformation.com(2026-09-10, 👍1 🔁0)— Scoop: l'ex responsabile OpenAI Sora Bill Peebles avvia una startup indipendente di AI per la generazione video con Jeffrey Katzenberg, figura di spicco di Hollywood ed ex DreamWorks, e l'ex CFO di Dropbox.
     https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n
  2. ctxwindow.kynth.studio(2026-09-08, 👍0/1 🔁0)— Rilevata la rimozione silenziosa di sora-2 e sora-2-pro dalla pagina prezzi di OpenAI (prezzi precedenti: 720p $0,05–$0,30), interpretata come conferma del ridimensionamento di Sora.
     https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23
  3. somewhattolerable.com(2026-09-06, 👍2)— Osservazione secondo cui OpenAI avrebbe interrotto Sora perché gli ingegneri interni lamentavano un consumo eccessivo di risorse.
     https://bsky.app/profile/somewhattolerable.com/post/3muuuazkaf223
  4. itmatterss.bsky.social(2026-09-11, 👍1)— Gemini di Google diventa app desktop Windows, avviabile con Alt+Space; viene indicato Nano Banana per immagini e «Gemini Omni» per video.
     https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n
  5. dimnews.bsky.social(2026-09-11, russo)— SenseTime annuncia SenseNova-U1.5, modello multimodale da 8 miliardi di parametri, sostenendo che superi Nano-Banana-Pro nel ragionamento visivo.
     https://bsky.app/profile/dimnews.bsky.social/post/3mv7u7crnzz25
  6. gen-ai.news(2026-08-30, 👍1)— Segnala che il modello di editing Midjourney V8.2 è stato silenziosamente corretto dopo lamentele sul peggioramento della qualità.
     https://bsky.app/profile/gen-ai.news/post/3mudbgowbnz2s
  7. futureautomationai.bsky.social(2026-09-03, 👍2)— Riepilogo «Midjourney in 2026»: V8.2, personalizzazione, moodboard, modello di editing e funzioni di riferimento.
     https://bsky.app/profile/futureautomationai.bsky.social/post/3mumtnbxuv22d
  8. oludai.bsky.social(2026-09-10/11, 👍1-2)— Nella classifica blind, il miglior modello scaricabile è Qwen-Image-3.0-Pro (#12), a soli 92 Elo da GPT Image 2 (high).
     https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t
  9. ddigitalmedia.bsky.social(2026-09-10, 👍1)— Valutazione secondo cui Qwen, Z-Image e MiniMax sono gli unici concorrenti in grado di opporsi ai prodotti LLM e immagini occidentali.
     https://bsky.app/profile/ddigitalmedia.bsky.social/post/3mv6lyejx3223
  10. circuitai.bsky.social(2026-09-11〜12, post ripetuti)— Promuove WAN 3.0 di Alibaba come alternativa economica pay-per-use a Seedance 2.5 di ByteDance, fino a 30 secondi per clip. Nota: lo stesso testo affiliato è stato pubblicato oltre 15 volte al giorno.
     https://bsky.app/profile/circuitai.bsky.social/post/3mvbvqsdvr22p
  11. minaxlab.bsky.social(2026-09-11)— Annuncia il rilascio di ComfyUI v0.35.1; l'ambiente open source di generazione locale continua ad aggiornarsi.
     https://bsky.app/profile/minaxlab.bsky.social/post/3mvasr3l72x2i
  12. aichina.news(2026-09-08〜09, post consecutivi)— Su Modelers.cn di Huawei compaiono continuamente LoRA FLUX con licenza Apache-2.0, spesso senza trigger word né benchmark; l'account ribadisce che mancano prove per ritenerli superiori a Qwen-Image.
     https://bsky.app/profile/aichina.news/post/3mv3vq3zdui24
  13. arxiv-cs-cv.bsky.social(2026-09-11)— Pubblicato un nuovo articolo su valutazione e miglioramento delle capacità di ragionamento «Think-with-Video» nei modelli video generativi.
     https://bsky.app/profile/arxiv-cs-cv.bsky.social/post/3mvbfk6tunc2j
Segnali
  • Sora è di fatto in rallentamento: rimozione di modelli dalla pagina prezzi, uscita del responsabile e fondazione di una startup concorrente, oltre all'osservazione sul consumo di risorse, sono emersi nello stesso periodo. La generazione video di OpenAI appare sulla difensiva.
  • Google, al contrario, è in piena espansione: integra Nano Banana per immagini, Nano Banana Pro, Veo e Gemini Omni per video persino nell'app Windows, seguendo una strategia di inserimento dell'AI generativa ovunque.
  • I protagonisti open source sono cinesi: Qwen-Image-3.0-Pro, Z-Image (Turbo), MiniMax, Alibaba WAN 3.0 e SenseTime SenseNova-U1.5 sono al centro dell'attenzione. Più account sostengono che solo i modelli open cinesi possano competere con prodotti occidentali di immagini e video.
  • Il divario con il closed source si sta riducendo: secondo le misurazioni continuative di oludai.bsky.social, Qwen-Image-3.0-Pro è a 92 Elo da GPT Image 2 (high) nelle valutazioni blind.
  • Attenzione a rumore e promozione: molti post su WAN 3.0 sono raffiche identiche di affiliazione da circuitai.bsky.social, non un segnale organico di interesse.
  • L'ecosistema ComfyUI e LoRA continua a evolvere: oltre agli aggiornamenti di ComfyUI, avanzano anche porting come i LoRA FLUX per NPU Ascend di Huawei, cioè per hardware diversi da CUDA.
Limiti
  • Le API pubbliche Bluesky (public.api.bsky.app e api.bsky.app tramite app.bsky.feed.searchPosts) hanno restituito errori 403 intermittenti, probabilmente per rate limiting. Molte query funzionavano solo riprovando dopo un intervallo.
  • Alcune parole chiave — Runway Gen, Kling AI, Black Forest Labs, Wan 2.5 con varianti — continuavano a produrre 403, quindi sono state abbandonate e sostituite con query alternative come Wan video. Non sono stati raccolti post diretti su Runway e Kling.
  • La UI web di bsky.app/search è una SPA JavaScript e non restituiva il testo tramite fetch; la raccolta dipende quindi interamente dal JSON dell'API pubblica.
  • Termini come Flux e Z-Image restituiscono molti risultati irrilevanti — Aeon Flux, solar flux, Pokémon Z-A e siti video per adulti — rendendo lunga l'esclusione manuale.
  • Per The Information sul caso Katzenberg e per l'articolo arXiv sono stati verificati solo titolo e riassunto, non il testo completo per paywall e complessità specialistica.

Lemmy

Lemmy — Notizie sull'AI per immagini e video

Community
  • !«メールアドレス» — 5.709 iscritti totali, di cui 893 locali. È il maggior hub Lemmy sul tema, ma i post recenti sono quasi tutti inseriti quotidianamente da un'unica persona, Even_Adder, che condivide nuove release GitHub e HuggingFace.
  • !«メールアドレス» / lemmy.world — Community per condividere opere generate; più galleria che notizie, con punteggi da -14 a 16.
  • !«メールアドレス» — Community specialistica di arte astratta con SDXL e LoRA personalizzati; oltre dieci post a settembre, attività vivace.
  • !ai_reddit@[varie istanze] — Raccolta di crosspost da Reddit r/ArtificialInteligence, con poca discussione originale.
  • !«メールアドレス» — Notizie tech generaliste, dove gli articoli Midjourney hanno superato 70 pt.
  • !hackernews@[varie istanze] — Crosspost da Hacker News, con più post sul caso Midjourney.
  • !techtakes@[varie istanze] — Community fortemente critica verso l'AI; «Midjourney pivots to Theranos» ha ottenuto 40 pt.
  • !llm@[varie istanze] — Community sui LLM; il post sul rilascio di GPT-6 Astra ha ricevuto un freddo -3.
  • !«メールアドレス» — Piccola community dedicata allo strumento di generazione testo/immagini Perchance.

Le API di alcune istanze restituiscono 404 per il numero di iscritti; salvo !«メールアドレス», non è stato possibile confermare cifre precise.

Post
Più vicini al closed source
  1. "Midjourney pivots from AI image generation to body scanning medical spa" — !«メールアドレス», 58 pt, 2026-06-18. https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429 — Notizia sorprendente: Midjourney passerebbe dalla generazione di immagini a una medical spa con CT a ultrasuoni, Midjourney Medical.
  2. "Midjourney AI pivots to Theranos: Ultrasonic CT" — !techtakes, 40 pt, 2026-06-19. https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — Commento ironico che definisce la vicenda il ritorno di Theranos.
  3. Pagina ufficiale "Midjourney Medical" — !hackernews, 3 pt, 2026-06-18. https://www.midjourney.com/medical
  4. "Midjourney wants Hollywood studios to reveal the details of their AI usage" — !«メールアドレス», 73 pt, 2026-07-05. https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/ — Midjourney chiede agli studi di Hollywood di rivelare i dettagli del loro uso dell'AI.
  5. "Behind the scenes with the Midjourney scanner"(video)— !hackernews, 1 pt, 2026-07-06. https://www.youtube.com/watch?v=4nzzpUKhj1M
  6. "Amnesty International's May 2026 briefing calls leading generative AI systems 'unlawful by design'" — !ai_reddit, 1 pt, 2026-06-24. https://www.reddit.com/r/ArtificialInteligence/comments/1ue64s2/ — Un'organizzazione per i diritti umani critica la raccolta dati dei principali sistemi generativi closed source, compresa la generazione di immagini, definendoli potenzialmente illegali.
  7. Rilascio di GPT-6 Astra — !llm, -3 pt, 2026-09-04. https://openai.com/index/gpt-6-astra/ — Il LLM non genera direttamente immagini/video: invoca strumenti attraverso Responses API. Ha quindi poca rilevanza diretta per il tema e una reazione negativa su Lemmy.
Più vicini all'open source(tutti su !«メールアドレス», pubblicati da Even_Adder)
  1. Strumenti nell'ecosistema del modello video MiniMax-H3 — Oltre 7 post dal 4 al 10 settembre (ComfyUI-MiniMax-H3-W4A4-VSA, MiniMax-H3-Semantic-Bridge, ComfyUI-Ref2VA-VSA, Minimax-h3_Singularity, minimax-h3_fl2v_8Step_motion_enhancer, ComfyUI-VDN-H3, vdn-minimax-h3, FastH3-Ref2V-Stream-Controller). Quantizzazione, accelerazione e bridge semantici mostrano un ecosistema in esplosione. Esempio: https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA
  2. "LLaDA-Image: Building Strong Image Generators" — 3 pt, 2026-09-04. https://arxiv.org/abs/2609.03796 — Paper su un Diffusion Transformer open source da 6B parametri.
  3. Due LoRA per Krea 2 TurboF16/krea2-turbo-sda(2 pt, 10/9, https://huggingface.co/F16/krea2-turbo-sda)e lvladikov/Krea2-Turbo-Distill-4step-LoRA(2 pt, 8/9, dichiara +45% di qualità tramite distillazione a 4 step).
  4. "Viggle/Viggle-Animate" — 10 pt, 2026-09-05. https://huggingface.co/Viggle/Viggle-Animate — Tecnologia per sostituire un personaggio in un video usando un singolo fotogramma ridisegnato.
  5. "How a 20-year-old independent builder from Bihar created an open omni AI model" — !ai_reddit, 0 pt, 2026-09-11. https://www.reddit.com/gallery/1wdii5s — Modello omni open da 5,84B parametri che avrebbe superato il modello AFM 3B di Apple nel benchmark MATH-500.
Segnali
  • Nell'open source, il campo di battaglia principale non è il modello base ma l'ecosistema circostante. In particolare, intorno a MiniMax-H3 sono stati rilasciati in una settimana oltre dieci strumenti tra quantizzazione, accelerazione, nodi ComfyUI e LoRA; qui si concentra l'entusiasmo della community.
  • La comunicazione Lemmy sul tema dipende di fatto dalla curation di una persona, Even_Adder. È più simile a una raccolta di link che a thread di discussione, e quasi non ci sono commenti.
  • La maggiore notizia closed source non è la gara prestazionale, ma il pivot di Midjourney verso le medical spa, percepito come scandaloso. Il tono è più da critica aziendale e ironia che da notizia tecnologica.
  • Anche le critiche di organizzazioni per i diritti umani, come Amnesty International, sulla legalità e sulla raccolta dei dati dell'AI generativa emergono come tema associato al closed source.
  • GPT-6 Astra, rilasciato a settembre 2026, non genera direttamente immagini o video e quindi riceve poca attenzione nel tema; su Lemmy ha persino un punteggio negativo.
Limiti
  • Lemmy dipende dalla corrispondenza per parole chiave dell'API. Ricerche per Sora, Veo, Runway, Kling, Grok Imagine e Nano Banana non hanno prodotto risultati rilevanti; questi argomenti sono quasi assenti su Lemmy.
  • !«メールアドレス», versione su un'altra istanza, non si caricava per HTTP 503; è stata usata come alternativa l'istanza dbzer0.
  • Le API per gli iscritti di più community (/api/v3/community?name=...) hanno prodotto 404, rendendo impossibile verificare i numeri esatti.
  • Pur avendo raccolto 20 post pertinenti, Lemmy è una piattaforma molto piccola per questo argomento: le fonti effettive sono concentrate in poche community e account. Le discussioni originali sono rare; la maggior parte sono link o repost.

Pinterest

Pinterest — Notizie sull'AI per la generazione di immagini e video

Sono stati aperti e controllati visivamente tutti i 50 pin presenti in output/pinterest.pins.md, raccolti tramite un'unica query, "Image and Video Generation AI News", senza classificazione di genere.

Temi visivi
  • Gli sfondi UI futuristici blu neon/viola sono di gran lunga i più comuni: sfondi neri con circuiti, loghi AI luminosi e sagome umane olografiche ricorrono sia nelle infografiche sia nelle miniature video [1, 3, 4, 5, 34, 37, 39, 41, 48].
  • Ricorrono miniature standard con volto in primo piano di uno YouTuber barbuto, grandi scritte «AI NEWS» e collage di loghi aziendali; espressioni stupite o sospettose e loghi Google/OpenAI/Microsoft/Meta/Anthropic [4, 20, 21, 45].
  • Sono molto frequenti infografiche di classifica «best AI video tool», con lo stesso schema: schede numerate, logo, checklist delle funzioni e «best for». Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo e Synthesia compaiono quasi in tutte [7, 8, 13, 24, 40].
  • Spicca il formato che chiede di distinguere tra reale e AI: quiz con foto di paesaggi, spiegazioni dei trend deepfake e indicatori di rilevamento della voce AI [16, 17, 20, 37].
  • L'immagine del robot umanoide come simbolo di AI viene riutilizzata spesso: robot conduttori di notiziari, robot che indicano il globo e visi metà cyborg, normalmente senza legame con il contenuto tecnico [2, 34, 37, 39, 48].
  • Un pin contiene una griglia di trasformazione dei materiali: lo stesso video di persona, cane e auto viene convertito in blocchi di legno, origami, LEGO e fiori; è una dimostrazione concreta della capacità espressiva dei modelli video [6].
  • Sono presenti pin promozionali per freelance e servizi: annunci stile Fiverr per «creo video AI», alcuni con contatti WhatsApp o immagini generate di Jeff Bezos [15, 32, 42].
  • Le vere notizie di prodotto, spesso screenshot di annunci ufficiali, sono una minoranza. Tra queste Google Veo 2/3, Microsoft VASA-1, Vidu S1 di ShengShu, il modello Adobe per upscaling, AMD Amuse 3.0 e l'accordo sul copyright ByteDance-MPA [3, 5, 12, 29, 46, 10, 47, 31].
Pin notevoli
  1. #3/#5 — Google announces ultra-high quality video / promo Veo 2 — Materiale promozionale ufficiale Google con campioni di output Veo 2, come un cane che nuota sott'acqua, fenicotteri e una ragazza animata in cucina.
  2. #12 — Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Aggiornamento concreto: immagini→video Veo 3 e audio nativo tramite Gemini API.
  3. #6 — Griglia dimostrativa di trasformazione dei materiali (stile Luma) — Confronto dello stesso video sorgente trasformato in blocchi di legno, origami, LEGO e fiori; è il pin che mostra più concretamente le prestazioni del modello.
  4. #16 — "Why Is Trump Obama AI Video Trending?" — Infografica dettagliata su un trend di video AI virali; elenca Runway ML, Pika Labs, Kaiber, HeyGen, CapCut AI e DeepBrain AI.
  5. #29 — ShengShu Technology unveils Vidu S1 — Pin sull'annuncio di un modello cinese che promette «generazione interattiva in tempo reale».
  6. #31 — ByteDance and Hollywood reach global deal on AI copyright — Notizia legale/IP su un accordo tra ByteDance e MPA per la protezione del copyright negli strumenti AI per immagini e video.
  7. #44 — "More than 20% of YouTube is now AI-generated" — Uno dei pochi pin che presenta una statistica specifica.
  8. #46 — Microsoft VASA-1 — Demo di ricerca che genera un video parlante da una foto e un clip audio.
  9. #47 — "Amuse 3.0" (AMD) — Annuncio di una nuova versione dello strumento di generazione immagini AI.
  10. #37 — Infografica sul rilevamento della voce AI ("97% likely AI generated") — Pin divulgativo su autenticità e etica dell'AI.
Segnali
  • Il centro della conversazione rimane l'insieme degli strumenti commerciali closed source — Runway, Pika, Kling AI, Luma, Canva, Hailuo, Synthesia e D-ID — i cui loghi ricorrono in quasi tutte le infografiche di classifica. Non sono emersi pin che mettano in primo piano open source, self-hosting, Stable Video Diffusion, workflow ComfyUI o Open-Sora.
  • Google Veo 2/3 è la notizia ufficiale di prodotto più visibile; vengono sottolineati immagini→video e audio nativo via Gemini API.
  • Tra i player cinesi compare Vidu S1 di ShengShu, presentato con l'angolo della generazione interattiva in tempo reale.
  • Deepfake e ansia sull'autenticità — trend Trump-Obama, rilevamento della voce AI e quiz «which is AI?» — sono un sottotema costante su Pinterest.
  • Esistono anche notizie sulla struttura del settore e sul diritto, fra cui la quota di contenuti AI su YouTube superiore al 20% e l'accordo ByteDance-MPA sul copyright.
  • Mancano quasi del tutto approfondimenti tecnici su architetture, metodi di training e confronti benchmark; per natura, Pinterest privilegia presentazioni di strumenti, guide e spiegazioni di fenomeni virali.
Limiti
  • Il worker ha usato una singola query, "Image and Video Generation AI News", senza ripartizione per open/closed source; l'analisi riguarda quindi tutti i 50 pin insieme e rinvia la classificazione al successivo stadio di integrazione.
  • Alcuni pin sono poco pertinenti o semplici immagini stock generiche, come #35 immagine di attualità con mappa del mondo, #43 statua che suona il violoncello e #22 icone Adobe Stock. Il matching di Pinterest è permissivo e introduce rumore.
  • Pinterest non mostra la data di pubblicazione dei pin; si possono usare solo riferimenti come «2025» o «2026» nei titoli.
  • I titoli testuali dei pin sono quelli memorizzati nella cache Pinterest e potrebbero divergere da data e dettagli effettivi degli articoli collegati; qui sono stati verificati solo immagine e titolo.

Azioni consigliate

  • Rifare la ricerca X usando nomi propri — Midjourney, Sora, Runway, Kling, Flux e ComfyUI — invece dei trend del giorno.
  • Monitorare nel tempo il divario Elo tra Qwen-Image-3.0-Pro e GPT Image 2 per tracciare il divario prestazionale open/closed source.
  • Continuare a seguire l'account Bluesky che monitora la pagina prezzi per verificare la tesi del rallentamento di Sora.
  • Ampliare le query Reddit per raggiungere l'obiettivo di 20 thread.
  • Non fidarsi isolatamente delle infografiche di classifica Pinterest né dei post affiliati ripetuti su Bluesky; adottarli solo dopo verifiche incrociate su altre piattaforme.

Immagini raccolte

🎨 AI Image and Video CreationAI content and social media concernsimageAI News: Anthropic Leak Shows Us The Future of AI...Google Unveils Veo 2: Advanced AI Video Generation...Google announces ultra-high quality video...Just Nail It 🎥🎬 10 FREE AI VIDEO TOOLS IN 2026 🤯 Create Videos Without Expensive Software!imageAdobe udvikler AI-model til opskalering af videoer, gør slørede optagelser HD-kvalitet️ Image to Video AI – Animate Your Photos With AIVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIimageAI For Image And video Generation🔥 Professional AI Content Creation | AI Reels, Videos & ImagesWhy Is “Trump Obama AI Video” Trending?AI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥New York's Bold Gambit: Inside the Legislative...AI News: OpenAI Finally Released What We Asked ForimageGPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWSAi Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoTop AI Video Generators of 20255+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreThe Secret Weapon for Content Creators: AI-Powered Video GenerationTop 10 Lip Sync Tools (2026) – Best AI Lip Sync Software for Realistic Lip Sync VideoAI driven image and video analysisAI Tools for Video Editing — What Creators Actually Use to Make Content in 2026ShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI VideoimageimageProfessional AI Video Creation | Cinematic AI Videos | Custom Video EditingWhat is Imagvio AI and how it helps creators...Discover how Grok is revolutionizing video...Current Affairs Images with National and World MapsHow AI Is Transforming Video Editing‎🚨 AI is getting scary good.OpenAI’s Secret Image Generation Tool to Debut SoonTotalYmage revolutionizes interactive videos...AI Video Creation: Complete Guide to Create Professional Videos Faster with AIFuture of Media Production with AI in...I will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoTransform your ideas into stunning visuals! 🎥More than 20% of YouTube is now AI-generatedAI News: Everyone's Mad At Anthropic Now |Microsoft Unveils VASA-1, Setting New Standards for Generative AI in Video Generation'Amuse 3.0', an AI art creation tool that includes...Artificial intelligence: let’s maintain our...history generative AI"Transform Your Vision with Personalized AI-Powered 4K Videos 🎥✨"

Nota sulla qualità dei dati

Su X non è stato raccolto alcun post relativo all'AI per immagini e video a causa della scelta errata delle query. Reddit si è fermato a 12 contenuti, meno dei circa 20 previsti; YouTube non ha consentito di ottenere visualizzazioni e iscritti a causa del rendering JavaScript; Bluesky ha richiesto l'abbandono della raccolta per alcune parole chiave dopo ripetuti errori 403.

Galleria