KEN’S CAT LOG

Notizie sull’IA per la generazione di immagini e video — 2026-09-09

Sul fronte closed source, Google Nano Banana Pro e OpenAI GPT Image 2 dominano; Sora va verso la fine. Nell’open source, Qwen-Image/FLUX/Wan/HunyuanImage si avvicinano alla qualità dei modelli chiusi.

Riepilogo delle notizie sull’IA per la generazione di immagini e video — 2026-09-09

Ecco cosa ho raccolto 🔥 In breve: sul fronte closed source, Nano Banana Pro di Google (Gemini 3 Pro Image) e GPT Image 2 di OpenAI sono i due contendenti principali, mentre l’app standalone di Sora sembra ormai al tramonto. Per i video, il campo di battaglia è dominato da Kling, Seedance e Veo, tra Cina e Google 😤 Nel mondo open source, invece, Qwen-Image, Z-Image, FLUX, Wan e HunyuanImage sono arrivati a un livello da far pensare: «si può fare davvero tutto questo gratis!?»; le community di ComfyUI e dell’esecuzione locale restano vivacissime 💪 Solo X è stato un vero buco nell’acqua questa volta, e vale la pena dirlo con franchezza.

Across platforms

Osservazioni sul closed source (10) 🏢

  1. Nano Banana Pro (Gemini 3 Pro Image) è considerato un modello che «surclassa gli altri nella generazione di immagini» e monopolizza le discussioni su YouTube → https://www.youtube.com/watch?v=UV9GqinedQ8
  2. Arriva GPT Image 2 di OpenAI: oltre il 99% di accuratezza del testo in più di 12 lingue, fino a 8 immagini per richiesta in modalità Thinking e supporto 4K in sviluppo → https://www.youtube.com/watch?v=blOlUnC75O4
  3. Il 17 agosto 2026 Google ha chiuso del tutto Imagen, concentrandosi sulla linea Nano Banana: il closed source delle immagini si sta spostando verso Google.
  4. OpenAI chiude l’app Sora il 26 aprile e prevede di dismettere anche la Sora API il 24 settembre. Il brand Sora è di fatto vicino alla fine → https://lemmy.world/post/44721138
  5. L’utente Bluesky dahara1 ha già segnalato che la versione gratuita di Sora non funziona dopo l’esaurimento dei crediti → https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
  6. Grok Imagine Image 2.0 di xAI, rilasciato il 7 agosto, è secondo di poco a GPT Image 2 su Arena: ora è una sfida a tre.
  7. Seedance 2.5 di ByteDance ha aperto la propria API al pubblico il 7 agosto, diventando una scelta di punta insieme a Veo 3.1 e Kling 3.0.
  8. Su Reddit, Seedance 2.5 e Wan 3.0 open source sono stati confrontati con lo stesso prompt, dividendo molto le opinioni → https://www.reddit.com/r/generativeAI/comments/1w60fip/
  9. Midjourney sta facendo discutere per la svolta dalla generazione di immagini ai dispositivi medici a ultrasuoni; non mancano paragoni sarcastici con Theranos → Lemmy (via theregister.com).
  10. ByteDance e Hollywood (MPA) hanno raggiunto un accordo globale sulla protezione del copyright nell’IA: la gestione dei diritti entra in una fase più concreta → ricerca Pinterest.
  11. Su Reddit, una tecnica per simulare con l’IA un «vero timelapse disegnato a mano» ha scatenato polemiche da 7.088 punti; molti chiedono l’obbligo di etichettatura dell’IA → https://www.reddit.com/r/antiai/comments/1w81kdd/
  12. Solo nel feed Bluesky di luok.ai, tra dicembre 2025 e febbraio 2026, sono usciti in successione nuovi modelli Kling, Runway, PixVerse, Vidu, Seedance e Niji: la spinta cinese è evidente.

Osservazioni sull’open source (10) 🛠️

  1. Qwen-Image 2512 (Alibaba, licenza di tipo Apache) e Z-Image Turbo sono i due trend principali, con numerosi video comparativi → https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  2. Flux 2.0 viene messo alla prova contro Qwen-Image 2512 e Z-Image in 15 stress test → https://www.youtube.com/watch?v=54zvSiAWz2Y
  3. LTX-2.3 di Lightricks, con 22 miliardi di parametri, sincronizzazione audio e 4K/50fps, è ritenuto di qualità paragonabile ai modelli chiusi → https://www.youtube.com/watch?v=qQXzlk134Sw
  4. Alcuni video pratici sostengono che Wan 2.5 di Alibaba superi il closed source Veo 3 → https://www.youtube.com/watch?v=yvD8TxNsR4Q
  5. È arrivato WanGP, un agente gratuito che riunisce modelli OSS come LTX-2.3, Qwen, Flux.2 Klein e Z-Image: i workflow integrati avanzano → https://www.youtube.com/watch?v=h-k6xOEITx4
  6. HunyuanImage 3.0 di Tencent, un MoE da oltre 80B, resta un punto di riferimento tra i grandi modelli open source per immagini.
  7. FLUX 3 di Black Forest Labs supporta immagini e video di 20 secondi con audio, in rilascio limitato → https://bfl.ai/blog/flux-3
  8. Sono comparsi una versione leggera FLUX.2-klein-9b-kv-fp8 e il FLUX Creator Program; persino Martin Scorsese partecipa come consulente.
  9. Le community Lemmy dedicate a Stable Diffusion, pur con circa 5.000 persone, ricevono ogni giorno opere create con ComfyUI/SDXL/Krea2: l’uso pratico è notevole.
  10. Simon Willison ha segnalato su Bluesky di eseguire localmente Qwen 3.7 27B su un MacBook M5 e, con un GGUF da 17 GB, di ottenere la sua migliore immagine di un pellicano: sta diventando un riferimento per il benchmarking locale → https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
  11. Anche il modello video open SkyReels V1, basato su HunyuanVideo, e il workflow OSS all-in-one gratuito Open Creative Studio continuano a essere aggiornati → https://bsky.app/profile/perilli.com/post/3mdddenkss22v

Punto emerso trasversalmente dalle piattaforme: Reddit, YouTube e Lemmy ripetono lo stesso schema: closed source «comodo ma costoso e censurato» contro open source «libero ma più laborioso». C’è anche un consenso diffuso nello scetticismo verso gli strumenti che promettono «gratis e illimitato» 🙅‍♂️. Pinterest, invece, mostra poco questa contrapposizione e si concentra soprattutto su presentazioni di strumenti e miniature di notizie.

Platform by platform

Reddit: raccolti 12 thread. Un thread anti-IA da 7.088 punti è diventato più visibile di tutti i temi tecnici messi insieme: il rifiuto degli abusi dell’IA tende a emergere più chiaramente del resto. Questa raccolta non include però subreddit centrali come r/StableDiffusion, quindi presenta lacune.

X: qui il risultato è stato sinceramente nullo 😅 I termini cercati dal worker erano parole estranee al tema, come "Harvey" e "$LAPTOP"; tra 40 post raccolti, non ce n’era nessuno su IA per immagini o video. È l’unica vera lacuna tra le sei piattaforme indicate nel brief.

YouTube: ampia disponibilità di recensioni e confronti. Nel closed source è emersa una sfida a tre tra Google, OpenAI e xAI; nell’open source sono coperti Qwen-Image, FLUX, Wan, LTX-2.3, HunyuanImage e workflow integrati con WanGP. Visualizzazioni e iscritti non erano recuperabili per dipendenza da JavaScript, quindi non è stato possibile un confronto quantitativo della freschezza.

Bluesky: l’API di ricerca searchPosts restituiva 403 per tutte le query; passando ai feed degli account, la copertura dei modelli video chiusi è risultata buona, soprattutto tramite luok.ai, mentre le discussioni sui video open source sono scarse. È emerso praticamente solo SkyReels V1.

Lemmy: le principali notizie closed source sono la controversa svolta medica di Midjourney e l’ironia sulla fine di Sora. Nell’open source Black Forest Labs e FLUX dominano, con iniziative concrete distribuite con regolarità trimestrale.

Pinterest: controllate tutte le 50 immagini. Dominano miniature con volti robotici al neon e infografiche di strumenti; nessuna delle 50 immagini rappresentava la cultura open self-hosted di Stable Diffusion o ComfyUI. Anche qui le metriche di engagement sono in gran parte indisponibili.

What to watch

  • Dismissione della Sora API di OpenAI, prevista per il 24 settembre 2026 — Lemmy https://lemmy.world/post/44721138
  • Evoluzione della classifica Arena tra Grok Imagine Image 2.0 e GPT Image 2 — YouTube, video comparativi nello stile Marin Method.
  • Sfida open source tra Qwen-Image, Z-Image e FLUX: quale diventerà lo standard? — YouTube https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  • Verificare se il business degli scanner medici a ultrasuoni di Midjourney si concretizzerà davvero — Lemmy, via theregister.com.
  • Regole operative concrete dell’accordo sul copyright tra ByteDance e Hollywood — ricerca Pinterest [24].
  • Diffusione di agenti OSS integrati come WanGP — YouTube https://www.youtube.com/watch?v=h-k6xOEITx4

Recommendations

  • Per X, la raccolta aggiuntiva dovrebbe essere rieseguita usando termini direttamente pertinenti come "Midjourney", "Stable Diffusion", "Sora", "Nano Banana" e "Qwen-Image".
  • La ricerca Reddit dovrebbe includere stabilmente r/StableDiffusion, r/midjourney e r/comfyui.
  • Come alternativa all’API di ricerca Bluesky bloccata da 403, gli account principali individuati, come luok.ai e simonwillison.net, dovrebbero diventare una watchlist per osservazioni periodiche.
  • Per visualizzare meglio la polarizzazione closed/open source, sarebbe preferibile dare priorità ai commenti più argomentati di Reddit e Lemmy rispetto a Pinterest.
  • La chiusura della Sora API il 24 settembre e gli aggiornamenti sulla svolta di Midjourney dovrebbero essere priorità assolute nella prossima ricerca.

Data quality

A causa del disallineamento delle query, X non ha raccolto neppure un post relativo all’IA per immagini o video: di fatto non ci sono dati. Bluesky e Pinterest non hanno reso disponibili le API di ricerca o le metriche di engagement; YouTube non permetteva di ottenere testo dei video e visualizzazioni a causa di JavaScript, quindi l’analisi dipendeva dagli snippet di ricerca. Reddit e Lemmy hanno invece fornito materiali generalmente adeguati per quantità e qualità.

Riepilogo per piattaforma

Reddit

Reddit — Notizie sull’IA per la generazione di immagini e video

Dove

I 12 thread raccolti sono distribuiti in 8 subreddit.

Subreddit Membri Thread raccolti
r/generativeAI 151,605 4
r/antiai 319,039 1
r/RemoteWorkers 75,979 1
r/Seedance_AI 20,508 1
r/freetoolsAI 7,942 1
r/aivideomaking 6,614 2
r/AItips101 1,153 1
r/Unrouted_AI 517 1

Il subreddit generalista r/generativeAI guida con quattro thread. Per punteggio e commenti, però, domina un singolo thread di r/antiai, critico verso la generazione di immagini con IA, con un engagement superiore alla somma degli altri thread.

Cosa dicono le persone
  • Crescono le piattaforme integrate che privilegiano assenza di censura e libertà creativa: il thread 1 (r/AItips101, 81 punti, 2026-09-07, https://www.reddit.com/r/AItips101/comments/1w9yftp/) presenta "WildOwl.ai", un servizio pay-as-you-go senza abbonamento che offre accesso a oltre 35 modelli, inclusi Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo e GPT Image. u/reliablemicrophone84 apprezza il fatto di non dover scegliere tra modelli all’avanguardia e libertà creativa; u/Clear-Assistance449 propone invece l’abbonamento illimitato di Mage.space.
  • Forte scetticismo verso il «gratis e illimitato»: nei thread 2 (r/aivideomaking, 2 punti, 22 commenti, 2026-09-06, https://www.reddit.com/r/aivideomaking/comments/1w953eo/) e 5 (r/generativeAI, 1 punto, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1wa4k88/) prevale l’idea che nulla sia davvero gratuito e illimitato. u/ai_art_is_art, nel thread 5, critica duramente promesse che richiedono di versare 550 dollari per ottenerne 200 e attendere 24 ore tra le generazioni.
  • La richiesta di un video da 45 secondi provoca ironia: nel thread 4 (r/aivideomaking, 13 punti, 22 commenti, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/), chi cerca di creare gratis un video IA da 45 secondi solo con smartphone o iPad si sente rispondere che servirebbe hardware da data center; al massimo si può trovare un generatore gratuito da cinque secondi, con filigrana.
  • Grande polemica sulla falsificazione di «vero disegno a mano» con l’IA: il thread 3 (r/antiai, 7.088 punti, 1.023 commenti, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/) parla di un LLM di livello GPT-6 in grado di usare mouse e tastiera per falsificare un «vero timelapse» in un software di pittura. È il punteggio più alto dell’intera raccolta. Gli utenti esprimono delusione per la diffusione di falsi timelapse e chiedono filtri e obblighi immediati di etichettatura IA.
  • Per i deepfake di celebrità reali prevale il tema della responsabilità dell’utente: nel thread 6 (r/Seedance_AI, 0 punti, 22 commenti, 2026-09-07, https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/), si sostiene che i recenti casi giudiziari attribuiscano la responsabilità all’utente, soprattutto per distribuzione e condivisione. Altri insinuano che chi vuole aggirare i vincoli usi strumenti diversi e meno regolamentati.
  • Confronto tra modelli closed e open: il thread 10 (r/generativeAI, 110 punti, 31 commenti, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) mette a confronto Seedance 2.5, chiuso e legato a ByteDance, con Wan 3.0, open-weight e legato ad Alibaba, usando lo stesso prompt. C’è chi ritiene Seedance nettamente superiore e chi obietta che il confronto con prompt identici misura soprattutto quale modello preferisca quello stile di prompt.
  • Il nuovo modello di immagini OpenAI diventa silenziosamente un tema di discussione: il thread 7 (r/Unrouted_AI, 2 punti, 6 commenti, 2026-09-08, https://www.reddit.com/r/Unrouted_AI/comments/1waxp14/) collega al post ufficiale OpenAI "introducing-chatgpt-images-2-5". Un commentatore mostra interesse per la funzione Sketch, che permette di disegnare in ChatGPT per guidare la generazione.
  • Frustrazione per le restrizioni sui personaggi coperti da copyright: nel thread 11 (r/generativeAI, 2 punti, 2 commenti, 2026-09-08, https://www.reddit.com/r/generativeAI/comments/1waapc1/) viene criticato Grok perché non consente nemmeno fan art personali di personaggi Disney; viene suggerito PixelForge per iOS come alternativa senza restrizioni incorporate.
  • Nostalgia e correzioni sulla storia decennale della generazione di immagini: il thread 9 (r/generativeAI, 15 punti, 9 commenti, 2026-09-06, https://www.reddit.com/r/generativeAI/comments/1w8gzt6/) ripercorre l’evoluzione da StackGAN del 2016 alle immagini generate da ChatGPT nel 2026. Un utente segnala l’omissione storica di Google DeepDream, attivo intorno al 2015.
  • Nascono nuovi «lavoretti IA» intorno alla generazione di immagini: il thread 8 (r/RemoteWorkers, 169 punti, 787 commenti, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/) parla di un lavoro remoto da 30 dollari l’ora per verificare didascalie generate dall’IA. I commenti principali, però, sono quasi tutti richieste ripetute di un link per candidarsi, quindi il dibattito sostanziale è scarso.
  • Dubbi sulla sostenibilità dei generatori gratuiti: nel thread 12 (r/freetoolsAI, 40 punti, 50 commenti, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) viene presentato aifreeforever.com, gratuito, illimitato e senza registrazione. Gli utenti chiedono come possa sostenersi economicamente e criticano le severe restrizioni NSFW.
Segnali
  • In rapida crescita: aggregatori «senza censura e multi-modello» come WildOwl.ai, Venice, Mage.space e PixelForge vengono citati in più thread come alternative ai contratti con singoli modelli. Spiccano i servizi che vendono «libera scelta dei modelli + filtri permissivi».
  • Affermazione respinta: la promessa di servizi video o immagini «gratuiti e illimitati» viene accolta con scetticismo o negata quasi unanimemente in r/aivideomaking, r/generativeAI e r/freetoolsAI. Il consenso è che il costo hardware o il pagamento debbano emergere in qualche forma.
  • Opinioni in conflitto: nel confronto Seedance-Wan del thread 10 si discute sia su quale modello sia migliore sia sul metodo di confronto. Nel thread 6 emergono anche differenze tra chi invoca responsabilità dell’utente e chi pretende misure da parte del servizio.
  • Sorpresa: tra i 12 thread raccolti, il thread anti-IA da 7.088 punti e 1.023 commenti supera di gran lunga l’attenzione ricevuta dai temi tecnici. Suggerisce che, su Reddit, l’opposizione ad abusi e inganni dell’IA sia più visibile dell’entusiasmo per la tecnologia.
  • Quadro closed/open: l’opposizione più esplicita è Wan, open-weight, contro Seedance, chiuso, insieme al contrasto tra generazione locale con ComfyUI/Civitai/Hugging Face e servizi cloud a pagamento. L’open source è visto come libero ma più complesso; il closed source come pratico, ma frenato da censura e costi.
Limiti
  • Sono stati raccolti 12 thread, sotto la soglia di circa 20 richiesta da brief.md. È stata usata soltanto la query "Image and Video Generation AI News", senza ricerche aggiuntive mirate al closed o all’open source.
  • Nessuno dei subreddit centrali e molto grandi, come r/StableDiffusion, r/midjourney, r/aivideo e r/comfyui, compare nei risultati. La raccolta non può quindi rappresentare con certezza il clima di Reddit nel suo complesso.
  • Nel thread 8 di r/RemoteWorkers i commenti principali sono quasi solo ripetizioni di «Images» per richiedere un link, quindi hanno valore informativo quasi nullo.
  • L’agente non poteva consultare direttamente Reddit o le pagine dei risultati di ricerca per rifiuto di WebFetch; quanto sopra deriva solo dai materiali raccolti in anticipo in output/reddit.threads.md e .json.

X

X — Notizie sull’IA per la generazione di immagini e video

Premessa: i dati raccolti non coincidono con il tema

Dalla verifica di output/x.posts.md, le dieci query effettivamente cercate dal worker in questa fase erano
"Harvey", "#Crypto", "#sweepstakes", "#Chance", "#giveaways", "Serbia",
"$LAPTOP", "Arsenal", "Germans", "Nazis". Non hanno alcun rapporto con la generazione
IA di immagini o video; di conseguenza, nessuno dei 40 post raccolti, provenienti da 39 account,
era pertinente. Anche la «Explore list di X» associata alla posizione del server, Croazia, non contiene voci sull’IA.

# Tendenza Dove
1 Harvey Di tendenza in Croazia
2 #Crypto Business e finanza · Di tendenza
3 #sweepstakes Di tendenza in Croazia
4 #Chance Di tendenza in Croazia
5 #giveaways Di tendenza in Croazia
6 Serbia Politica · Di tendenza
7 $LAPTOP Di tendenza in Croazia
8 Arsenal Sport · Di tendenza
9 Germans Politica · Di tendenza
10 Nazis Politica · Di tendenza

In base alla regola 7, che vieta di inventare fonti, non si attribuiscono a questo tema osservazioni tratte da post irrilevanti. Seguono solo fatti desunti da quanto effettivamente raccolto.

Account

I 39 account raccolti formano gruppi senza legame reciproco: fan di reality sentimentali, trader di criptovalute, account promozionali per concorsi e giveaway, discussioni politiche balcaniche, community di memecoin, tifosi dell’Arsenal e account coinvolti in dibattiti su revisionismo storico e antisemitismo. Non è stato individuato neppure un account che discutesse di IA per immagini/video o dichiarasse esplicitamente di pubblicare contenuti creati con tali strumenti. Alcuni post riportano "has an image", ma non menzionano né confermano contenuti generati dall’IA. Gli account con maggiore engagement, @saintjupitr con 64.747 like e @Kwin8675309 con 42.021, sono entrambi casi di singoli post politici virali e irrilevanti per il tema.

Post

Nessun risultato pertinente. Tra i 40 post, zero riguardano la generazione IA di immagini e video o la dinamica closed/open source. I post su politica serba, calcio dell’Arsenal e dibattiti storici su Germania e nazismo possono avere grandi numeri di engagement, ma non vengono conteggiati come risultati.

Segnali
  • Non sono stati rilevati segnali tematici di crescita o calo, perché non esistono dati pertinenti.
  • L’unico dato utile è procedurale: Explore era geolocalizzato in Croazia e le query erano fissate su termini estranei al tema, come "Harvey" e "$LAPTOP".
Limiti
  • Le query non corrispondono al tema: in output/x.posts.md, tutte le voci "Found by searching …" riguardano parole estranee alla generazione IA di immagini/video. Seguendo la procedura della fase, non sono state avviate nuove ricerche; occorre una nuova raccolta con query corrette quali "AI image generation", "Midjourney", "Stable Diffusion", "Sora", "Veo" e "オープンソース 画像生成AI".
  • Tra i 40 post raccolti, zero offrono osservazioni sulla dinamica closed/open source dell’IA per immagini o video. Per questo non è possibile soddisfare il requisito del brief di analizzare circa 20 post pertinenti.
  • Anche Explore di X offriva soltanto tendenze generiche croate, senza argomenti IA.
  • La sessione era valida e la raccolta dei post è riuscita; il problema riguarda esclusivamente la scelta delle query.

YouTube

YouTube — Ultime tendenze dell’IA per immagini e video (closed source/open source)

Canali
Video
  1. «Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN»
    Canale: Theo - t3.gg|Pubblicato: circa 26 novembre 2025|https://www.youtube.com/watch?v=UV9GqinedQ8
    → Video che sostiene la netta superiorità di Nano Banana Pro (Gemini 3 Pro Image) nella generazione di immagini, emblematico della frontiera closed source.

  2. «Nano Banana PRO (Gemini-3.0-Pro-Image): I GOT EARLY ACCESS...»
    Canale: AICodeKing|https://www.youtube.com/watch?v=13AovEj4oDM
    → Recensione in accesso anticipato di Gemini 3 Pro Image, definito impressionante attraverso molti esempi pratici.

  3. «GPT Image 2 Is Here — Everything You NEED to Know»
    Canale: ElevenLabs|Pubblicato: 23 aprile 2026|https://www.youtube.com/watch?v=blOlUnC75O4
    → Presentazione di GPT Image 2 di OpenAI: accuratezza testuale oltre il 99% in più di 12 lingue, fino a 8 immagini per prompt nella modalità Thinking e 4K in beta/API.

  4. 【ナノバナナ超え】OpenAIの新しい画像生成AIモデル「GPT Image 2」とは?
    Canale: AI大学【AI&ChatGPT最新情報】 (giapponese)|https://www.youtube.com/watch?v=ZrO7tv-uv1E
    → Spiegazione in giapponese di GPT Image 2 rispetto a Nano Banana, con prestazioni, utilizzo e casi d’uso.

  5. «Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison»
    Canale: Marin Method|Pubblicato: 10 marzo 2026|https://www.youtube.com/watch?v=x5fMQvhKP60
    → Confronto diretto tra quattro modelli video closed source. Kling 3.0 emerge per completezza, mentre Grok Imagine è forte nella conversione immagine-video.

  6. «Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 - Comparison»
    Canale: Youri van Hofwegen|https://www.youtube.com/watch?v=vw_Jk2-phsA
    → Video comparativo che sostiene la superiorità di Seedance 2.0 di ByteDance sui principali modelli chiusi esistenti.

  7. «New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)»
    Canale: AIOnTrend|Pubblicato: inizio gennaio 2026|https://www.youtube.com/watch?v=uAGH_yRZ2Gw
    → Confronto tra Qwen-Image 2512 open source di Alibaba e Z-Image Turbo, sottolineando i vantaggi della gratuità e della licenza di tipo Apache.

  8. «Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests)»
    https://www.youtube.com/watch?v=54zvSiAWz2Y
    → Confronto in 15 stress test tra Flux di Black Forest Labs, Qwen-Image 2512 e Z-Image, che suggerisce un cambiamento negli equilibri dell’open source visivo.

  9. «LTX-2.3 Review: The Open-Source AI Video Model Built for Creators»
    Canale: BMF MEDIA|Pubblicato: circa un mese prima della ricerca, agosto 2026|https://www.youtube.com/watch?v=qQXzlk134Sw
    → Recensione di LTX-2.3 di Lightricks: 22 miliardi di parametri, sincronizzazione audio, 4K/50fps e codice aperto. È un contenuto molto recente.

  10. «WAN 2.5 CRUSHES VEO 3 (Higgsfield AI Workflow)»
    Canale: Jack Vs. AI|https://www.youtube.com/watch?v=yvD8TxNsR4Q
    → Workflow pratico che sostiene che Wan 2.5 open source di Alibaba Tongyi superi Google Veo 3, modello chiuso.

  11. «This AI Agent Can Make Movies WanGP Deepy - Open source free Agent for LTX 2.3 Qwen Klein Z-Image»
    Canale: AI Late to Class|https://www.youtube.com/watch?v=h-k6xOEITx4
    → Presenta WanGP, un agente gratuito che integra LTX-2.3, Qwen, Flux.2 Klein e Z-Image per automatizzare la produzione video, segnale della crescente integrazione dell’ecosistema open source.

  12. «HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4)»
    https://www.youtube.com/watch?v=32lhiZKhgOY
    → Presentazione di HunyuanImage 3.0 di Tencent: oltre 80 miliardi di parametri, architettura MoE e 13 miliardi di parametri attivi. Sostiene la parità o il superamento di Nano Banana; è del settembre 2025, quindi viene citato come riferimento continuativo, non come novità recente.

Segnali

Movimenti sul lato closed source

  • Google ha chiuso completamente la linea Imagen il 17 agosto 2026, concentrandosi su Nano Banana, incluso Gemini 3 Pro Image. La generazione di immagini closed source si concentra sempre più sulla famiglia Gemini.
  • OpenAI ha chiuso l’app Sora il 26 aprile 2026 e prevede di chiudere anche la Sora API il 24 settembre 2026. Il brand Sora come prodotto video indipendente è in sostanza al termine, mentre le risorse sembrano migrare verso GPT Image 2 e l’integrazione in ChatGPT.
  • GPT Image 2 di OpenAI, uscito nell’aprile 2026, è tra i migliori sia nella generazione sia nell’editing testuale su Arena. Grok Imagine Image 2.0 di xAI, rilasciato il 7 agosto, lo segue di poco: immagini closed source come confronto a tre tra OpenAI, Google e xAI.
  • Seedance 2.5 di ByteDance ha aperto la API al pubblico il 7 agosto 2026 e si afferma rapidamente accanto a Google Veo 3.1 e Kling 3.0.
  • Nei confronti di modelli video chiusi, si sta stabilizzando una divisione: Kling 3.0 per completezza, Veo 3.1 per estetica e Runway Gen-4.5 per libertà creativa.

Movimenti sul lato open source

  • Qwen-Image 2512 e Z-Image Turbo, eseguibile in otto step con 16 GB di VRAM, sono i due maggiori trend per le immagini. Il numero di video comparativi ne conferma l’attenzione.
  • Flux.2 Klein di Black Forest Labs, da 4B, eseguibile con circa 13 GB di VRAM su una RTX 3090 e con licenza Apache 2.0, ricorre spesso come opzione open source leggera.
  • HunyuanImage 3.0 di Tencent, oltre 80B e MoE, resta un riferimento per i grandi modelli open source di immagini.
  • Nei video, Wan 2.2/2.5 di Alibaba Tongyi e LTX-2.3 di Lightricks, con audio sincronizzato, 4K/50fps e 22B di parametri, vengono giudicati da più canali vicini alla qualità closed source.
  • Crescono i video su agenti e workflow che uniscono più modelli open source, come ComfyUI e WanGP: l’interesse si sposta dal confronto del singolo modello alla pipeline integrata.
  • Il tono comune delle recensioni è che il divario qualitativo tra open e closed source si stia riducendo e che molti team creativi valutino prima l’open source.
Limiti
  • Le pagine di ricerca e dei video YouTube sono renderizzate via JavaScript, quindi WebFetch non ha potuto ottenere direttamente visualizzazioni, date precise o iscritti. I nomi dei canali sono stati recuperati tramite l’API oEmbed, ma non le metriche.
  • Visualizzazioni e iscritti sono quindi indicati come sconosciuti; sono state usate solo date e contesto degli snippet di WebSearch. Non è stato possibile confrontare quantitativamente la freschezza dei contenuti.
  • Il contenuto dei video e dei commenti principali non era direttamente leggibile: le conclusioni derivano indirettamente da titoli, snippet e sintesi di articoli correlati, non da citazioni testuali dei video.
  • Il video su HunyuanImage 3.0 è fuori dalla finestra raccomandata degli ultimi 60 giorni, ma viene mantenuto come riferimento stabile per i grandi modelli open source.
  • È emerso un solo canale giapponese, AI大学; non è stato possibile verificare quanto sia ampia la discussione su YouTube in lingua giapponese rispetto a quella anglofona.

Bluesky

Bluesky — Ultime tendenze dell’IA per immagini e video

Account
  • Simon Willison @simonwillison.net — Sviluppatore IA noto; confronta spesso nuovi modelli con la sua immagine benchmark di un pellicano in bicicletta. Molti post raccolgono tra oltre 100 e oltre 500 like.
  • Ethan Mollick @emollick.bsky.social — Professore alla Wharton School dell’Università della Pennsylvania; pubblica esperimenti in cui modelli come GPT-6 Astra e Fable 5.1 producono scene 3D in Blender.
  • Alessandro Perilli @perilli.com — Sviluppatore di "Open Creative Studio", prima AP Workflow, un workflow open source all-in-one per ComfyUI, per generare testo, immagini, video e audio.
  • luokai @luok.ai — Account che presenta rapidamente aggiornamenti sui modelli video closed source, inclusi Kling, Runway, Vidu, PixVerse, Seedance e Niji.
  • dahara1 @dahara1.bsky.social — Ingegnere giapponese che pubblica impressioni su LLM e IA generativa, anche tramite strumenti di traduzione propri. Raccoglie notizie come la fine di Sora e confronti con Nano Banana. Ha una piccola base di 113 follower.
  • Midjourney Experience Newsletter @midjourneynews.bsky.social — Account non ufficiale di fan/newsletter, con esperimenti di prompt e frammenti di notizie del settore, con basso engagement.
  • Stable Diffusion online AI @stablediffusion.bsky.social — Feed per condividere opere SD/Midjourney. Gli ultimi post risalgono a gennaio-febbraio 2025 e non è una fonte utile di notizie attuali.
  • Dalla ricerca di account ufficiali, non sono stati confermati account Bluesky ufficiali di Black Forest Labs, Runway, Stability AI e Civitai. midjourney.bsky.social, apparentemente ufficiale, è un account vuoto senza post.
Post
  1. «Fine di Sora» — dahara1, 2026-04-28, 0 like/0 RP
    https://bsky.app/profile/dahara1.bsky.social/post/3mkjnla6hnk2m
    Commenta la chiusura del servizio video Sora di OpenAI, osservando che l’azienda forse non vi era molto legata. Le ricerche web confermano notizie sulla cessazione dell’app e dell’API per sviluppatori intorno al marzo 2026.

  2. La versione gratuita di Sora esaurisce i crediti e non genera più video — dahara1, 2026-04-04
    https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
    Segnala di non riuscire a creare video pur avendo ancora un credito, coerentemente con le notizie della successiva chiusura.

  3. Confronto tra filigrane di Nano Banana gratuito e ChatGPT Images 2.0 — dahara1, 2026-05-04, 1 like
    https://bsky.app/profile/dahara1.bsky.social/post/3mkztj6phrk2l
    Osserva che ChatGPT Images 2.0, come Nano Banana gratuito, non mostra filigrane vistose ed è quindi più pratico da usare.

  4. Seedance 2 supera gli altri modelli — luokai, 2026-02-10, 5 like
    https://bsky.app/profile/luok.ai/post/3mehseuzlls2r
    Allegando un video originale creato in un giorno, elogia fortemente le prestazioni di Seedance 2.

  5. Rilascio di Niji 7 — luokai, 2026-01-10, 3 like
    https://bsky.app/profile/luok.ai/post/3mc2422hgck2m
    Annuncia il modello di immagini anime Niji 7, con occhi più nitidi, maggiore coerenza e migliore aderenza al prompt.

  6. Runway Gen-4.5 — luokai, 2025-12-02, 4 like/1 RP
    https://bsky.app/profile/luok.ai/post/3m6xsakpud226
    Presentato come un innalzamento degli standard in movimento, fedeltà e controllo del prompt, con enfasi sul world modeling.

  7. Kling IMAGE O1 — luokai, 2025-12-03, 3 like
    https://bsky.app/profile/luok.ai/post/3m72caiexw225
    Rinnovo full-stack della generazione di immagini Kling, proposto come sistema capace di accettare, comprendere e generare qualsiasi input.

  8. Kling VIDEO 2.6 — luokai, 2025-12-05, 2 like
    https://bsky.app/profile/luok.ai/post/3m7aio7hntk2f
    Promuove una generazione video «story-first» con audio sincronizzato, lip-sync e coerenza della scena.

  9. PixVerse V5.5 — luokai, 2025-12-02, 4 like/2 RP
    https://bsky.app/profile/luok.ai/post/3m6xrxnh47c27
    Punta sulla semplificazione della produzione con generazione multishot in un tocco e aggiunta automatica di effetti sonori.

  10. Modello di immagini Vidu AI Q2 — luokai, 2025-12-02, 5 like/2 RP
    https://bsky.app/profile/luok.ai/post/3m6xrt43ll227
    Promuove «4K in 5 secondi» e una campagna di generazione illimitata fino al 31 dicembre.

  11. SkyReels V1, modello fondamentale open source per video — luokai, 2025-02-18, 3 like/1 RP
    https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27
    Presentato come il primo modello video open source centrato sull’essere umano, con HunyuanVideo raffinato su oltre 10 milioni di video per riprodurre 33 espressioni e più di 400 movimenti naturali. È vecchio di oltre un anno, ma è l’unico post chiaramente relativo a un modello video open source trovato in questo account.

  12. Open Creative Studio v13.0, workflow open source integrato per ComfyUI — Alessandro Perilli, 2026-01-26, 0 like
    https://bsky.app/profile/perilli.com/post/3mdddenkss22v
    Annuncia un workflow ComfyUI all-in-one gratuito e illimitato per testo, immagini, video, audio, musica, effetti sonori e testi di canzoni.

  13. Generazione locale di immagini con Qwen 3.7 27B, il pellicano — Simon Willison, 2026-08-14, 183 like/14 RP
    https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
    Riferisce che Qwen 3.7 27B, eseguito tramite LM Studio su un MacBook Pro M5 Max con GGUF da 17 GB, ha creato il miglior «pellicano in bicicletta» mai ottenuto su un modello locale.

  14. Griglia di confronto tra pellicani GPT-6 Astra e GPT-5.6 — Simon Willison, 2026-09-04, 202 like/9 RP
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
    Pubblica una griglia di 12 immagini che mette a confronto GPT-6 Astra e le varianti Sol/Terra/Luna di GPT-5.6: la generazione visiva dei modelli chiusi viene trattata come benchmark continuativo.

  15. Generazione 3D Blender di GPT-6 Astra, modello architettonico — Ethan Mollick, 2026-09-05, 163 like/17 RP
    https://bsky.app/profile/emollick.bsky.social/post/3murua22igs2i
    Segnala che, a partire da schizzo e descrizione, GPT-6 Astra ha modellato in Blender il cenotafio di Boullée, edificio del XVIII secolo mai costruito, producendo anche un walkthrough con narrazione. In altri post descrive la generazione visiva come una fonte di forte presenza per i LLM closed source.

  16. «Midjourney è diventata parte di Meta.ai» — Midjourney Experience Newsletter, 2026-02-03, 1 like
    https://bsky.app/profile/midjourneynews.bsky.social/post/3mdxymie7pi25
    ⚠️ Attenzione: è un post di un account non ufficiale e probabilmente eccessivamente semplificato. La verifica web indica che nell’agosto 2025 Meta ha annunciato una partnership per licenziare la «aesthetic tech» di Midjourney; non si tratta di un’acquisizione e Midjourney resta indipendente (riferimento: TechCrunch, implicator.ai).

Segnali
  • I video closed source sono in una fase di competizione aperta: solo nel feed di luok.ai, tra dicembre 2025 e febbraio 2026, sono comparsi almeno sette nuovi modelli o versioni: Runway Gen-4.5, Kling IMAGE O1/VIDEO 2.6/O1, PixVerse V5.5, Vidu AI Q2, Seedance 2 e Niji 7. La spinta dei modelli cinesi, inclusi Kling, Vidu, PixVerse e Seedance, è evidente.
  • Sora perde slancio e va verso la fine: i post di dahara1 mostrano che nell’aprile 2026 i crediti della versione gratuita non funzionavano più e che a fine mese veniva già dichiarata la chiusura. Il quadro è coerente con le notizie sulla cessazione dell’app e dell’API; la leadership video sembra spostarsi verso modelli cinesi e funzionalità integrate nei modelli generici di Google e OpenAI.
  • La generazione di immagini diventa una funzione del LLM e un benchmark: Simon Willison ed Ethan Mollick confrontano la capacità visiva e 3D di LLM generici, come GPT-6 Astra, Claude Fable 5.1 e Qwen 3.7/3.8 27B, più che strumenti di immagine isolati. Esempi come la ricostruzione architettonica in Blender diventano indicatori della potenza del modello.
  • Su Bluesky si parla poco di video open source: nell’esplorazione di feed e ricerche, l’unico post inequivocabile su un modello video open source è SkyReels V1 del febbraio 2025. Non sono emersi riferimenti a Wan2.2, Qwen-Image o Z-Image; per ComfyUI c’è soprattutto l’annuncio periodico di Open Creative Studio.
  • Il rapporto Midjourney-Meta è facilmente frainteso: un account non ufficiale lo descrive come incorporazione in Meta.ai, mentre i fatti indicano una licenza tecnologica, non un’acquisizione. È un buon esempio della cautela richiesta dalle fonti social.
Limiti
  • L’API di ricerca ufficiale Bluesky (app.bsky.feed.searchPosts) ha restituito 403 Forbidden per ogni query. Altri endpoint pubblici, come app.bsky.actor.getProfile, app.bsky.feed.getAuthorFeed e app.bsky.feed.getPostThread, funzionavano: la restrizione sembra limitata alla ricerca.
  • Anche la ricerca web su https://bsky.app/search?q=... è renderizzata lato client e non ha fornito il contenuto dei post tramite fetch.
  • In alternativa alla ricerca per keyword, sono stati trovati account tramite ricerca web e letti i loro feed. Il metodo dipende dagli account intercettati e può avere creato distorsioni, in particolare nella scarsa copertura del video open source.
  • Le ricerche web su Bluesky per Wan2.2, Qwen-Image, Z-Image e HunyuanVideo hanno restituito soprattutto paper arXiv o account non pertinenti, senza post rilevanti.
  • Non è stato possibile confermare gli account Bluesky ufficiali di Black Forest Labs, Runway, Stability AI e Civitai.
  • Il feed stablediffusion.bsky.social si ferma a gennaio-febbraio 2025 e non può essere usato per le tendenze attuali.
  • Rispetto al criterio di circa 20 post analizzati per social, sono stati esaminati oltre 100 post dai feed di sei account, selezionando 16 post pertinenti.

Lemmy

Lemmy — Ultime tendenze dell’IA per immagini e video

Lemmy è un Fediverse distribuito: la ricerca è stata effettuata soprattutto con l’API di lemmy.world (/api/v3/search) e lemmy.today, che rispecchia community di lemmy.dbzer0.com, oltre a ricerche web site:lemmy.world. Sono stati verificati circa 25 post.

Community
  • !«メールアドレス» — Circa 5.050 iscritti. Community centrale per la generazione open source legata a Stable Diffusion.
  • !«メールアドレス» (lemmy.today, "Stable Diffusion Art") — 2.362 iscritti. Pubblica ogni giorno più opere prodotte con SDXL/ComfyUI/Krea2, spesso con link a civitai.com.
  • Stable Diffusion Anime, Stable Diffusion Abstraction, Stable Diffusion Witches, Stable Diffusion Furry, Stable Werewolves — Community tematiche della rete lemmy.dbzer0.com; gli iscritti non sono pubblici, ma continuano a ricevere post quotidiani anche nel settembre 2026.
  • c/«メールアドレス» — Community tecnologica generalista dove convergono grandi notizie closed source, come la controversia sullo scanner medico di Midjourney e Sora.
  • c/genart — 47 iscritti; piccola community che dichiara il proprio sostegno a modelli generativi open source e con licenze aperte.
  • c/«メールアドレス» — Community sulle reazioni anti-IA. Non è dedicata specificamente a immagini/video, ma un post sul desiderio di uscire dalla dipendenza dagli strumenti IA ha raggiunto 83 punti.
  • c/euroai — Community di nicchia che pubblica elenchi di IA e LLM open source europei.
Post
Tendenza closed source
  1. «Midjourney pivots from AI image generation to body scanning medical spa» (2026-06-18, punteggio 58, technology) https://lemmy.world/post/... via theregister.com — Notizia dell’ingresso di Midjourney nella diagnostica a ultrasuoni/CT invece della generazione di immagini. The Register osserva che la tecnologia sottostante è reale, ma che non sono stati indicati partner.
  2. «Midjourney AI pivots to Theranos: Ultrasonic CT» (2026-06-19, punteggio 40, techtakes) via pivot-to-ai.com — Post sarcastico che paragona l’iniziativa a Theranos.
  3. «I was wrong about the Midjourney ultrasound scanner» (2026-06-21, hackernews) https://twitter.com/MattZirwas/status/2068365802491834541 — Un autore inizialmente scettico verifica i fatti e ritratta.
  4. «Midjourney wants Hollywood studios to reveal details of their AI usage» (2026-07-05, punteggio 73, technology) via techcrunch.com — Nella causa contro tre studi, Midjourney chiede che Hollywood riveli le proprie pratiche d’uso dell’IA.
  5. Reazione alla fine di Sora da parte di OpenAI: «OpenAI: decides to shut down their AI slop video generating model Sora» https://lemmy.world/post/44721138 — Ironizza sulla chiusura dell’app standalone, annunciata il 24 marzo 2026, fermata il 26 aprile e con Sora 2 API prevista in dismissione il 24 settembre 2026.
  6. «OpenAI collapses media reality with Sora AI video generator» https://lemmy.world/post/12056737 — Condivisione di un articolo che teme un calo della fiducia nei video anonimi.
  7. «OpenAI's new Sora video generator to require copyright holders to opt out, WSJ reports» https://lemmy.world/post/36665644 — Critiche alla scelta di imporre agli aventi diritto un meccanismo di opt-out.
  8. «Elon Musk maakt complete AI-film met zijn versie van The Odyssey» (2026-07-22, films) via ad.nl — Musk annuncia la produzione di un lungometraggio IA dell’"Odissea" con Grok Imagine.
  9. Post di analisi dei ricavi di ChatGPT (2026-07-15, ai_reddit) — Analizza che gran parte dei ricavi di Grok/xAI provenga da contenuti immagini/video NSFW a pagamento.
  10. «Video AI» — Post che chiede informazioni sulle quote gratuite di Adobe Firefly per generazione video; vengono confrontati Hailuo, Kling, Runway, Pixverse e Hunyuan.
Tendenza open source
  1. «Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio» (2026-07-24, punteggio 1, tech) https://bfl.ai/blog/flux-3 — Rilascio limitato di FLUX 3, modello multimodale per immagini e video di 20 secondi con audio.
  2. «FLUX.2-klein-9b-kv-fp8 optimized variant» (2026-03-14, punteggio 8, stable_diffusion) via huggingface.co — Variante leggera di FLUX.2 con cache KV.
  3. «Black Forest Labs Opening up the first FLUX Creator Program» (2026-05-06, punteggio 3, stable_diffusion) — Annuncio del programma per creatori.
  4. «Regisseur Martin Scorsese wordt adviseur bij AI-bedrijf» (2026-06-03, films) via nu.nl — Martin Scorsese diventa consulente di Black Forest Labs.
  5. «FLUX Chroma (The Perchance T2i model)» (circa un anno prima, community Perchance) via huggingface.co(lodestones/Chroma) — Modello derivato che usa NAG, Normalized Attentive Guidance, con commenti positivi sulla resa del lip-sync.
  6. Esempi di post quotidiani delle community Stable Diffusion, tra 2026-09-06 e 09, realizzati localmente con SDXL/ComfyUI/Krea2: «Erika - Mahouka Koukou No Rettousei» (punteggio 16), «Colors in Quiet Water» (14), «Giant Wire Walker» (11), «Karin - Umi Monogatari» (13), tutti con link a civitai.com.
  7. «Opendream = NEW! Stable Diffusion Automatic1111/ComfyUI alternative that uses nondestructive layering like Gimp» https://lemmy.world/post/3243205 — Presentazione di un’interfaccia OSS con livelli non distruttivi in stile GIMP.
  8. «Europäische KI- & LLM-Anbieter» (2026-02-15, euroai) — Elenco di IA europee open source, orientate a sovranità tecnologica e protezione dei dati, comprese opzioni per immagini.
  9. «Your Lemmy Crash Course to Free Open-Source AI» https://lemmy.world/post/76020 — Guida introduttiva a text-generation-webui, Automatic1111 e strumenti locali come ComfyUI+Pinokio.
Segnali
  • La maggiore notizia closed source è la controversia sulla svolta medica di Midjourney: nei punteggi 40-73, tre community discutono il passaggio dalla generazione di immagini a scanner ultrasonici. Abbondano le reazioni sarcastiche che richiamano Theranos, ma alcuni scettici iniziali hanno poi corretto la propria posizione.
  • OpenAI Sora viene ripetutamente preso di mira come emblema di «AI slop». Dopo la chiusura dell’app, la prevista dismissione della Sora 2 API il 24 settembre 2026 continua ad alimentare discussioni.
  • Nel lato open source Black Forest Labs e FLUX dominano: FLUX 3, la variante leggera FLUX.2-klein, il Creator Program e il ruolo di Scorsese come consulente rappresentano movimenti concreti e regolari.
  • Le community creative quotidiane Stable Diffusion Art/Anime/Abstraction, pur piccole — circa 2.000-5.000 persone — continuano a pubblicare ogni giorno contenuti locali con SDXL, ComfyUI e Krea2 anche nel settembre 2026. Ciò dimostra la profondità dell’uso operativo open source.
  • Il sentimento anti-IA è un segnale da non ignorare: un post di c/fuck_ai sul desiderio di disintossicarsi dalla dipendenza da IA ha ottenuto 83 punti, più di molti normali post IA, mostrando una certa avversione diffusa verso i contenuti generati.
  • Le notizie closed source su Lemmy sono soprattutto rilanci e reazioni ad articoli di TechCrunch, The Register e WSJ: le fonti primarie restano esterne a Lemmy.
Limiti
  • Lemmy ha una base di utenti e un volume di post ridotti rispetto a Reddit; le discussioni dedicate a immagini/video IA sono limitate. Non sono state trovate community specializzate che approfondiscano davvero Sora, Veo, Kling o Runway.
  • La ricerca full-text dell’API di lemmy.world è poco precisa: query generiche come "AI image generation" restituiscono molti post irrilevanti. Query mirate a Sora, Midjourney e FLUX sono state più utili.
  • Alcune pagine, tra cui lemmy.world/post/44721138 e un post relativo a DLSS 5, hanno dato HTTP 500 o non hanno permesso di recuperare il contenuto. Valutazioni basate solo su titolo e snippet di ricerca.
  • Le ricerche interne per Grok Imagine, Qwen Image, HunyuanVideo, Wan2.2, Nano Banana/Gemini e Veo hanno trovato pochissime menzioni dirette. Su Lemmy questi modelli sembrano poco discussi.
  • Le ricerche su lemmy.ml e lemmy.ee hanno prodotto perlopiù duplicati federati dei risultati di lemmy.world, senza nuove informazioni indipendenti.

Pinterest

Pinterest — Notizie sull’IA per la generazione di immagini e video

Tutti i 50 pin raccolti sono stati aperti e verificati visivamente. Non c’era una classificazione per generi: erano tutti risultati della singola query "Image and Video Generation AI News".

Temi visivi (visual themes)
  • Proliferazione del template «volto robotico + notizia dell’ultima ora»: ricorrono miniature con mezzi primi piani di robot umanoidi bianchi e scritte al neon rosse/blu come "AI NEWS" e "BREAKING NEWS". Si vedono robot al banco di un notiziario [22], compositi con volti di YouTuber sorpresi [29] e robot femminili con "THE FUTURE IS AI" [39]. Dominano blu navy scuro e neon ciano, magenta o arancione.
  • Miniature con reazioni di YouTuber: fotografie di uomini bianchi con espressioni sorprese o sospettose, accompagnate da icone circolari al neon di OpenAI, Google, Meta, Anthropic, Grok e Notion, ricorrono in più pin [4, 18]. Sembrano ripubblicazioni da video YouTube.
  • Infografiche listicle «i migliori N strumenti»: il formato più frequente è un’infografica verticale su fondo viola-nero con carte numerate. Runway, Pika, Kling AI, Luma AI/Dream Machine, Canva AI e Hailuo AI sono ripetuti quasi sempre [9, 10, 27, 36, 50].
  • Quiz Before/After e confronti: immagini come due foto di montagne affiancate con "Which is AI?" [13], oppure griglie che trasformano video sorgente in blocchi di legno, origami, LEGO o fiori [11], sottolineano quanto sia difficile riconoscere l’IA e quanto possa cambiare le texture.
  • Robot e umani in collaborazione o in medicina: alcuni contenuti mostrano robot umanoidi e operatori sanitari che usano ologrammi [3, 33], oppure medici e robot illustrati [32], con un tono più sobrio sulla coesistenza umana e IA.
  • Estetica tech scura e neon: fondali dal blu profondo al nero, linee luminose ciano/magenta/viola e particelle sono presenti in circa il 70% delle immagini: è chiaramente lo stile standard delle notizie tech su Pinterest.
  • Pubblicità di creazione video IA con avatar e icone personali: più pin promuovono servizi tipo Fiverr per video esplicativi IA usando volti celebri come Jeff Bezos [38], oppure la demo fotorealistica AMD di Amuse 3.0 con il volto di un anziano pescatore [46].
  • Immagini sul fatto che il contenuto IA si scopra o non si scopra: scene con robot, uno smartphone, timbri "FAKE" e foto di gatti, oppure sagome mascherate [3], oltre a strumenti di rilevamento IA [37], visualizzano le preoccupazioni per autenticità e disinformazione.
Pin degni di nota (notable pins)
  • [11] Demo di trasformazione materica in stile Luma AI: confronta in una griglia cinque varianti dello stesso video sorgente — persona, peluche di panda e auto — trasformate in blocchi di legno, origami, LEGO e fiori. È il pin che mostra più concretamente la capacità di trasformazione delle texture nei video IA.
  • [24] Accordo sul copyright tra ByteDance e Hollywood: titolo "ByteDance and Hollywood reach global deal on AI copyright". Screenshot di un articolo secondo cui ByteDance e Motion Picture Association hanno raggiunto un accordo globale per rafforzare la protezione della proprietà intellettuale negli strumenti di immagini/video IA. È vicino a una fonte primaria sul comportamento delle grandi aziende closed source rispetto al copyright.
  • [35] Riepilogo di notizie IA del 12 agosto 2026: tre notizie — "Grok 4.6 drops", capace di eseguire decine di passi autonomi e autoverificarsi; "Gemini hits 1 billion users", con Google che raggiunge 100 milioni di utenti alla velocità più alta della propria storia, due persone su tre che usano input vocale e 150 milioni di immagini generate al giorno; "Honor's robot phone", con braccio in titanio posteriore che segue automaticamente il soggetto. È uno dei rari pin con data e numeri espliciti.
  • [36] Classifica "Best AI Video Generators of 2026": Google Veo 3.1, Runway Gen 4.5 e Kling 3.0 figurano nei primi tre posti con corone; seguono Adobe Firefly, Seedance 1.5 Pro, Pika 2.5 e HeyGen. L’elenco riporta versioni recenti dei modelli.
  • [42] Vidu S1 di ShengShu Technology: visuale prodotto di un modello video cinese per interazione IA in tempo reale, descritto come "The World's Most Advanced Model for Real-Time AI Interaction". È uno dei pochi esempi che non guardano soltanto ai modelli occidentali.
  • [45] Articolo teaser sul nuovo strumento di immagini OpenAI: immagine con titolo "OpenAI's Secret Image Generation Tool to Debut Soon", che alimenta attesa per uno strumento non ancora annunciato.
  • [25] Riepilogo Google I/O 2026: Gemini 3.5 Flash, Gemini Omni e Gemini Spark, il passaggio alla ricerca IA e la competizione tra Apple e Google negli occhiali XR, datato 20 maggio 2026. Mostra l’ecosistema circostante più che la sola generazione di immagini.
  • [9] Infografica comparativa di strumenti video "Just Nail It": organizza Runway, Pika, Kling AI, Luma AI, Canva AI e Hailuo AI per funzionalità e pubblico; include anche la statistica secondo cui entro il 2026 l’80% dei contenuti online includerà video.
  • [8] Set di icone per creazione di contenuti IA da stock photography: immagine Adobe Stock su testo, immagini, musica e video; non è una notizia, ma riflette la domanda di materiali visivi sul tema.
  • [43] Infografica della storia dell’IA generativa: cronologia viola dagli anni Cinquanta con ELIZA agli anni 2020 con GPT, che colloca il boom attuale in un contesto storico e didattico.
Segnali (signals)
  • Dalle immagini non emerge con chiarezza la contrapposizione open/closed source: i pin sono soprattutto presentazioni di strumenti, miniature di notizie e guide. Non appare una struttura esplicita come Seedance contro Wan. Vidu S1 cinese [42] e Amuse 3.0 legato ad AMD [46], più vicino alla generazione locale, sono le poche alternative visibili ai grandi servizi chiusi statunitensi, come Veo, Sora e Runway.
  • Dominano raccolte, confronti e how-to; le notizie rapide sono minoritarie: tra 50 pin, solo [24], [25], [35] e [45] riportano date o annunci concreti. La maggioranza consiste in listicle evergreen e contenuti che invitano al salvataggio o sembrano affiliati, tipici di Pinterest.
  • È visibile interesse per il rischio e la verifica dell’autenticità: i pin [3], [22] e [37], con timbri "FAKE", robot giornalisti e strumenti di rilevamento, indicano una certa attenzione del pubblico Pinterest a contenuti generati, falsi e riconoscibili.
  • Il ricambio generazionale dei modelli è rapido: [36] mostra Veo 3.1, Runway Gen 4.5, Kling 3.0 e Seedance 1.5 Pro; insieme a Grok 4.6 e Gemini da un miliardo di utenti in [35], suggerisce aggiornamenti ormai normali su base trimestrale.
  • Assenza: nessuna delle 50 immagini rappresenta Stable Diffusion, ComfyUI o Hugging Face, simboli della cultura local/self-hosted open-weight frequente su Reddit. I risultati Pinterest sono fortemente orientati alla promozione di SaaS e strumenti commerciali, con quasi nessuna visibilità per la community autenticamente open source.
Limiti
  • La raccolta è stata eseguita in anticipo da un worker tramite browser headless; l’agente non ha navigato direttamente Pinterest, come previsto dal playbook.
  • Non è stata applicata una classificazione per generi: i 50 elementi sono risultati di un’unica query. Non è possibile confrontare tendenze per categoria.
  • Cinque pin hanno titolo "(untitled)" — [5, 13, 15, 20, 24]; per [24] il contenuto è stato dedotto dal titolo nell’immagine.
  • Pur essendo riportati URL pinterest.com/pin/..., i collegamenti non sono stati aperti per verifica; l’analisi dipende da immagine e titolo. Date e metriche di engagement non sono disponibili, salvo quando già impresse nelle immagini, come [25] e [35].
  • Rispetto al requisito di almeno dieci osservazioni per closed e open source, Pinterest da solo offre pochi elementi chiaramente attribuibili all’open source, essenzialmente [42] e [46]. La lacuna deve essere compensata integrando i risultati di altre piattaforme, come Reddit.

Azioni consigliate

  • Rieseguire la raccolta X con query direttamente pertinenti, quali Midjourney, Stable Diffusion, Sora, Nano Banana e Qwen-Image.
  • Includere nella prossima raccolta Reddit i subreddit centrali r/StableDiffusion, r/midjourney e r/comfyui.
  • Poiché la ricerca Bluesky non funziona, creare una watchlist di account rilevanti individuati, per monitorarli nel tempo.
  • Dare la massima priorità ai seguiti sulla fine della Sora API, prevista per il 24 settembre 2026, e sulla svolta di business di Midjourney.

Immagini raccolte

Image to Video AI: Come funziona e perché conta - The Data Scientist🎨 Creazione di immagini e video con IAPreoccupazioni su contenuti IA e social mediaNotizie IA: una fuga di Anthropic ci mostra il futuro dell’IA...immagineLa piattaforma definitiva per la generazione di immagini e video IA - The Data ScientistGoogle presenta Veo 2: generazione video IA avanzata...Concetto di creazione di contenuti IA con icone per testo, immagini, musica e video — Sfoglia 57 foto, vettori e video stockJust Nail It 🎥🎬 10 strumenti video IA GRATUITI nel 2026 🤯 Crea video senza software costosi!Google annuncia video di qualità ultraelevata...IA per la generazione di immagini e videoimmagineCreazione di contenuti video IA: chi guadagna molto,...immagineVideo generati dall’IA: bene o male? Ecco la verità! 🤖🎥Veo 3 da immagine a video: generazione rapida e audio nativo tramite Gemini APINotizie IA: OpenAI ha finalmente rilasciato ciò che chiedevamoIA da immagine a video – anima le tue foto con l’IAimmagineScopri come Grok sta rivoluzionando i video...‎🚨 L’IA sta diventando spaventosamente brava.I migliori generatori video IA del 2025immagineimmagineOltre il 20% di YouTube è ora generato dall’IAOltre 5 migliori siti per generazione video IA 2026 | Runway, Pika, Kling AI, Canva e altroIntelligenza artificiale: preserviamo la nostra...Creazione video IA: 10 modi intelligenti per creare più rapidamente video coinvolgentiCos’è Imagvio AI e come aiuta i creator...Analisi di immagini e video guidata dall’IAIl potenziale impatto dell’intelligenza artificiale su...IAStrumenti IA per il montaggio video — ciò che i creator usano davvero per creare contenuti nel 2026Ultime notizie IA — Grok 4.6, Gemini 1B, Honor Robot PhoneFuturo della creazione video: migliori generatori video IA del 2026🔸Come rilevare gratuitamente online immagini generate dall’IACreerò un video esplicativo IA con Synthesia, Sora AI, Kling AI, Runway AI e InVideoCreazione professionale di video IA | Video IA cinematografici | Montaggio video personalizzatoCreazione video IA: guida completa per creare più rapidamente video professionali con l’IACome l’IA sta trasformando il montaggio videoShengShu Technology presenta Vidu S1, portando la generazione interattiva in tempo reale nei video IAStoria dell’IA generativaPadroneggiare video e IA: tendenze chiave del social media marketing 2025Lo strumento segreto di OpenAI per la generazione di immagini debutterà presto'Amuse 3.0', uno strumento di creazione artistica IA che include...Le creazioni più impressionanti degli utenti di Internet...Trasforma le tue idee in immagini straordinarie! 🎥Effetto IA virale delle persone minuscole — scopri come crearlo!12 migliori generatori video IA del 2026, gratuiti e a pagamento | Google Veo, Sora, Runway e altro

Nota sulla qualità dei dati

X non ha raccolto nemmeno un post pertinente per via di query non allineate al tema. Bluesky, Pinterest e YouTube avevano limitazioni nell’accesso a metriche di engagement o API di ricerca, perciò alcune conclusioni quantitative sono poco solide.

Galleria