KEN’S CAT LOG

Notizie sull’AI per la generazione di immagini e video — 2026-09-06

OpenAI GPT-6 Astra sta dominando il panorama closed-source non tanto come strumento di “generazione di immagini e video”, quanto come “agente per il controllo del PC”; sul fronte open source, intanto, le notizie di implementazione su Qwen Image e MiniMax-H3 continuano ad accumularsi attorno a ComfyUI.

Riepilogo delle notizie sull’AI per la generazione di immagini e video — 2026-09-06

Sul serio, questa settimana è stata piena di movimenti pazzeschi 😳🔥 Sul fronte closed-source è completamente esplosa la festa di OpenAI “GPT-6 Astra”: tutti ne parlano più come di un “agente che controlla l’intero PC” che come di uno strumento per generare immagini e video. Al contrario, Sora sembra essersi spento silenziosamente e pare sia in corso uno spostamento degli investimenti dalle app di generazione video agli agenti AI. Nel mondo open source, Qwen Image, Z-Image Turbo, HunyuanImage e MiniMax-H3 continuano ad aggiornarsi costantemente nell’ecosistema ComfyUI: meno clamore, ma una densità davvero alta di notizie sulle implementazioni. A essere sinceri, però, alcune piattaforme non hanno funzionato bene nella ricerca questa volta (Reddit, X e Bluesky), quindi non è stato possibile analizzare a fondo tutti i 20 contenuti previsti; lo dichiaro apertamente nella sezione “Qualità dei dati” qui sotto 🙏

Tra le piattaforme

  • GPT-6 Astra (OpenAI) domina quasi completamente il panorama closed-source: sia su X (@masahirochaen, https://x.com/masahirochaen/status/2095644339041153256) sia su Bluesky (@todaystopainews, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225), ha monopolizzato l’attenzione subito dopo il lancio. È diventato virale il benchmark ARC-AGI-3 al 98,6% (7,8% per la generazione precedente).
  • Astra viene raccontato più come “controllo agentico” che come “generazione di immagini”: sia X (@aigeboku, verifica della funzione ComputerUse) sia Bluesky (demo di costruzione automatica di una città in Unity) si concentrano più sul lato “far muovere autonomamente il PC” che su singole immagini o video prodotti. Sembra davvero una nuova categoria.
  • Fable 5.1 viene usato moltissimo come termine di confronto: su X, @renoiseai e @Mayz1169 hanno pubblicato indipendentemente video di confronto “Astra vs Fable 5.1” via Seedance 2.5. Nel post di @k_matsumaru, inoltre, Fable 5.1 non era il renderer finale, ma parte di una pipeline a quattro strumenti come livello di generazione dei prompt. Quasi nessuno completa più tutto con un singolo modello.
  • Le API aggregatrici stanno acquisendo rilevanza in entrambi gli ecosistemi: su Reddit (WaveSpeedAI, che riunisce oltre 1.000 modelli dietro una sola REST API) e Bluesky (useapi.net, confronto trasversale tra Veo/Kling/Seedance/PixVerse/Hailuo/Runway/Nano Banana), le informazioni pratiche sono state giudicate più dense di quelle provenienti dagli account ufficiali.
  • L’open source mostra una struttura a due poli — Qwen Image / Z-Image Turbo (Alibaba·Tongyi-MAI) e HunyuanImage (Tencent) — più l’emergente MiniMax-H3: una lettura fortemente corroborata sia dalle recensioni su YouTube sia da !«メールアドレス» su Lemmy.
  • L’ecosistema attorno a MiniMax-H3 (modello video open-weight) si sta espandendo a velocità altissima: soltanto su Lemmy, oltre 10 post tra l’8 agosto e il 5 settembre (quantizzazione GGUF, Turbo LoRA, supporto a video lunghi fino a 120 secondi, implementazioni di hybrid attention). Anche su X, @ImaStudio_ai ha costruito il proprio strumento commerciale sulla sua base: un punto confermato su più piattaforme.
  • ComfyUI è ormai il centro di comando dell’open source: Lemmy, Bluesky (@kunecco) e i tutorial YouTube lo mostrano chiaramente: la compatibilità con ComfyUI è diventata il banco di prova per capire se una tecnologia è davvero concreta.
  • Multi-shot e sincronizzazione audio sono il prossimo asse competitivo comune a open e closed source: Wan 2.6 (open) e Kling 3.0/Seedance 2.0/Runway Gen-4.5 (closed) sono stati confrontati direttamente in stress test su YouTube.
  • Il dubbio “è AI o è reale?” è ovunque: battute sulle mani deformi su Reddit, discussioni nelle classi e pin Pinterest in stile quiz “Which is AI?”: questa inquietudine ricorre su tutte le piattaforme.
  • Gli account ufficiali dei brand sui social sono praticamente inattivi: su Bluesky, sia Midjourney ufficiale (ultimo post 2025-10-08) sia Kling AI ufficiale (zero post) sono di fatto fermi. Le notizie arrivano prima da account non ufficiali, singoli utenti e aggregatori.

Piattaforma per piattaforma

Reddit — Raccolti 12 thread da 9 subreddit (meno dell’obiettivo di circa 20). Tra i punti principali: forte reazione negativa a un nuovo metodo che fa usare il mouse a un LLM per falsificare interi timelapse di disegno a mano (r/antiai, 5.259 punti); API aggregatrice WaveSpeedAI; generazione locale rapida di Krea-2-Turbo su Apple Silicon (45 secondi per immagine). In r/VeniceAI sono emersi anche post di utenti esperti che differenziano finemente i modelli per generazione immagini, editing e video conversion. Restano forti anche le critiche etiche e qualitative (immagini AI di cibo stroncate, spam di offerte di lavoro da $30/ora).

X — I termini in forte crescita della sezione Explore erano influenzati dalla localizzazione del server in Croazia: 7 termini su 10 (Bitcoin, Ucraina, Argentina e altri) erano completamente irrilevanti. I post pertinenti erano tutti collegati a GPT-6 Astra; questa volta non sono stati provati termini open source come Stable Diffusion, Wan o Flux. Quindi, per questa rilevazione, il quadro open source su X non è “inesistente”: semplicemente non è stato esaminato.

YouTube — La notizia più importante sul lato closed-source è la fine di Sora (app chiusa il 26 aprile 2026, API prevista in chiusura il 24 settembre 2026; download scesi da 3,3 milioni a 1,1 milioni in 11 mesi). Sul lato open source abbondano i video first-test su Qwen Image, HunyuanImage e Z-Image Turbo; viene citato anche FLUX.2 (Apache 2.0) di Black Forest Labs come concorrente.

Bluesky — L’API di ricerca full-text dei post (searchPosts) ha restituito 403 per tutte le query, obbligando a cambiare metodo e passare alla ricerca per account; il numero di contenuti analizzati è quindi rimasto sotto l’obiettivo di 20. Sul lato closed-source predominano “news bot” come todaystopainews e useapi.net; sul lato open source prevalgono post di opere finite di creatori individuali come Niji-iro e Kunecco. Le notizie tecniche sull’open source quasi non circolano su Bluesky.

Lemmy — Pur essendo piccola, !«メールアドレス» (5.708 membri) è di fatto una bacheca di aggiornamenti rapidi open source, con notizie dense su MiniMax-H3 e supporto Day-0 per LTX-2.5. Sul lato closed-source, notizie come il passaggio di Midjourney ai dispositivi medici vengono consumate più come sarcasmo o scandalo che come aggiornamenti di prodotto. Non sono stati trovati post originari su Lemmy relativi a Sora/Veo/Kling/Hailuo.

Pinterest — Esaminati 50 risultati provenienti da un’unica query pre-raccolta, senza suddivisione per genere. Quasi tutto consisteva in liste comparative e infografiche su strumenti closed-source quali Runway, Pika, Kling, Luma, Synthesia e HeyGen. Solo due contenuti citavano l’open source: Baidu Ernie 4.5 e AMD Amuse 3.0. Pinterest è ormai un mercato SEO/marketing quasi interamente closed-source.

Cosa osservare

Raccomandazioni

  • Continuare a confrontare GPT-6 Astra con Fable 5.1 non solo sulla qualità di immagini e video, ma anche sulla dimensione del “controllo agentico”.
  • Tenere sotto osservazione nel prossimo aggiornamento l’ecosistema ComfyUI di MiniMax-H3 (GGUF e Turbo LoRA), come frontiera della generazione video open source.
  • Nella prossima ricerca su X, non basarsi sui termini di tendenza di Explore: cercare esplicitamente termini open source come Stable Diffusion, Wan, Flux e Qwen.
  • Per fonti primarie open source, dare priorità a !«メールアドレス» su Lemmy rispetto a Reddit o Bluesky.
  • Non usare Pinterest come fonte dell’andamento open source; limitarlo invece all’osservazione di marketing e SEO degli strumenti closed-source.
  • Verificare se esistono strumenti o flussi esterni dipendenti dalla chiusura della Sora API del 2026-09-24.

Qualità dei dati

Reddit si è fermato a 12 thread, sotto l’obiettivo di circa 20 (non era possibile raccogliere direttamente tramite WebFetch, quindi si è dipeso esclusivamente dalla raccolta preventiva). Su X, la maggioranza dei termini cercati — 7 su 10 — erano tendenze irrilevanti e non è stata effettuata neppure una ricerca open source: il panorama open source su X è quindi sostanzialmente inesplorato. Su Bluesky, l’API di ricerca full-text ha restituito 403 per ogni query e ha imposto il passaggio alla ricerca per account, lasciando il numero di analisi sotto l’obiettivo. Su YouTube, molti dati relativi a visualizzazioni e iscritti non erano verificabili a causa del rendering dinamico. Lemmy ha una scala ridotta e non sono stati trovati post originari su Sora/Veo/Kling/Hailuo, probabilmente anche per limiti di copertura della ricerca. Pinterest si basa su una sola query generale di 50 risultati, senza una seconda ricerca dedicata all’open source.

Riepilogo per piattaforma

Reddit

Reddit — Notizie sull’AI per la generazione di immagini e video

Dove

Con la query “Image and Video Generation AI News” sono stati raccolti 12 thread da 9 subreddit.

Subreddit Membri Thread raccolti
r/StableDiffusion 1,001,169 1
r/teenagers 3,674,216 1
r/aiwars 166,685 1
r/antiai 314,968 2
r/generativeAI 150,823 3
r/RemoteWorkers 74,528 1
r/VeniceAI 10,421 1
r/DailyIncome 12,914 1
r/freetoolsAI 7,736 1

r/generativeAI (3 thread) e r/antiai (2 thread) sono le comunità che hanno affrontato più spesso questo tema. r/antiai assume una posizione critica verso la generazione di immagini AI, mentre r/generativeAI è incentrato soprattutto su confronti tra strumenti e consulenza pratica: due atmosfere molto diverse.

Cosa dicono le persone
  • Avviso contro la falsificazione di timelapse di disegno a mano tramite LLM (thread #1, r/antiai, 5.259pt·760 commenti, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). È stato condiviso un metodo che fornisce a GPT-6 controllo di mouse e tastiera per falsificare in modo credibile anche il timelapse di un’illustrazione digitale; ha generato forti reazioni, come “perché rilasciare una tecnologia del genere, se non per danneggiare gli artisti veri?” (u/sanstheskelebrotherc, 235pt).
  • Confronto giornaliero di strumenti gratuiti per generare video AI (thread #2, r/generativeAI, 42pt·28 commenti, 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/). Il confronto ruota attorno a Adobe Firefly (2 video al giorno), PixVerse (1), Grok Imagine (1) e Google Flow (3–4); nei commenti vengono citati anche Kling AI (66 crediti ogni 24 ore, equivalenti a 2–6 video da 5 secondi a 720p) e i crediti gratuiti giornalieri di CapCut.
  • Thread di condivisione di strumenti gratuiti e illimitati per immagini (thread #3, r/freetoolsAI, 37pt·38 commenti, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). La possibilità di gestire NSFW è il principale tema nei commenti: accanto a “perché tutti bannano NSFW?” (u/Relevant_Syllabub895), vengono elencati Deepany, Aifun, Perchance e Z-Image-Turbo su huggingface.
  • Offerta di lavoro “$30/ora per revisionare immagini AI” diffusa in parallelo in due subreddit (thread #4, r/RemoteWorkers, 114pt·520 commenti, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/ e thread #6, r/DailyIncome, 129pt·1.123 commenti, 2026-09-04, https://www.reddit.com/r/DailyIncome/comments/1w7b18p/). L’annuncio è quasi identico nei due casi, ma la maggior parte dei commenti consiste in risposte di una sola parola come “images” o “Interested”, probabilmente risposte standardizzate in cerca del link per candidarsi.
  • Demo di accelerazione della generazione locale di immagini (thread #5, r/StableDiffusion, 31pt·10 commenti, 2026-09-03, https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/). Vpipe + Krea-2-Turbo-M87 (16bit) eseguiti localmente su Apple Silicon (M5 Pro 24GB) hanno ottenuto circa 45 secondi per immagine a 1024×1024 e 8 step (35 secondi in tempo reale con quantizzazione a 8bit).
  • Thread meme sul fatto che le immagini AI siano sempre più difficili da rilevare (thread #8, r/antiai, 113pt·30 commenti, 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/). In realtà, il tema dominante restano le mani deformi: commenti come “perché il suo piede è una mano?” (u/GurInside278, 31pt) dimostrano che gli errori classici sono ancora oggetto di ironia.
  • Valutazione del servizio di aggregazione API WaveSpeedAI (thread #7, r/generativeAI, 2pt·4 commenti, 2026-09-05, https://www.reddit.com/r/generativeAI/comments/1w8ci5z/). Secondo u/Jenna_AI, “racchiude oltre 1.000 modelli, tra cui Flux, Wan 2.1/2.6, Hailuo e Kling, in una sola REST API”; un utente che lo ha integrato in uno strumento proprietario con Seedance (u/BradClarkAI) dichiara di non aver avuto alcun problema.
  • Informazioni della comunità VeniceAI sulla scelta dei modelli (thread #9, r/VeniceAI, 8pt·6 commenti, 2026-08-30, https://www.reddit.com/r/VeniceAI/comments/1w2rtq1/). u/jerm2z consiglia Chroma per generare immagini, Qwen Edit Uncensored o Seedream per l’editing, FireRed (non compatibile con NSFW ma con elevata coerenza dei volti) e WAN Enhanced, Seedance, Minimax R2V per image-to-video.
  • Le immagini AI di cibo vengono stroncate perché “non appetitose” (thread #10, r/aiwars, 4pt·175 commenti, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Accanto al commento tagliente “sembra solo un grub hive (nido di larve)” (u/LCI_Jake, 14pt), un utente che ha provato a generare localmente con Krea 2 in 40 secondi (u/Bassed_Hummble) si chiede perché l’output sia così pessimo nonostante un prompt semplice.
  • Discussione tra giovani sul valore dell’arte AI (thread #12, r/teenagers, 7pt·41 commenti, 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/). Al post secondo cui “l’AI riceve un prompt ed è l’AI stessa a disegnare, cosa fondamentalmente diversa dalla creazione umana con strumenti o software” sono seguite opinioni divise. u/TheDarkmore dichiara di aver affidato all’AI le 120 illustrazioni di un gioco di carte perché non sa disegnare bene e di ritenerlo una scelta valida.
Segnali
  • In crescita: il nuovo metodo che fa usare mouse e tastiera a un LLM per simulare il disegno “a mano” (thread #1) sta suscitando rapidamente reazioni contrarie come minaccia distinta dal tradizionale rilevamento dei modelli di diffusione, aggiungendo un nuovo punto di conflitto tra AI e anti-AI. Stanno crescendo, più silenziosamente, anche le discussioni dedicate a infrastrutture ed efficienza per sviluppatori: servizi aggregatori come WaveSpeedAI, che avvolgono oltre 1.000 modelli in una sola API (thread #7), e generazione locale rapida su Apple Silicon (thread #5).
  • Aree sottovalutate o derise: le immagini pubblicitarie AI di cibo (thread #10) sono state giudicate così male che “sarebbe meglio incollare una foto stock”, con limiti di qualità ripetutamente evidenziati. Le offerte da “$30/ora per revisionare immagini AI” (thread #4 e #6), quasi identiche fra loro, ricevono soprattutto risposte automatiche da candidati in cerca del link e pochissima discussione pratica: è probabile che vengano percepite come spam.
  • Contrasto inatteso: sullo stesso tema della difficoltà di distinguere le immagini AI, r/antiai (thread #8) continua a scherzare sulle mani deformi, mentre il thread #1 considera seriamente minaccioso il nuovo metodo capace di falsificare perfino i timelapse. La comunità è quindi divisa persino sulla reale maturità del rilevamento. Analogamente, r/VeniceAI e r/StableDiffusion discutono di uso tecnico e ottimizzazione, mentre r/antiai e r/aiwars esprimono forti critiche etiche e qualitative: l’atteggiamento verso la generazione immagini AI su Reddit è fortemente frammentato per subreddit.
Limiti
  • È stata usata solo la query “Image and Video Generation AI News”, senza ricerche separate per “open source” e “closed source”. Perciò questo file da solo non può separare direttamente le almeno 10 osservazioni richieste per ciascuno dei due ambiti; la classificazione va fatta nel report aggregato.
  • Il criterio di completamento prevedeva circa 20 post analizzati per social, ma sono stati raccolti soltanto 12 thread.
  • Nei thread #4 e #6, relativi al lavoro da $30/ora, la maggior parte dei commenti consiste in risposte standard come “images” e “Interested”; non emergono vere discussioni o verifiche.
  • Reddit rifiuta l’acquisizione diretta tramite WebFetch e ricerca, perciò l’analisi dipende soltanto dai file raccolti in precedenza dal worker (reddit.threads.md/json). In questa sessione non è stato possibile approfondire ulteriormente, seguire thread correlati o espandere l’analisi dei commenti.

X

X — Notizie sull’AI per la generazione di immagini e video

La lista Explore di X per questa sessione è geolocalizzata in Croazia (dove si trova il server), non in Giappone né su un feed globale: mostra come tendenze “Astra”, “Bitcoin”, “Ukrainian”, “Argentina”, “$SONG”, “OpenAI”, “Russia”, “Black”, “$KURO”, “Fable”, senza conteggi dei post. Solo tre dei dieci termini (“Astra”, “OpenAI”, “Fable”) hanno effettivamente a che fare con l’AI per generare immagini/video; gli altri riguardano pronostici crypto, guerra Russia-Ucraina, gossip su celebrità argentine e memecoin, e non sono trattati qui sotto — vedere Limiti.

Account

Account pertinenti, in base a ciò che hanno effettivamente pubblicato:

Account Cosa pubblica Portata di questo post
@masahirochaen (チャエン) Account giapponese di notizie AI/tech; ha dato la notizia del lancio di GPT-6 Astra con numeri di benchmark, poi un aggiornamento sulla frase di Altman secondo cui “c’è altro oltre Astra” 2 post, 841 + 133 like, fino a ~550.000 visualizzazioni per il post di lancio
@UNIBRACITY (SHINTARO) Artista 3D amatoriale che combina GPT-6 Astra e Blender 1 post, 306 like
@hayashimon1 (ハヤシモン|AI×個人開発) Creatore AI/3D che organizza anche seminari a pagamento; usa Fable 5.1 × Blender 1 post, 55 like
@manaimovie (Mankyu) Appassionato di video AI, inserisce un modello 3D di Tripo in Astra 1 post, 409 like
@yachimat_manga (yachimat‑AI Short Anime) Creatore di corti anime AI; ipotizza che Astra possa sostituire strumenti video dedicati per alcuni stili 1 post, 51 like
@aigeboku (AI様の下僕) Power user AI che testa il controllo agentico “ComputerUse” di Astra 1 post, 653 like
@gagarot200 (ガガロット) Account di demo AI, clip da prompt di una riga a gioco 1 post, 306 like
@SSSS_CRYPTOMAN Account ibrido crypto+AI, ha pubblicato una demo di costruzione di gioco con Astra 1 post, 161 like
@Mayz1169 (Kiki) / @renoiseai (Renoise) Account di confronto video AI, entrambi mettono GPT-6 Astra contro Fable 5.1 con rendering via Seedance 2.5 1 post ciascuno, 64 e 140 like
@k_matsumaru Creatore video AI che documenta una pipeline completa (Typeless → Fable 5.1 → Seedream 5.0 → Seedance) 1 post, 279 like
@Strength04_X Account di condivisione prompt per Seedance 2.5 (via lovart_ai) 1 post, 444 like
@ImaStudio_ai Account prodotto/studio per un proprio strumento di fashion video AI basato su MiniMax H3 1 post, 132 like

Ognuno di questi è un singolo post, non un thread né una campagna continuativa: si tratta di una reazione dispersa di un solo giorno al lancio, non di account che guidano sistematicamente la conversazione.

Post
24. @masahirochaen (チャエン)

【速報】OpenAI ha annunciato “GPT-6 Astra”. È finalmente uscito il modello principale che delega l’intero lavoro al PC e supera Fable 5.1. …ARC-AGI-3 (capacità di risolvere puzzle mai visti) 98,6%; GPT-5.6 della generazione precedente 7,8%. Un salto anomalo.

Di gran lunga il post più grande della raccolta, e quello che incornicia tutto il resto: presenta GPT-6 Astra come agente in grado di operare un PC e superiore a Fable 5.1, citando un salto ARC-AGI-3 dal 7,8% di GPT-5.6 al 98,6%.

21. @masahirochaen (チャエン)

Sam Altman afferma apertamente che c’è un “dopo GPT-6”… Ha chiarito che il modello i cui lavori erano stati temporaneamente sospesi ad agosto per rischio cyber non era GPT-6 Astra.

Due giorni dopo il lancio, lo stesso account riferisce che Altman ha detto che il modello sospeso da OpenAI ad agosto per rischi cyber non era Astra, facendo intuire l’esistenza di un modello ancora più capace e non rilasciato.

3. @aigeboku (AI様の下僕)

Come suggerisce il fatto che GPT-6 Astra è molto bravo a “controllare gli altri”, ComputerUse amplia enormemente ciò che si può fare… magari non tutto in un colpo solo, ma con qualche aggiustamento da qui si potrebbero ottenere espressioni ancora più interessanti.

Inquadra il vantaggio di Astra come controllo agentico (“ComputerUse”), non come mera qualità di generazione: i primi tester esplorano ciò che quel controllo può sbloccare nei flussi creativi, non soltanto nell’output di immagini.

1. @manaimovie (Mankyu)

Ho dato al professor Astra un modello creato con Tripo e gli ho chiesto di animarlo: è quello che ha realizzato. …Molto meglio che con Fable o Sol!

Un’affermazione concreta su un flusso prima/dopo: dare ad Astra un modello 3D creato con Tripo e chiedergli di animarlo ha funzionato meglio dello stesso processo con Fable o “Sol”.

22. @gagarot200 (ガガロット)

GPT-6 Astra produce tutto automaticamente… basta spiegargli con una sola frase “GPT-6 Astra, crea un gioco del genere”.

Una demo in cui un prompt di una sola riga genera un gioco giocabile end-to-end, proposta come prova del posizionamento di Astra: “fa l’intero compito”.

23. @UNIBRACITY (SHINTARO)

GPT-6 Astra × Blender “Forest Retreat / フォレスト・リトリート”. Tempo di esecuzione di Astra: circa 7 ore. Si è arrivati fin qui.

Un’esecuzione di Astra di circa 7 ore che produce una scena 3D completa in Blender: uno dei dati più dettagliati del gruppo sulla durata effettiva del processo.

4. @SSSS_CRYPTOMAN (SSSS.CRYPTOMAN⚡️AI)

Con GPT-6 Astra ho completato un gioco in un attimo! 🎮… Da un prompt grezzo e poche interazioni è venuto fuori qualcosa di qualità normalmente giocabile.

Un’altra demo, indipendente, da prompt vago a gioco giocabile, con link live, che riecheggia l’affermazione di @gagarot200.

2. @yachimat_manga (yachimat - AI Short Anime)

Ho provato a fare modellazione con GPT-6 Astra. …Non potrebbe esserci un futuro in cui, per certi stili di video, non servano più strumenti dedicati alla generazione video?

Un creatore attivo di anime AI ipotizza che, per alcuni stili, la modellazione 3D di Astra possa rendere superflui gli strumenti di generazione video specializzati.

40. @renoiseai (Renoise)

GPT-6 Astra vs Fable 5.1. Entrambi i video sono stati generati con Seedance 2.5 su Renoise.

Una clip di confronto diretto, con entrambi gli output renderizzati tramite lo stesso strumento downstream (Seedance 2.5) per controllare questa variabile.

39. @Mayz1169 (Kiki)

Dimenticate per un attimo i benchmark: guardate questo. Confronto fianco a fianco GPT-6 Astra vs. Fable 5.1 sugli stessi prompt. Quale scegliereste?

Lo stesso impulso al confronto del caso precedente, emerso indipendentemente: i testa a testa Astra contro Fable 5.1 costituiscono un micro-genere riconoscibile in questo gruppo, non un episodio isolato.

37. @k_matsumaru (松丸 彗吾)

Il mio recente modo di creare video… ① Trascrivere le istruzioni con Typeless ② Fare scrivere a Fable 5.1 un prompt per generazione video ③ Trasformarlo in storyboard e controllare il contenuto con Seedream 5.0 Pro ④ Seedance…

La pipeline di produzione più dettagliata del gruppo: Typeless per la sceneggiatura → Fable 5.1 per la scrittura del prompt → Seedream 5.0 Pro per storyboard → Seedance per il video finale. Qui Fable è un livello di prompting, non il renderer.

32. @ImaStudio_ai (Ima Studio)

MiniMax H3 K-Fashion Outfit Change MV… 8 LOOK. 1 GIRL. ZERO IDENTITY DRIFT.

Uno studio commerciale promuove il proprio prodotto costruito su MiniMax H3, proponendo come elemento distintivo lo “zero identity drift” durante i cambi d’abito.

Segnali
  • Cosa sta crescendo: GPT-6 Astra (OpenAI) domina ogni post pertinente del gruppo ed è raccontato prima di tutto come modello agentico, capace di operare un computer, e solo secondariamente come generatore di immagini/video. I tester lo abbinano continuamente ad altri strumenti (Tripo per le mesh 3D, Blender per le scene), anziché trattarlo come renderer autonomo.
  • Un micro-genere riconoscibile: account indipendenti e non sollecitati (@renoiseai, @Mayz1169) pubblicano confronti fianco a fianco “GPT-6 Astra vs Fable 5.1” renderizzati con Seedance 2.5. Fable 5.1 è il riferimento naturale, mentre Seedance e Seedream ricorrono come vero livello di rendering video sotto entrambi.
  • Pipeline concatenate, non strumenti singoli: il post più dettagliato (@k_matsumaru, #37) concatena quattro strumenti (Typeless → Fable 5.1 → Seedream 5.0 Pro → Seedance) per un unico video. Nessuno in questo insieme descrive il completamento di un video con un solo modello.
  • Cosa ha sorpreso: i termini di tendenza ottenuti dal pannello Explore di X, geolocalizzato in Croazia — Bitcoin, Ukrainian, Argentina, $SONG, Russia, Black, $KURO — non avevano praticamente alcuna connessione con l’AI per immagini/video. Le tendenze del luogo del server il 2026-09-05/06 sono crypto e geopolitica, non modelli AI; usarle come proxy del dibattito AI sarebbe fuorviante.
  • Cosa viene ignorato: in questo insieme non è emerso alcun thread scettico o critico su GPT-6 Astra; tutti i post pertinenti sono demo, ripubblicazioni di benchmark o clip comparative. L’assenza è di per sé degna di nota, considerate le aggressive affermazioni di superiorità su Fable 5.1 nel post #24.
Limiti
  • I dieci termini cercati (“Astra”, “Bitcoin”, “Ukrainian”, “Argentina”, “$SONG”, “OpenAI”, “Russia”, “Black”, “$KURO”, “Fable”) provenivano dalla lista Explore di X per questa sessione, non da un elenco curato di termini AI per immagini/video. Sette di essi (“Bitcoin”, “Ukrainian”, “Argentina”, “$SONG”, “Russia”, “Black”, “$KURO”) hanno restituito post totalmente estranei al tema, come giveaway crypto, guerra Russia-Ucraina, notizie su celebrità argentine e memecoin, e sono esclusi dalla sezione Post.
  • Per questo motivo, la copertura open source è esile e indiretta: nessun post della raccolta ha usato termini come “Stable Diffusion”, “ComfyUI”, “Wan”, “HunyuanVideo” o “Flux”; tali ricerche non sono mai state eseguite in questa fase. Tutto ciò che è pertinente rimanda a nomi closed/commerciali (GPT-6 Astra, Fable 5.1, Seedance, Seedream, MiniMax H3, Tripo), quindi il quadro open source di X per questa rilevazione va considerato assente, non come “non sta succedendo nulla”.
  • Il post #35 (@MINHxDYNASTY, taggato “$KURO”) è stato raccolto senza il testo del post nel file sorgente, quindi non ha potuto essere usato come risultato.
  • La colonna “Where” di Explore è geolocalizzata dove risiede il server della sessione — Croazia — e non in Giappone o nel mondo; non va letta come quadro globale o giapponese delle tendenze.
  • Non ci sono stati fallimenti tecnici o di accesso: la raccolta ha restituito dati per ogni termine cercato. Il divario è tematico, ossia relativo alle query eseguite, non tecnico.

YouTube

YouTube — Notizie sull’AI per immagini e video (closed source/open source)

Canali
  • Bijan Bowen (@Bijanbowen, circa 37.000 iscritti) — Specializzato in recensioni approfondite di LLM e modelli di generazione immagini. Ha testato Qwen Image-2512.
  • Future Tools / Matt Wolfe (@mreflow, oltre 900.000 iscritti) — Riassume ogni settimana gli sviluppi di AI per immagini e video, tra cui Midjourney e Runway, nel formato “Everything in AI This Week”.
  • Gruppo di canali tutorial su ComfyUI/generazione locale (molti video sui workflow Wan 2.2/2.6, FLUX e Qwen Image; nei risultati erano visibili i titoli ma non i nomi dei singoli canali).
Video
  1. “Why OpenAI Shut Down Sora So Fast: What's Next?” — Pubblicato circa tra marzo e aprile 2026. Spiega il contesto della decisione di OpenAI di chiudere l’app Sora il 26 aprile 2026 e prevedere la chiusura della stessa API per il 24 settembre 2026: i download mensili sono crollati da 3,3 milioni nel novembre 2025 a 1,1 milioni nel febbraio 2026 e un accordo triennale da 1 miliardo di dollari con Disney è fallito. https://www.youtube.com/watch?v=H2jVcy5PuBI
  2. “Why Did Sora AI Shut Down? The Real Reason OpenAI Killed Its Viral Video App” — Pubblicato nella primavera del 2026. Discute costi economici e difficoltà di monetizzazione dell’app di generazione video, oltre al cambiamento strategico verso l’AI agentica. https://www.youtube.com/watch?v=MpLY9bjYVuA
  3. “HunyuanImage-3.0 First Test – The Open Source Nano Banana?” — Pubblicato il 29 settembre 2025. Test locale di HunyuanImage-3.0 di Tencent, uno dei maggiori modelli open source text-to-image, inclusi requisiti hardware. https://www.youtube.com/watch?v=lLTv4sGf8Wo
  4. “Qwen Image-2512 First Test – The BEST Open Source Image Model!” (Bijan Bowen) — Pubblicato il 31 dicembre 2025. Test su realismo dei soggetti umani e miglioramenti nel rendering testuale di Qwen Image-2512 di Alibaba. https://www.youtube.com/watch?v=SBaK616nP6Q
  5. “New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)” — Pubblicato il 5 gennaio 2026. Confronto diretto tra Qwen Image 2511/2512 e Z-Image Turbo di Tongyi-MAI. https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  6. “Tencent Hunyuan 2.1 vs. Qwen Image: Who is the True King? A 2K Image & Text Rendering Showdown!” — Pubblicato il 28 settembre 2025. Sfida nel rendering testuale 2K tra Hunyuan Image 2.1, allora primo nella classifica Arena open source text-to-image, e Qwen Image. https://www.youtube.com/watch?v=MUDTryJS0XM
  7. “Z-Image la nouvelle star des modèles Open Source?? Test dans ComfyUI” — Pubblicato il 28 novembre 2025. Test in ComfyUI di Z-Image Turbo, modello open source text-to-image di Alibaba/Tongyi-MAI. https://www.youtube.com/watch?v=eOKSBu7KLh0
  8. “Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models” — Pubblicato l’11 gennaio 2026. Tutorial long-form sui modelli open source più recenti per immagini e video (Wan 2.2/FLUX/Qwen Image) in ComfyUI. https://www.youtube.com/watch?v=3BFDcO2Ysu4
  9. “WAN 2.6 Hands-On: The Good, the Bad, and the Useful” — Pubblicato il 26 dicembre 2025. Verifica pratica di Wan 2.6, rilasciato da Alibaba, con clip fino a 15 secondi, multi-shot e sincronizzazione audio. https://www.youtube.com/watch?v=iNnmLwPg7OE
  10. “Multi-Shot AI Videos: Wan 2.6 vs Kling 2.6 (Stress Test)” — Pubblicato il 27 dicembre 2025. Stress test della generazione multi-shot tra Wan 2.6 open e Kling 2.6 closed. https://www.youtube.com/watch?v=CDRKn4I-Iv0
  11. “I Tested Google's Nano Banana Pro Tips - This One Creates Pro Graphics in 30 Seconds” — Pubblicato tra novembre e dicembre 2025. Test pratico di Gemini 3 Pro Image di Google DeepMind, noto come Nano Banana Pro, con output 4K, oltre 14 oggetti e rendering di testo multilingue. https://www.youtube.com/watch?v=ca4SXmRqtKE
  12. “Qwen Image Edit Review — Free Open-Source Alternative to Nano Banana” — Pubblicato il 4 dicembre 2025. Recensione di Qwen Image Edit, modello open source per l’editing proposto come alternativa a Nano Banana closed-source. https://www.youtube.com/watch?v=Ur3udfFJ2QQ
Segnali
  • La più grande notizia closed-source è il ritiro di Sora: OpenAI avrebbe notificato gli sviluppatori il 24 marzo 2026, terminato app e versione web di Sora il 26 aprile e pianificato la chiusura della API il 24 settembre 2026. Più video indicano come contesto il crollo dei download (3,3 milioni nel novembre 2025 → 1,1 milioni nel febbraio 2026) e il fallimento della partnership Disney da 1 miliardo di dollari. Il caso viene trattato come segnale di un cambiamento del settore dalla generazione video verso coding e AI agentica.
  • L’open source ha una struttura “due poli più stella emergente”: la famiglia Alibaba (Qwen Image, Z-Image Turbo, Wan 2.2/2.6) e quella Tencent (HunyuanImage 3.0/2.1) competono per il vertice delle principali classifiche; FLUX.2 di Black Forest Labs ([dev]/[klein], VAE Apache 2.0) si oppone sul fotorealismo. Molti creatori presentano Qwen Image e HunyuanImage come “alternative open source a Nano Banana”, e il confronto diretto tra closed e open source è diventato un formato consolidato.
  • Nei video, multi-shot e sincronizzazione audio diventano il nuovo standard: Wan 2.6 (open) e Kling 3.0/Seedance 2.0/Runway Gen-4.5 (closed) competono tutti su “più inquadrature in una sola generazione” e “generazione simultanea di audio e SFX”, portando la gara oltre la singola clip.
  • Molte recensioni adottano il formato pratico “first test” o “first look”, pubblicato entro pochi giorni o una settimana dall’annuncio del modello, ormai una formula rapida e consolidata.
Limiti
  • Le pagine dei risultati e di visione di YouTube (youtube.com/results, youtube.com/watch) sono renderizzate in JavaScript; WebFetch ha quindi recuperato soprattutto il footer statico (copyright, termini e link), senza poter confermare direttamente visualizzazioni, iscritti o commenti nella maggior parte dei casi. Le visualizzazioni e gli iscritti sopra riportati provengono soltanto da ciò che era disponibile negli estratti di ricerca e molti video non hanno un conteggio visibile.
  • Non è stato possibile identificare URL diretti di singole recensioni YouTube per Kling 3.0 / Seedance 2.0 / Runway Gen-4.5, perché i risultati erano concentrati su articoli di blog comparativi (invideo.io, Pixo, AI.cc e altri).
  • Il numero di iscritti ai canali è stato confermato nei risultati soltanto per Bijan Bowen (circa 37.000) e Matt Wolfe / Future Tools (oltre 900.000).

Bluesky

Bluesky — Notizie sull’AI per la generazione di immagini e video

L’API ufficiale di ricerca Bluesky (app.bsky.feed.searchPosts) ha restituito costantemente 403 Forbidden in questa sessione, impedendo la raccolta per parole chiave (dettagli in Limiti). Si è quindi passati alla ricerca di account rilevanti tramite app.bsky.actor.searchActors, per poi leggere una per una le cronologie dei loro post con getAuthorFeed.

Account
Account Contenuto Follower Post
@todaystopainews.bsky.social “Today's Top AI News”. Account in stile bot che raccoglie e pubblica notizie del settore AI; molti contenuti su GPT-6 Astra, Fable 5.1 e modelli closed-source 272 1.826
@useapi.bsky.social useapi.net. Account ufficiale del servizio aggregatore che riunisce API di Veo, Kling, Seedance, PixVerse, Hailuo, Runway, Nano Banana e altri 13 24
@nijiironokeshiki.bsky.social “Niji-iro”. Creatore individuale che pubblica 2–3 illustrazioni fan art al giorno usando Stable Diffusion e ComfyUI, su Re:Zero, Lycoris Recoil, Frieren e altro 699 1.963
@kunecco.bsky.social “Kunecco”. Sviluppatore di nodi, workflow e LoRA per la versione git di ComfyUI; pubblica anche contenuti tecnici quali traduzioni dei tag danbooru 540 494
@midjourneyofficial.bsky.social Account ufficiale Midjourney. Ha annunciato il proprio arrivo su Bluesky nell’agosto 2025 Sconosciuto Ultimo post 2025-10-08
@comfyuistudio.bsky.social Account di terze parti che presenta workflow ComfyUI Sconosciuto Ultimo post 2024-12-19
@klingaivideo.bsky.social Account che presenta lo strumento video Kling AI Sconosciuto Feed vuoto (nessun post)
Post
Closed source
  1. GPT-6 Astra genera un SVG di un controller PS4 (@todaystopainews, 11 like·2 repost·1 risposta, 2026-09-05, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225). È indicato perfino il tempo di generazione, 11 minuti e 54 secondi: un esempio concreto del tempo richiesto a GPT-6 Astra per un’attività grafica.

  2. GPT-6 Astra costruisce una scena urbana in Unity (@todaystopainews, 4 like·1 repost, 2026-09-04, https://bsky.app/profile/todaystopainews.bsky.social/post/3muoucqf4tk2w). Una demo che compone automaticamente una scena 3D usando asset esistenti, mostrando un uso agentico oltre la semplice generazione di immagini.

  3. Repost di “Fable 5.1 world modeling” (@todaystopainews, 11 like·4 repost, 2026-09-03, https://bsky.app/profile/todaystopainews.bsky.social/post/3mumdxgujh22h) e, il giorno precedente, “Città medievale creata con Fable 5.1” (10 like·3 repost, 2026-09-02, https://bsky.app/profile/todaystopainews.bsky.social/post/3mukekiwxws2j). Fable 5.1 di area Anthropic viene ripetutamente presentato attraverso demo di modellazione 3D e world modeling.

  4. Blog useapi.net “Seedance 2.5 su Dreamina API” (@useapi.bsky.social, 2026-08-08, https://bsky.app/profile/useapi.bsky.social/post/3mskj7fb2ok2a). Presenta in forma di blog tecnico la disponibilità del modello video Seedance 2.5 di area ByteDance tramite API Dreamina.

  5. Confronto useapi.net “MiniMax H3 vs Seedance 2.0” sulla stessa immagine di riferimento (@useapi.bsky.social, 2026-07-31, https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x). Confronto diretto fra modelli che usa lo stesso materiale di riferimento (omni references), verificato dal punto di vista di un fornitore API.

  6. useapi.net “Confronto approfondito di oltre 17 modelli di immagini AI” (@useapi.bsky.social, 3 like, 2026-07-25, https://bsky.app/profile/useapi.bsky.social/post/3mrigfks25k2n). Articolo comparativo trasversale tra molti modelli di generazione immagini, che mostra la frammentazione dell’offerta closed-source.

  7. useapi.net “Confronto prezzi: percorso ufficiale Seedance 2.0 vs percorso di terze parti” (@useapi.bsky.social, 2026-07-23, https://bsky.app/profile/useapi.bsky.social/post/3mrdyxqswcb2p). Mostra concretamente differenze di prezzo tra API ufficiali e accesso via aggregatore allo stesso modello, rendendo visibile la struttura a livelli del mercato API.

Open source
  1. Post quotidiani di illustrazioni AI di “Niji-iro” (@nijiironokeshiki, intervallo 87–245 like, diversi post dal 2026-09-02 al 09-05, esempio: https://bsky.app/profile/nijiironokeshiki.bsky.social/post/3mumi7nop522l, 104 like·25 repost). Come dichiarato nel profilo, le opere sono realizzate con Stable Diffusion e ComfyUI; tra gli account Bluesky ottengono costantemente un engagement molto alto.

  2. Post di Kunecco sullo sviluppo di workflow ComfyUI (@kunecco, 2025-10-27, https://bsky.app/profile/kunecco.bsky.social/post/3m45jd5s2ek2f): “Creare nodi e workflow è diventato divertente, ci sto cadendo dentro”. Nello stesso periodo l’account ha scritto anche “ho tradotto 140.000 righe di token danbooru” (https://bsky.app/profile/kunecco.bsky.social/post/3m432qalae22t), un esempio di lavoro sull’ecosistema ComfyUI fino al livello dei dizionari di tag.

  3. Stagnazione degli account ufficiali o semi-ufficiali ComfyUI (@comfyuistudio.bsky.social ultimo post 2024-12-19; @comfy-ui.bsky.social ha feed vuoto). La ricerca per attori trova numerosi handle simili, tra cui comfyuistudio, real-comfyui, comfy-ui, comfyuiorg, ma gli account davvero attivi sono creatori individuali di illustrazioni AI come Niji-iro e Kunecco; gli sviluppatori e fonti informative ufficiali non hanno quasi presenza su Bluesky.

Segnali
  • Il closed source ruota attorno alle notizie rapide, l’open source alle opere finite: i post di todaystopainews e useapi.net trattano modelli, prezzi API e benchmark di GPT-6 Astra, Fable 5.1, Seedance e MiniMax H3. I like sono bassi, spesso da una cifra a circa dieci, ma la densità informativa è alta. L’open source Stable Diffusion/ComfyUI, invece, ruota attorno a illustrazioni finite di creatori individuali come Niji-iro: l’attenzione è sull’opera, non sull’evoluzione dei modelli. Le notizie tecniche open source quasi non circolano su Bluesky.
  • Gli account ufficiali di Midjourney e Kling AI sono di fatto inattivi: Midjourney ha annunciato il proprio arrivo su Bluesky nell’agosto 2025, ma l’ultimo post risale al 2025-10-08; l’account ufficiale Kling AI Video ha il feed vuoto. I brand non stanno usando Bluesky come canale editoriale continuativo.
  • Esistono account-personaggio con il marchio GPT-6 Astra: sono stati trovati account come astrra.space (Astra, “AI agent running on GPT-6 Astra”) e maple-nekokami.bsky.social (“Runs on OpenAI GPT-6 Astra”). Non sono direttamente dedicati alla generazione immagini/video, ma mostrano che GPT-6 Astra è consumato anche come meme e identità di brand su Bluesky.
  • useapi.net è un hub per confrontare modelli closed-source: aggregando Veo, Kling, Seedance, PixVerse, Hailuo, Runway e Nano Banana, useapi.net pubblica su Bluesky le informazioni più concrete su prezzi e qualità. Servizi trasversali di questo tipo risultano più utili degli account ufficiali dei singoli modelli.
Limiti
  • app.bsky.feed.searchPosts (API di ricerca full-text dei post) ha restituito HTTP 403 per ogni query, incluse query minimali come “image generation AI”, “Stable Diffusion” e “Flux”. Al contrario, app.bsky.actor.searchActors e app.bsky.feed.getAuthorFeed hanno funzionato. Il report dipende quindi dall’approccio “trovare account plausibilmente rilevanti e leggerli singolarmente”, non da una ricerca trasversale per keyword: i post e gli account non emersi dalla ricerca degli account non sono inclusi.
  • Rispetto al criterio di completamento di circa 20 post analizzati per social, è stato possibile leggere e analizzare soltanto i 10 elementi sopra più alcuni post di contesto. Per aumentare il numero con questa limitazione sarebbe necessario trovare altri account correlati; in questa sessione, dopo aver verificato le principali categorie — news bot closed-source, aggregatori API e creatori individuali ComfyUI/Stable Diffusion — i nuovi account trovati erano per lo più inattivi o irrilevanti (sport, politica, giornalismo), quindi la raccolta è stata interrotta.
  • Account ufficiali di brand come Midjourney e Kling AI erano fermi o vuoti, quindi inutilizzabili come fonti di notizie correnti.
  • La ricerca di account con nomi di modelli open source recenti come “Wan2.5”, “Flux.2” e “オープンソース 画像生成” non ha prodotto risultati. Non sono stati trovati account Bluesky che pubblichino su Wan, HunyuanVideo, Qwen-Image o Chroma; le osservazioni open source restano limitate ai marchi esistenti Stable Diffusion e ComfyUI.

Lemmy

Lemmy — Ultimi sviluppi nell’AI per immagini e video

Comunità
  • !«メールアドレス» — 5.708 membri. Di gran lunga la comunità più attiva. Ogni giorno arrivano nodi personalizzati ComfyUI, nuovi pesi di modelli e LoRA: di fatto una bacheca di notizie rapide sull’AI open source per immagini e video.
  • !«メールアドレス» — 2.360 membri. Principalmente condivisione di opere generate; poche notizie.
  • !«メールアドレス» — 1.662 membri. Simile alla versione dbzer0, ma con minore frequenza di pubblicazione.
  • !«メールアドレス» — 87.858 membri. Una delle più grandi comunità tech di Lemmy, ma con poca attenzione dedicata alla sola AI per immagini/video; talvolta emergono notizie aziendali su Midjourney.
  • !«メールアドレス» (incluse copie su altre istanze) — Molte ripubblicazioni dai subreddit AI di Reddit. Pochi elementi, ma intercetta fonti specifiche come dati finanziari di Runway.
  • !techtakes — Comunità critica e scettica verso l’AI, con post sarcastici su episodi come la deriva di Midjourney.
Post
  1. Midjourney passa al settore degli scanner TC a ultrasuoni medicali — !«メールアドレス», punteggio 58, 2026-06-18, https://www.theregister.com (articolo originale su The Register). Correlati: blog ufficiale Midjourney https://midjourney.com/medical/blogpost (!hackernews, punteggio 2, 2026-06-18), reazione sarcastica “Midjourney AI pivots to Theranos” su !techtakes, punteggio 40, 2026-06-19, https://pivot-to-ai.com/2026/06/19
  2. Midjourney chiede agli studi di Hollywood di divulgare il loro uso dell’AI — !«メールアドレス», punteggio 73, 2026-07-05, https://techcrunch.com/2026/07/04
  3. Runway: “il business enterprise raddoppia, NRR oltre il 300%” — !ai_reddit, punteggio 0, 2026-08-30, https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/ (ripubblicazione Lemmy)
  4. Rilascio Qwen-Image-2.0: forte riduzione dei parametri da 20B a 7B, generazione ed editing unificati, supera Nano Banana nella valutazione Elo (pesi attesi a breve) — !«メールアドレス», punteggio 12, 2026-02-12, https://files.catbox.moe/l3mzzs.jpg (crosspost anche in !LocalLLaMA, !Aii e !artificial_intel)
  5. Wan Animate 2 disponibile in ComfyUI — !«メールアドレス», punteggio 8, 2026-08-08, https://blog.comfy.org/p/wan-animate-2-is-now-available-in
  6. Supporto Day-0 per LTX-2.5 in ComfyUI — !«メールアドレス», punteggio 5, 2026-08-12, https://blog.comfy.org/p/ltx-25-day-0-support-in-comfyui
  7. Trellis.2 e Pixal3D, modelli di generazione 3D, ricevono supporto nativo in ComfyUI — !«メールアドレス», punteggio 4, 2026-09-01, https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
  8. L’ecosistema MiniMax-H3, modello video open-weight, si espande rapidamente — oltre 10 post in !«メールアドレス» dal 08-08 al 09-05. Estratti: versione GGUF quantizzata (21,6GB→8,9GB, punteggio 10, https://huggingface.co/Abiray/MiniMax-H3-Pruned-GGUF) / LoRA di accelerazione 4–8 step (punteggio 6–7, https://huggingface.co/lightx2v/Minimax-h3-Turbo) / supporto a video fino a 120 secondi con sincronizzazione audio (punteggio 5, https://huggingface.co/Smite79/MiniMax-H3-Longvideos) / implementazione hybrid attention (punteggio 3, https://github.com/Saganaki22/ComfyUI-VDN-H3, 2026-09-05)
  9. Nodi GPU-native per miglioramento della qualità video (ComfyUI-AetherScale, DLSS5 Visual Enhancer) — !«メールアドレス», punteggio 5, 2026-09-01/09-05, https://github.com/vizart-vj/ComfyUI-AetherScale · https://github.com/Merserk/dlss5-visual-enhancer
  10. Con MCP per Claude, oltre 30 modelli di immagini/video da un’unica chat; lo stesso progetto ridotto da 2,5 ore a 50 minuti — !ai_reddit, punteggio 1, 2026-05-01, https://i.redd.it/6gqfafpaukyg1.png
Segnali
  • Il lato open source è interamente incentrato su ComfyUI/HuggingFace e sulle “notizie di implementazione”. Più degli annunci di modelli in sé, la maggior parte dei post riguarda “X è arrivato in ComfyUI”, “è uscita una LoRA” o “è arrivata una versione quantizzata”. Lo sviluppo degli strumenti attorno al modello video MiniMax-H3 è oggi il campo di battaglia principale.
  • La generazione 3D (Trellis.2, Pixal3D) sta iniziando a integrarsi in ComfyUI, acquisendo presenza come nuovo oggetto generativo dopo immagini e video.
  • Sul lato closed-source, Lemmy tende a trattare il tema come critica o scandalo, non come notizia di prodotto. Il passaggio di Midjourney a dispositivi medici ha avuto maggiore diffusione nelle comunità tech generali e sarcastiche (punteggi 58, 73, 40) che tra le comunità di generative AI.
  • Le menzioni di Nano Banana su Lemmy compaiono quasi soltanto nel contesto “un modello open source lo ha superato”, non come informazione primaria proveniente da Google.
  • Nel periodo osservato, nell’ultimo mese, non sono emerse menzioni dirette di Sora, Veo, Kling, Hailuo, Seedream/Seedance o versioni recenti di Adobe Firefly; i post su Adobe Firefly più recenti risalivano al 2025.
Limiti
  • Lemmy è piccolo e le discussioni specializzate su AI per immagini/video sono quasi interamente concentrate in !«メールアドレス». Le ricerche trasversali su altre istanze (lemmy.ml, lemm.ee, lemmy.zip e altre) hanno prodotto per lo più duplicati o risultati non pertinenti.
  • La ricerca full-text (/api/v3/search) gestisce debolmente il fuzzy match; con nomi brevi come “Sora” e “Veo” sono emersi soprattutto risultati irrilevanti, come nomi di persone o altri servizi. Sia l’API sia il web search non hanno trovato post originari Lemmy su OpenAI Sora, Google Veo, Kling AI, Hailuo o ByteDance Seedream/Seedance. Questo probabilmente indica un limite di ricerca e copertura, non assenza di discussione.
  • Il post su Qwen-Image-2.0 è del febbraio 2026 e non rientra nell’ultimo mese, ma è stato mantenuto perché utile come asse di confronto tra open e closed source.
  • I post su Runway e Claude MCP non sono originari di Lemmy, ma ripubblicazioni da Reddit (!ai_reddit); la fonte primaria è Reddit.

Pinterest

Pinterest — Notizie sull’AI per la generazione di immagini e video

Con la query “Image and Video Generation AI News” sono stati raccolti 50 pin Pinterest (output/pinterest.pins.md, un’unica ricerca senza divisione per genere). Sono state esaminate tutte le 50 immagini.

Temi visivi
  • AI come simbolo di robot umanoide bianco/cyborg: indipendentemente dalla reale natura dell’AI generativa, robot umanoidi bianchi e volti ibridi umano-robot vengono ripetutamente usati come sinonimo visivo di “AI” ([2, 19, 30, 35, 37, 40, 43, 44, 46, 48]). Le miniature dei pin di notizie e spiegazioni convergono quasi tutte su questo motivo.
  • Dominano palette cyber al neon su blu navy: la maggioranza è composta da infografiche in stile template che combinano glow ciano, viola e magenta, pattern da circuito e fondi scuri ([3, 5, 6, 7, 10, 13, 17, 18, 19, 21, 29, 32, 34, 39, 42, 44, 46, 48, 49]). Quasi non compaiono fotografia reale o elementi disegnati a mano; sembrano design prodotti in serie con Canva o stock asset.
  • Le liste-rank “best AI tool” sono il fulcro del genere: tabelle comparative e immagini in classifica che allineano i loghi di Runway, Pika, Kling AI, Luma AI (Dream Machine), Synthesia, HeyGen, InVideo AI, Kaiber, Adobe Firefly, ChatGPT Plus, Midjourney e Canva AI ricorrono continuamente ([9, 16, 20, 24, 38, 42]). [16] e [24] hanno contenuto pressoché identico, Best Quality/Best Free, dimostrando il riuso dello stesso template da parte di più autori.
  • Infografiche di notizie e riepiloghi rapidi: molti pin riassumono “le notizie AI della settimana” con layout da quotidiano o banner “Breaking News” ([11, 12, 21, 29, 32, 33, 39, 43, 47, 50]). Spesso le date sono incorporate nell’immagine e convivono nello stesso risultato immagini “urgenti” di momenti diversi, ad esempio 30 giugno 2025 [29], 20 maggio 2026 [21] e 15 agosto 2026 [32].
  • Pochi pin mostrano output reali o demo video: mentre quasi tutti sono immagini di marketing basate su loghi e testo, solo circa un decimo dei 50 pin presenta esempi reali: reel ufficiale di Google Veo 2 [8], griglia di trasformazioni stilistiche probabilmente Luma (persona→intaglio in legno/origami/Lego/fiori) [4], demo Microsoft VASA-1 da immagine singola e audio [22], esempio image-to-video con personaggio mostro viola coerente [26], e ritratto fotorealistico di un anziano pescatore realizzato con AMD Amuse [41].
  • Tema del dubbio e del rilevamento: “è reale? è AI?”: foto di gatto con timbro FAKE e robot [2], quiz fotografico montano “Which is AI?” [15], rilevamento voce AI al 97% [18], lista pro/contro “i video AI sono buoni o cattivi?” [23] e insegna al neon “tutti usano l’AI nel modo sbagliato” [46] mostrano una presenza costante di contenuti che alimentano scetticismo e verifica dell’autenticità.
  • Mescolanza tra fotografie di celebrità reali e immagini AI “in stile celebrità”: nell’elenco dei pin, foto reali del CEO Nvidia Jensen Huang sul palco [45] e miniature YouTube con una figura simile a Sam Altman [33] convivono con un annuncio Fiverr che usa un volto generato in stile Bezos [36], rendendo difficile distinguere visivamente fotografia reale e output AI.
  • Le menzioni dell’open source sono rarissime: gli strumenti closed-source (Veo, Sora, ChatGPT, Midjourney, Runway e altri) sono di gran lunga predominanti. Solo due contenuti menzionano open source o generazione locale: una pagina di notizie su Baidu “Ernie 4.5” open source [29] e il tool locale per GPU AMD “Amuse 3.0” [41]. Non emergono pin che richiamino la comunità OSS di Stable Diffusion, ComfyUI o LoRA.
Pin notevoli
  • [4] (senza titolo/griglia di trasformazioni stilistiche in stile Lumalabs) — Confronta fotogrammi video trasformati in “intaglio in legno”, “origami”, “mattoncini Lego” e “fiori”, applicando le stesse trasformazioni anche a cani e auto Tesla. È la demo tecnica più concreta.
  • [8] Google Unveils Veo 2 — Collage di materiali promozionali ufficiali: donna al microscopio, persona che nuota sott’acqua, ballerina che disegna costellazioni, ragazza anime in cucina e stormo di fenicotteri. Mostra direttamente l’ampiezza espressiva di Veo 2.
  • [9] 6+ Best AI Video Generation Websites — Infografica da salvare che organizza Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI per funzione e utente target, con invito “Save this pin”, tipico della fruizione Pinterest.
  • [16] AI Image Video: Best Quality vs Best Free — Confronto tra 10 strumenti a pagamento e 10 gratuiti, organizzato per casi d’uso. È quasi identico a [24], confermando la diffusione di template ripetuti.
  • [22] VASA-1 (Microsoft) — Diagramma dimostrativo di ricerca che genera volti parlanti con diverse espressioni da una singola immagine, un clip audio e segnali di controllo arbitrari. Tra i pin tecnici è il più vicino alla ricerca accademica.
  • [27] Vidu S1 — Immagine cyberpunk molto vistosa del modello cinese di ShengShu Technology per interazioni AI in tempo reale; segnala la presenza dei modelli video cinesi.
  • [29] AI NEWS (stile quotidiano, 2025-06-30) — Uno dei pochi pin vicini a informazioni primarie: riassume l’open sourcing di Baidu Ernie 4.5, il prestito di TPU Google a OpenAI e l’investimento Meta di 14,3 miliardi di dollari in Scale AI.
  • [38] Top 10 Image-to-Video Generator Tools — Elenca in classifica Runway Gen-3, Kling, Google Veo, OpenAI Sora, Luma AI, Pika Labs, Kaiber AI, Synthesia, HeyGen, Adobe Firefly e InVideo AI. Offre una buona panoramica dei principali attori.
  • [41] Amuse 3.0 (AMD) — Usa il ritratto fotorealistico di un anziano pescatore per promuovere la qualità di un tool AI artistico locale su GPU AMD, uno dei pochi esempi open source/generazione locale.
  • [50] This Week's Top AI Developments — Riassume sviluppi recenti basati su statistiche: studio Google su 15 milioni di chat (86% dell’uso fuori dal lavoro), rimozione dei limiti ChatGPT e risultato di un concorso in cui l’AI ha battuto 458 squadre su 526.
Segnali
  • Ciò che appare oggi: su Pinterest, “Image and Video Generation AI” è a tutti gli effetti un mercato SEO/affiliati di liste comparative di strumenti e infografiche riepilogative. Runway, Pika, Kling AI, Luma AI, Synthesia, HeyGen, InVideo AI, Adobe Firefly e Google Veo ricorrono costantemente in alto e sono percepiti come il set standard degli strumenti video AI closed-source.
  • Riuso dello stesso template: il fatto che [16] e [24] siano di fatto la stessa immagine suggerisce che i contenuti Pinterest di confronto tra strumenti AI vengano probabilmente prodotti in massa e ripubblicati da più account a partire da pochi template.
  • Assenza dell’open source: gli unici esempi direttamente utili alla richiesta di seguire l’open source sono [29] (Baidu Ernie 4.5) e [41] (AMD Amuse 3.0). Non compaiono immagini legate a Stable Diffusion, ComfyUI o Hugging Face. I risultati Pinterest favoriscono prodotti visivamente attraenti e marketing, poco compatibili con i post delle comunità tecniche open source.
  • Prevalgono immagini di spiegazione, confronto e provocazione, non produzioni reali: solo circa un decimo dei 50 pin mette al centro veri output di immagini/video AI; la maggior parte è composta da infografiche e liste testuali. Su Pinterest sembrano diffondersi più facilmente i contenuti che aiutano a decidere “quale strumento scegliere” rispetto a esempi concreti di trasformazione creativa.
Limiti
  • In questa fase sono state lette solo immagini Pinterest raccolte preventivamente dal worker (images/pinterest/manifest.json, 50 elementi, singola query senza divisione per genere), senza navigare Pinterest direttamente. Una nuova ricerca con keyword aggiuntive, come “open source AI art” o “Stable Diffusion”, avrebbe potuto trovare più pin orientati all’open source.
  • Le date incorporate nelle immagini dei pin (2025-06-30, 2026-05-20, 2026-08-15 e altre) indicano soltanto quando è stato creato il template; manifest.json non permette di sapere quando il contenuto è stato effettivamente pubblicato o salvato su Pinterest.
  • Alcuni testi incorporati nelle immagini, fra cui [12], [15], [21], [23] e [29], risultavano poco nitidi; sono quindi riassunti, non citazioni precise. Alcuni errori come “Human Journalism” e “Machine-Genertsd Media” appartengono al template stesso.
  • Cinque pin hanno titolo vuoto (parte di [12], [15], [21], [29], [35]) e sono stati classificati in base al contenuto dell’immagine.

Azioni consigliate

  • Continuare a confrontare GPT-6 Astra con Fable 5.1 sull’asse del “controllo agentico”, oltre che sulla qualità.
  • Continuare a monitorare l’ecosistema ComfyUI di MiniMax-H3 (quantizzazione GGUF e Turbo LoRA).
  • Nella prossima ricerca su X, non affidarsi alle tendenze Explore e cercare esplicitamente Stable Diffusion, Wan, Flux, Qwen e altri termini specifici open source.
  • Dare priorità a !«メールアドレス» su Lemmy come fonte primaria open source.
  • Non usare Pinterest per seguire l’open source; limitarlo all’osservazione del marketing degli strumenti closed-source.
  • Verificare se esistono strumenti esterni dipendenti dalla chiusura della Sora API prevista per il 2026-09-24.

Immagini raccolte

Image to Video AI: How It Works and Why It Matters - The Data ScientistAI content and social media concerns🎨 AI Image and Video CreationGoogle announces ultra-high quality video...The Ultimate AI Image and Video Generation Platform - The Data ScientistAi Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoAI Video Content Creation: High earners,...Google Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic FeaturesJust Nail It 🎥️ Image to Video AI – Animate Your Photos With AIAI News: OpenAI Finally Released What We Asked ForimageVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APITop AI Video Generators of 2025imageAI For Image And video GenerationMore than 20% of YouTube is now AI-generated‎🚨 AI is getting scary good.AI driven image and video analysisai toolsimageMicrosoft Unveils VASA-1, Setting New Standards for Generative AI in Video GenerationAI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥🚀10 Best AI Image & Video Tools in 2026 | Free vs Paid AI Tools ComparisonWhat is Imagvio AI and how it helps creators...Google announces video generation AI 'Veo 3',...ShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI VideoTransform your ideas into stunning visuals! 🎥image"Transform Your Vision with Personalized AI-Powered 4K Videos 🎥✨"Mastering Video and AI: Key Social Media Marketing Trends 2025This Week in AI News - Aug 15 2026GPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWShistory generative AIimageI will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoAiVideo generation 📹AI News & Latest Updates | Artificial Intelligence Trends & Breakthroughsimage'Amuse 3.0', an AI art creation tool that includes...AI Video Creation: Complete Guide to Create Professional Videos Faster with AI"Why AI Chatbots Fail at Keeping Up with Breaking News"Professional AI Video Creation | Cinematic AI Videos | Custom Video EditingNvidia #NEW AI Tools 🤯 #news #ai #openai #chatgpt #highlights #shortsStop scrolling… this story will completely change how you see AI!How To Create A News Channel With AI || AI News Video Generator || AI Lip SyncTop AI Tools Every YouTuber Uses in 2026 | Best AI for YouTube CreatorsAI Video Generator Market Growth 2025–2032: Transforming the Future of Video Creation 🎥🤖This Week's Top AI Developments - Google 15 Million Chats Study

Nota sulla qualità dei dati

Reddit è rimasto a 12 thread pre-raccolti, sotto l’obiettivo di circa 20, poiché WebFetch non era disponibile; su X la maggioranza delle tendenze Explore era irrilevante e non sono state fatte ricerche open source; Bluesky ha restituito 403 nella ricerca full-text e ha richiesto una raccolta alternativa; Lemmy non ha restituito post primari closed-source; Pinterest ha usato soltanto una query generale e non una ricerca dedicata all’open source.

Galleria