技術2026年6月26日(金)約12分Radeon 8060S(EVO-X2 / ROCm)でFastWanとWan 14Bを実走 ZLUDAは諦めてTheRockのgfx1151ホイールで動かしたAMD Radeon 8060S(EVO-X2 / Strix Halo / 48GB UMA)でローカルWan動画生成を実走。ZLUDAは公式PyTorchと非互換で全滅し、AMD TheRockのgfx1151ホイールでネイティブROCmが動いた。FastWan 1.3Bは4分、Wan 14B I2Vは13.6分、ボトルネックはVAEデコードと16GB RAMのSegfault。AI動画生成WanROCmAMDPyTorch実験
技術2026年6月25日(木)約8分ノートPCのRTX 4060 8GBでローカル動画生成はやれるのか FramePack F1実走でVRAMでなくRAMの壁に当たったRTX 4060 Laptop 8GBでFramePack F1を実走。VRAMは5.75GBしか使わないのに、26GBのモデルが32GB RAMに収まらずページファイルへ溢れ、5秒の生成に56分かかった。ノートPCでローカル動画生成をやるときの本当のボトルネックはVRAMでなくRAM、という実機検証。AI動画生成WanCUDA実験
技術2026年5月19日(火)約9分ByteDance Lanceは3Bで画像と動画の理解・生成・編集をまとめたApache 2.0モデルByteDanceのLanceを一次情報で確認。3Bの統合マルチモーダルモデルで、画像・動画の理解、生成、編集を1つのCLIから扱える一方、推論には40GB以上のVRAMが要求される。AIマルチモーダル画像生成動画生成VLMオープンソースHuggingFace
技術2026年4月27日(月)更新約7分HappyHorseはローカルで動かせるのかAlibaba ATHの動画生成モデルHappyHorse-1.0について、Model StudioでのAPIテスト、公開ウェイトの有無、Macローカル実行の現実性、RunPodで試すならどのGPUを見るかを整理した。AI動画生成RunPodWanLTX-2
技術2026年3月7日(土)約5分WAN 2.2をRTX 4060(VRAM 8GB)のComfyUIで動かすRTX 4060 VRAM 8GBのWindows環境でWAN 2.2のI2V動画生成を試した。5B fp8は品質が厳しく、14B Rapid蒸留モデルのlowvramオフロードが現実的な解だった。AI動画生成WanComfyUIWindowsCUDA実験
技術2026年3月1日(日)更新約13分LTX-2とWan 2.2をM1 Max 64GBで動かせるのか調べて動かしたLTX-2とWan 2.2をM1 Max 64GBで動かした。FP8はMetal非対応、GGUF形式で回避。Wan 2.2は2秒に82分。LTX-2は公式パイプラインがMPSでNaNを出し、KSampler代替でも品質が実用に達しない。AI動画生成LTX-2WanApple Silicon実験
技術2026年2月28日(土)更新約6分Seedance 2.0がハリウッドに著作権で詰められてAPI無期限停止になったSeedance 2.0のリリース直後にハリウッドのIP侵害が大量発生。Disney・Netflix・Paramountらがcease-and-desistを送付し、API公開は無期限延期、顔クローンや人物リファレンス機能も停止された。AI動画生成Seedance著作権
技術2026年2月19日(木)更新約5分Seedance 2.0 APIとComfyUI連携の現状Seedance 2.0のAPIは2026年2月時点で未公開。API公開後のComfyUI連携の見通しと準備事項をまとめた。AI動画生成ComfyUIAPISeedance
技術2026年2月8日(日)更新約7分Seedance 2.0が出たので、ローカル動画生成とクラウドの「楽さ」を比べてみるByteDanceのSeedance 2.0がDreaminaで公開された。ローカルでWan 2.xやComfyUIを触ってきた視点から、クラウド動画生成サービスとの楽さの違いを考えた。AI動画生成Seedance
技術2026年2月4日(水)更新約3分InfiniteTalk: Wan 2.1ベースの音声駆動リップシンクComfyUI公式ワークフローとして公開されたInfiniteTalkは、音声ファイルから口パク動画を生成するリップシンク特化モデル。MOVAやVidu Q3との違い、必要なモデル構成をまとめた。AI動画生成ComfyUIリップシンク
技術2026年2月4日(水)約3分AnimeGamer: ゲーム状態を理解してアニメ動画を生成するAITencent ARC Labが開発したAnimeGamerは、ゲームの状態遷移を理解しながらアニメスタイルの動画を生成する。汎用動画生成AIとは異なるアプローチ。AI動画生成ゲームアニメ
技術2026年2月3日(火)約3分MOVA: オープンソース初の映像・音声同時生成モデルOpenMOSSチームが公開したMOVA-720pは、動画と音声を1回の推論で同時生成するオープンソースモデル。Vidu Q3などクローズドモデルとの違い、アーキテクチャの特徴をまとめた。AI動画生成音声生成オープンソース