技術2026年2月4日(水)ACE-Step 1.5:音楽生成AIがアーキテクチャごと刷新されたACE-Step V1.5がリリースされた。LM+DiTのハイブリッド構成、50言語対応、4GB VRAMで動作など、V1.0から大幅に進化している。AI音楽生成ローカルAI
技術2026年2月4日(水)更新InfiniteTalk: Wan 2.1ベースの音声駆動リップシンクComfyUI公式ワークフローとして公開されたInfiniteTalkは、音声ファイルから口パク動画を生成するリップシンク特化モデル。MOVAやVidu Q3との違い、必要なモデル構成をまとめた。AI動画生成ComfyUIリップシンク
技術2026年2月4日(水)UI UX Pro Max Skill:AIのUI生成を改善するスキルを過去記事と比較してみたClaude Code等のAIコーディングアシスタント向けスキル「UI UX Pro Max Skill」を、過去に書いたUI/UX改善記事と比較。自動推論 vs 人間の意図、どちらのアプローチが効くのか。Claude CodeAIUIUX
技術2026年2月4日(水)AnimeGamer: ゲーム状態を理解してアニメ動画を生成するAITencent ARC Labが開発したAnimeGamerは、ゲームの状態遷移を理解しながらアニメスタイルの動画を生成する。汎用動画生成AIとは異なるアプローチ。AI動画生成ゲームアニメ
技術2026年2月3日(火)MOVA: オープンソース初の映像・音声同時生成モデルOpenMOSSチームが公開したMOVA-720pは、動画と音声を1回の推論で同時生成するオープンソースモデル。Vidu Q3などクローズドモデルとの違い、アーキテクチャの特徴をまとめた。AI動画生成音声生成オープンソース
技術2026年2月3日(火)LingBot-World:Ant Groupがオープンソース化したリアルタイムワールドモデルAnt Group傘下のRobbyantが公開したLingBot-Worldは、1枚の画像からリアルタイムでインタラクティブな映像を生成するワールドモデル。従来の動画生成AIとの違い、技術的特徴、Apple Silicon対応状況を整理した。AI動画生成ワールドモデルロボティクス
技術2026年2月3日(火)NovelAI精密参照をローカルで再現する方法を調べた — ComfyUI + IP-AdapterNovelAIの精密参照(キャラ参照+絵柄参照)をComfyUI + IP-Adapterでローカル再現するための下調べ。セットアップ手順とパラメータ設定をまとめた。AI画像生成ComfyUIIP-AdapterNovelAIApple Silicon
技術2026年2月3日(火)planning-with-files: Manus風プラン管理をClaude Codeに導入するスキルファイルシステムを拡張メモリとして使い、セッション間で計画・調査・進捗を引き継ぐ手法を解説Claude CodeAI
技術2026年2月3日(火)TJ_ComfyUI_HashRecorder - 「ブロックチェーン風」著作権保護ツールの実態ComfyUI向けの著作権保護ツールを調べたら、ブロックチェーンと名乗りつつ実態はローカル完結だった話ComfyUIAI著作権
技術2026年2月3日(火)ACE-Step:ローカルで動く音楽生成AI基盤モデルを調べた音楽版Stable Diffusionを目指すACE-Stepについて、M1 Maxで試す前の下調べとしてまとめた。アーキテクチャ、機能、インストール手順など。AI音楽生成Apple SiliconMacPythonローカルAI
技術2026年2月3日(火)PersonaPlex: NVIDIAのリアルタイム全二重音声対話モデルNVIDIAが2026年1月にリリースしたPersonaPlex-7B-v1の概要。Moshiベースで全二重会話とペルソナ制御を実現した音声対話モデル。AI音声合成音声認識NVIDIAオープンソース
技術2026年2月3日(火)Z-Image-Distilled — 蒸留で高速化しても多様性を維持したZ-Image派生モデルZ-Imageを蒸留で高速化したZ-Image-Distilledの概要。FLUX.1 Schnellとの違い、M1 Max 64GBでの動作、LoRA互換性についてまとめた。AI画像生成Z-ImageApple SiliconLoRA