技術2026年2月26日(木)約5分RTX 4060 Laptop(8GB)でComfyUI + WAI-Illustriousを動かすComfyUI + WAI-Illustrious v16.0をRTX 4060 Laptop(VRAM 8GB)で動かした。LoRA併用含めlowvram不要で1024x1024が15秒。ComfyUIStable Diffusion画像生成GPU実験
技術2026年2月19日(木)更新約5分Seedance 2.0 APIとComfyUI連携の現状Seedance 2.0のAPIは2026年2月時点で未公開。API公開後のComfyUI連携の見通しと準備事項をまとめた。AI動画生成ComfyUIAPISeedance
技術2026年2月13日(金)更新約5分ComfyUIのUpscaleがMac MPSで壊れる問題をcontiguousで直したLoad Image経由のUpscaleで画像が崩壊する問題を、テンソルのnon-contiguous対策で修正した記録。2026-04-29にComfyUI更新で上書きされて再発したのでPyTorch側の上流issueと再発の経緯も追記。ComfyUIApple SiliconPyTorchMPS実験
技術2026年2月8日(日)約5分ComfyUI公式が出したAIアップスケーリング完全ガイドを読み解くComfyUIが公開した「The Complete AI Upscaling Handbook」の要点をまとめた。保守的・創造的アップスケーリングの違い、用途別のモデル選び、画像・動画それぞれのベンチマークまで網羅。ComfyUI画像生成AI動画生成AIアップスケーリング
技術2026年2月6日(金)更新約6分アニメ画像生成モデルAnima(2B)をNoobAI/Illustrious/Z-Imageと比較、Cosmos-Predict2ベースだがプレビュー版の制約多数CircleStone Labs × Comfy Org が開発したCosmos-Predict2ベースの2Bアニメ画像生成モデル Anima のリリース直後評価。7GBで動く軽量さは利点だがSDXLより10倍遅く、手の崩壊やテキストエンコーダ(Qwen3 0.6B)の弱さ、ControlNet未対応、LoRAエコシステム不在で、現状はNoobAI/Illustriousから移行する理由が薄い。AI画像生成ComfyUIQwenAnima
技術2026年2月4日(水)更新約3分InfiniteTalk: Wan 2.1ベースの音声駆動リップシンクComfyUI公式ワークフローとして公開されたInfiniteTalkは、音声ファイルから口パク動画を生成するリップシンク特化モデル。MOVAやVidu Q3との違い、必要なモデル構成をまとめた。AI動画生成ComfyUIリップシンク
技術2026年2月3日(火)約5分Qwen Image Editでポーズ・角度制御を改善する方法を調べたNunchaku量子化版、VNCCS Pose Studio、公式2511の改善点を比較して、ポーズ・角度制御の改善策を探ったQwenComfyUI画像生成
技術2026年2月3日(火)約4分M1 Max 64GBでQwen Image Edit(NSFW版)をローカル実行するApple Silicon MacでQwen-Rapid-AIO-NSFW v16を動かし、キャラ維持しながらポーズ変更する方法ComfyUIQwenApple Silicon画像生成実験
技術2026年2月3日(火)約4分NovelAI精密参照をローカルで再現する方法を調べた — ComfyUI + IP-AdapterNovelAIの精密参照(キャラ参照+絵柄参照)をComfyUI + IP-Adapterでローカル再現するための下調べ。セットアップ手順とパラメータ設定をまとめた。AI画像生成ComfyUIIP-AdapterNovelAIApple Silicon
技術2026年2月3日(火)約3分TJ_ComfyUI_HashRecorder - 「ブロックチェーン風」著作権保護ツールの実態ComfyUI向けの著作権保護ツールを調べたら、ブロックチェーンと名乗りつつ実態はローカル完結だった話ComfyUIAI著作権
技術2026年2月3日(火)約3分BEYOND_REALITY_Z_IMAGE — Z-Image Turboベースのフォトリアル人物特化モデルModelScopeで公開されているZ-Image Turboの派生チェックポイント。肌のテクスチャとフィルム写真的な美学に特化。M1 Max 64GBでも動作可能。画像生成AIZ-ImageApple SiliconComfyUI
技術2026年2月3日(火)約3分KugelAudio - 7BパラメータのオープンソースTTS(ComfyUI対応)ヨーロッパ24言語対応、ボイスクローン機能付きのText-to-Speech。ElevenLabsを上回るベンチマーク結果を出したオープンソースモデル。ComfyUITTS音声合成AI