技術2026年2月12日(木)MioTTS - コーデックから自作した軽量LLMベースTTSAratakoが公開したMioTTS。独自コーデックMioCodecからフルスクラッチ開発された0.1B〜2.6Bの日英対応TTSモデル群。llama.cppやOllamaでそのまま動く設計が特徴的。AITTS音声合成オープンソースLLM
技術2026年2月11日(水)更新Mac M1 MaxでLoRA学習に13回全敗してからRunPodで成功するまでMac Studio M1 Max 64GBでIllustrious-XLのLoRA学習に13回挑んで全敗。Antigravity、Claude、Geminiなど複数AIエージェントの力を借りて原因を特定し、RunPod RTX 4090で最終的に成功した全記録。致命的だった3パラメータとsd-scripts直叩きの罠。Stable DiffusionLoRAMacAI実験
技術2026年2月10日(火)ActionMesh - 動画からアニメーション付き3Dメッシュを生成するMeta AIのモデルMeta AI Researchが公開したActionMeshを調査。動画を入力するとBlenderやUnityで使える.glb形式のアニメーション付き3Dメッシュが出力される。入力制限や実行環境、AI動画生成との組み合わせなど実用面を整理した。AI3DBlender
技術2026年2月9日(月)Claude Code ベストプラクティス集リポジトリの紹介と実践ガイドGitHub で1,500スターを超えた claude-code-best-practice リポジトリを深掘り。CLAUDE.md の書き方、Command→Agent→Skills の3層アーキテクチャ、Hooks による通知、RPI ワークフローなど、開発現場で使えるノウハウを整理した。Claude CodeAI開発ツール
技術2026年2月8日(日)更新LFM2.5 — Transformerでもない、MambaでもないハイブリッドアーキテクチャLiquid AIのLFM2.5は、短距離畳み込みとAttentionのハイブリッドで、SSMを使わずにエッジ最適化を実現した。アーキテクチャの仕組み、ベンチマーク、コミュニティ活用例をまとめた。AILLMエッジAIアーキテクチャ
技術2026年2月8日(日)更新Seedance 2.0が出たので、ローカル動画生成とクラウドの「楽さ」を比べてみるByteDanceのSeedance 2.0がDreaminaで公開された。ローカルでWan 2.xやComfyUIを触ってきた視点から、クラウド動画生成サービスとの楽さの違いを考えた。AI動画生成Seedance
技術2026年2月7日(土)Qwen3-TTS - pip一発で使えるオープンソース音声合成Alibaba Qwenチームが公開したQwen3-TTSの技術解説。pip install一発でセットアップ完了、3秒のボイスクローン、自然言語での声デザイン、日本語含む10言語対応。Apache 2.0ライセンス。AITTS音声合成オープンソースLLM
技術2026年2月6日(金)UltraFlux-v1 — FLUX.1-devベースのネイティブ4K画像生成モデルFLUX.1-devを4K生成に特化させたUltraFlux-v1の技術詳細。Z-ImageやFLUX.2 Kleinとのアプローチの違い、独自のRoPE拡張やVAE改良、実用面での注意点をまとめた。AI画像生成FLUX4K
技術2026年2月6日(金)Qwen3-Omni: 3BアクティブのMoEでテキスト・画像・音声・動画を統合処理するオムニモーダルモデルAlibabaが公開したQwen3-Omni-30B-A3Bの技術解説。30Bパラメータ中3Bのみアクティベートするオムニモーダルモデルで、テキスト・画像・音声・動画の入力から音声付きで応答する。Thinker-Talkerアーキテクチャ、ベンチマーク、Qwen3 MoEファミリーの全体像を整理した。AILLMオープンソースマルチモーダル音声AI
技術2026年2月6日(金)更新アニメ画像生成モデルAnima(2B)をNoobAI/Illustrious/Z-Imageと比較、Cosmos-Predict2ベースだがプレビュー版の制約多数CircleStone Labs × Comfy Org が開発したCosmos-Predict2ベースの2Bアニメ画像生成モデル Anima のリリース直後評価。7GBで動く軽量さは利点だがSDXLより10倍遅く、手の崩壊やテキストエンコーダ(Qwen3 0.6B)の弱さ、ControlNet未対応、LoRAエコシステム不在で、現状はNoobAI/Illustriousから移行する理由が薄い。AI画像生成ComfyUIQwenAnima
技術2026年2月5日(木)UI-TARS-1.5-7B: GUIグラウンディングでSOTAを達成したVision AIエージェントByteDanceが公開したUI-TARS-1.5-7Bの技術解説。スクリーンショットからGUI要素を特定する精度でOpenAI CUAやClaude 3.7を大幅に上回る。デスクトップアプリも提供され、ローカルで動作可能。AILLMエージェントオープンソース
技術2026年2月4日(水)Qwen3-Coder-Next: 3Bアクティブパラメータでローカル動作するコーディングエージェントAlibabaが公開したQwen3-Coder-Nextの技術解説。80Bパラメータながら3Bのみアクティベートする超効率MoEで、RTX 4090単体でも動作。SWE-Bench 70%超えの実力をローカルで。AILLMオープンソースエージェント