技術2026年5月1日(金)更新約11分Qwen-ScopeはQwen内部特徴を推論制御やデータ合成に使うSAEスイートQwenチームがQwen3/Qwen3.5向けのSparse AutoencoderスイートQwen-Scopeを公開した。14グループのSAEで、推論時ステアリング、評価分析、毒性分類、データ合成、学習改善までを狙う。AILLMQwen解釈可能性AIセーフティ
技術2026年4月30日(木)更新約9分NIIの48,000時間音声音響データセットはTTSの材料になるNII/LLMCが公開したCC AudioとArchive.org Audio Datasetを、URLリスト、メタデータ、TTS学習、Embedding解析の違いから読む。AI音声AI音声合成音声認識TTSSTTLLM機械学習
技術2026年4月30日(木)更新約11分mflux vs iris.cでFLUX.2 Klein 4Bを動かしたM1 MaxベンチFLUX.2 Klein 4BをM1 Max 64GB上で、mflux(MLX)とiris.c(純C+Metal)の2系統で実機ベンチ。Pruna AIのH100前提チュートリアルへのカウンターとして、Apple Siliconで何秒で出るかを実測した。AI画像生成FLUXApple SiliconMacMLX実験
技術2026年4月30日(木)約10分信頼度スコアで文書抽出の人手確認を絞るフィールド単位の信頼度スコアで人手確認を絞る設計と、freee MCPで仕訳自動化を試して踏んだOCR・閾値の壁。AIOCRVLMMCPAIエージェントAPI
技術2026年4月30日(木)約8分Xiaomi MiMo-V2.5はMacやROCmで動かせるのかXiaomi MiMo-V2.5のウェイト公開後、Mac/ROCmとクラウドGPU(RunPod/GCE)での実行可否を調べた。手元機ではまだ厳しいが、RunPodの4x H200で約14ドル/時間、GCE SpotのH100なら約1.6ドル/時間で動かせる。AILLMローカルLLMXiaomiMoEApple SiliconROCmllama.cpp
技術2026年4月29日(水)更新約13分Z-AnimeはZ-Image系のアニメ特化フルファインチューンだったSeeSee21/Z-AnimeがZ-Image Baseのフルファインチューンであることを確認し、AIO版をM1 Max 64GBのローカルComfyUIで動かしてt2i・i2i・NSFW通り具合まで検証した。AI画像生成Z-ImageComfyUIApple Silicon実験
技術2026年4月29日(水)約14分AIイラストを漫画モノクロに変換するときグレスケではなくスクリーントーンにしたい話カラーのアニメ系AIイラストを漫画原稿風のモノクロへ変換する検証ログ。AI再生成系は色残りか顔変化のどちらかに寄り、決定論的なローカル処理だけだと機械的に見える。次に試すべき方向(Anima にグレスケ専用LoRAを載せる案、See-throughで部位分離してから機械合成する案)まで整理する。AI画像生成ComfyUILoRA漫画スクリーントーン実験Apple SiliconSDXLQwenZ-ImageAnima
技術2026年4月28日(火)約6分Sarashina2.2-TTSは日本語寄りのゼロショット音声合成モデルSB Intuitionsが公開したsarashina2.2-ttsを調べた。日本語中心のLLMベースTTSで、短い参照音声から話者・話し方を再現し、日英生成やコードスイッチにも対応する。AITTS音声合成LLMボイスクローン
技術2026年4月28日(火)約8分Cosmic、Sanity、Hygraph AIの実装比較Cosmic、Sanity、HygraphのAI CMS機能を、エージェント実行、MCP接続、編集ワークフローの3層で比較する。原典の比較記事で古くなっているHygraphの扱いも公式情報で補正した。AICMSMCP
技術2026年4月27日(月)約17分WAI-Anima向けキャラLoRAを公式推奨の12,000ステップまで延ばしたら逆に方向制御が悪化、半分のep150で100%出るようになったv3 のキャプション据え置きで学習量だけ Anima 公式推奨の 12,000+ ステップまで増やしたら、ep150〜180 で方向ヒット率 100%、ep200 で 0% に急落、ep227 で 67% まで部分回復、という非単調な曲線が出た。1枚あたり露出 600〜720 回が sweet spot、800 回超で catastrophic forgetting。learning_rate 2e-5、約11時間 / $10 のRunPod学習と sweet spot エポックスキャンを記録。LoRAAI画像生成AnimaWAI-AnimaRunPodQwen実験
技術2026年4月27日(月)約7分YourMemoryは生物学的減衰でAIメモリの古い文脈を捨てるsachitrafa/YourMemoryを調べた。Ebbinghaus忘却曲線、BM25、ベクトル検索、グラフ展開を組み合わせたローカルMCPメモリで、LoCoMo-10のRecall@5は現在59%とされている。AIAIエージェントMCPRAGClaude Codeトークン管理
技術2026年4月27日(月)約6分LLaDA2.0-Uniは拡散LLMで画像理解と生成を一本化したオープンモデルInclusion AIがLLaDA2.0-Uniを公開した。16B MoEの拡散LLMを中核に、画像理解、1024px画像生成、画像編集、テキストと画像の交互生成を単一モデルで扱う。AILLM画像生成VLMMoEオープンモデル拡散モデル