技術2026年5月13日(水)約9分VoxCPM2含めOSS TTSが7方向に割れてきたVoxCPM2のtokenizer-free方式を起点に、F5-TTSやCosyVoice2など7モデルの方向の違い、Irodori-TTSやStyle-Bert-VITS2など日本語特化TTSの位置づけ、台本+OpenJTalkで音素を作る学習データの仕組み、ボイスクローン悪用リスクまでを整理した。AITTS音声合成ボイスクローンローカルAIオープンソースファインチューニング
技術2026年5月12日(火)約13分WordPress 7.0直前でAI基盤は残りリアルタイム共同編集は見送りWordPress 7.0(5月20日予定)からリアルタイム共同編集が外れ、AI Client・Connectors API・PHP-only block registrationが残った。wp_ai_client_prompt()のコード例とfunctions.phpの実装パターン、保存戦略ベンチマークで約52%高速化でも見送った経緯を扱うWordPressAICMSPHPAPI
技術2026年5月11日(月)更新約9分Gemini API File Searchのマルチモーダル化はゲームNPCの記憶にも使えそうGemini API File Searchがマルチモーダル対応し、画像とテキストを同じstoreで検索できるようになった。metadata filterでNPC記憶を章やキャラで絞り込める点と、1キャラ月$1未満の料金試算からゲーム用途の実用性を見る。AIGeminiRAGAPIゲーム
技術2026年5月11日(月)約6分山火事避難AIの蒸留は制約を学習に混ぜる話だった山火事避難ルーティングAIで、通行止めやAQI制約を後処理ではなく蒸留ロスに入れる手法。ルールエンジンとの違い、画像を見ない生徒モデルの限界、エッジ推論23msの実用性を検討したAI機械学習マルチモーダルリアルタイム
技術2026年5月9日(土)約6分Fortress Token OptimizerはLLM API送信前の冗長プロンプトを11%前後削るFortress Token OptimizerのDEV記事と実装周辺を確認した。会話調プロンプトでは11〜22%削れるが、system promptやRAG文脈で雑に挟むと意味のある制約まで削る危険がある。AILLMAPIAPIコストトークン管理
技術2026年5月8日(金)約7分IFしか知らない人が3か月でCivicSurvivalを作れた理由DEVのCivicSurvival開発記録を読んだ。158K行のCities: Skylines II modを支えたのはAIへの丸投げではなく、CivicRAG、300超のRoslyn analyzer、ビルド失敗、目視確認でAIを縛る運用だった。AIAIエージェントClaude CodeMCPRAGゲーム
技術2026年5月8日(金)約10分FLUX.2 Klein 9B + 9B NSFW LoRAをM1 Max 64GB / mflux 0.17.5で実機検証するM1 Max 64GBでFLUX.2 Klein 9B + diroverflo/FLux_Klein_9B_NSFWを実際に動かした記録。NSFWプロンプトで実際にNSFW画像が出ることまで確認。4bit量子化で512は1分51秒、1024は5分37秒、LoRAのオーバーヘッドはほぼゼロAI画像生成FLUXApple SiliconMacMLXLoRA実験
技術2026年5月8日(金)約11分AIが同じ好みを聞き返すならVektor Memoryのsupersession chainsを見るVektor Memory v1.5.4のsupersession chainsを読む。意味的近傍で古い好みを退役させる仕組みを、YourMemoryの時間減衰、Cloudflareのキー上書き、CTXの取り出し分けと並べて整理し、自前エージェント(かなチャットのHeartbeatメモリ)への最小実装まで落とす。AIAIエージェントRAGMCPトークン管理Node.js
技術2026年5月7日(木)約10分エージェントメモリは記憶ではなくメモという論文を読んだarXiv:2604.27707の主張を、CTXやOCR-Memoryのような検索系メモリと並べて読む。RAG、vector store、scratchpadは便利な検索棚だが、経験からルールを重みに畳み込む学習とは別物だ。AIAIエージェントRAGトークン管理AIセーフティ論文
技術2026年5月7日(木)約7分Gemma 4 MTP drafterをM1 Max 64GBで実測、26B A4Bだけ速くなって31BとE4Bは遅くなったM1 Max 64GB + mlx-vlm 0.5.0でGemma 4 MTP drafterを実測。26B A4B (MoE) だけ+13%速くなり、公式が一番効くと言った31B DenseとE4Bは逆に遅くなった。コード生成と短文haikuで結論が反転する。AILLMGoogleGemmaローカルLLM推論MLX実験
技術2026年5月7日(木)約9分人間とLLMの共著テキスト境界を変化点検出で切るarXiv論文を読んで最小実装を試したarXiv:2605.03723の人間・LLM共著テキスト分割手法をM1 MaxとQwen3-8B-Baseで動かした。重み付きCUSUMは標準Pythonで動くが、生log-likelihoodだと人間文単独でも境界が量産される。AILLMAIセーフティ論文Python実験Qwen
技術2026年5月6日(水)約13分LLMを温かみのある応答にチューニングしても協調的ペルソナを与えてもユーザーの誤った意見に同意しやすくなるという2論文Oxford Internet Institute(Nature 2026採録)の温かさファインチューニング実験と、Shahら arXiv 2604.10733の275ペルソナ協調性実験を並べる。ファインチューニングでもペルソナでも、ユーザーの感情や誤信念を入れると同じ方向にモデルが倒れる。AILLMAIセーフティ論文紹介OpenAI