技術2026年5月14日(木)oMLX 0.3.9.dev2をM1 Max 64GBで実測、SSD KVキャッシュ・Gemma 4 VLM MTP・DFlash・omlx launch copilotM1 Max 64GBにoMLX 0.3.9.dev2を入れて、SSD KVキャッシュ2回目prefill短縮、Gemma 4 VLM MTPオン/オフ、DFlash vs 通常エンジン、omlx launch copilotの実動作を順に測る。VLM入力はWAI-Animaで生成したかなちゃん画像で揃えた。AILLMローカルLLMApple SiliconMLX推論最適化Codex実験
技術2026年5月13日(水)更新oMLX 0.3.9.dev2はMacローカルLLMをCodexやCopilotに寄せてきたoMLX 0.3.9.dev2のリリースノートを読む。Gemma 4 VLMのMTP、DFlash対応、SSD KVキャッシュ、`omlx launch copilot`まわりが、Codex/Copilotなど常駐エージェントをMacローカルLLMに繋ぐ時にどこへ効くかを整理した。AILLMローカルLLMApple SiliconMLX推論最適化Codex
技術2026年5月13日(水)VoxCPM2含めOSS TTSが7方向に割れてきたVoxCPM2のtokenizer-free方式を起点に、F5-TTSやCosyVoice2など7モデルの方向の違い、Irodori-TTSやStyle-Bert-VITS2など日本語特化TTSの位置づけ、台本+OpenJTalkで音素を作る学習データの仕組み、ボイスクローン悪用リスクまでを整理した。AITTS音声合成ボイスクローンローカルAIオープンソースファインチューニング
技術2026年5月12日(火)WordPress 7.0直前でAI基盤は残りリアルタイム共同編集は見送りWordPress 7.0(5月20日予定)からリアルタイム共同編集が外れ、AI Client・Connectors API・PHP-only block registrationが残った。wp_ai_client_prompt()のコード例とfunctions.phpの実装パターン、保存戦略ベンチマークで約52%高速化でも見送った経緯を扱うWordPressAICMSPHPAPI
技術2026年5月11日(月)更新Gemini API File Searchのマルチモーダル化はゲームNPCの記憶にも使えそうGemini API File Searchがマルチモーダル対応し、画像とテキストを同じstoreで検索できるようになった。metadata filterでNPC記憶を章やキャラで絞り込める点と、1キャラ月$1未満の料金試算からゲーム用途の実用性を見る。AIGeminiRAGAPIゲーム
技術2026年5月11日(月)山火事避難AIの蒸留は制約を学習に混ぜる話だった山火事避難ルーティングAIで、通行止めやAQI制約を後処理ではなく蒸留ロスに入れる手法。ルールエンジンとの違い、画像を見ない生徒モデルの限界、エッジ推論23msの実用性を検討したAI機械学習マルチモーダルリアルタイム
技術2026年5月9日(土)Fortress Token OptimizerはLLM API送信前の冗長プロンプトを11%前後削るFortress Token OptimizerのDEV記事と実装周辺を確認した。会話調プロンプトでは11〜22%削れるが、system promptやRAG文脈で雑に挟むと意味のある制約まで削る危険がある。AILLMAPIAPIコストトークン管理
技術2026年5月8日(金)IFしか知らない人が3か月でCivicSurvivalを作れた理由DEVのCivicSurvival開発記録を読んだ。158K行のCities: Skylines II modを支えたのはAIへの丸投げではなく、CivicRAG、300超のRoslyn analyzer、ビルド失敗、目視確認でAIを縛る運用だった。AIAIエージェントClaude CodeMCPRAGゲーム
技術2026年5月8日(金)FLUX.2 Klein 9B + 9B NSFW LoRAをM1 Max 64GB / mflux 0.17.5で実機検証するM1 Max 64GBでFLUX.2 Klein 9B + diroverflo/FLux_Klein_9B_NSFWを実際に動かした記録。NSFWプロンプトで実際にNSFW画像が出ることまで確認。4bit量子化で512は1分51秒、1024は5分37秒、LoRAのオーバーヘッドはほぼゼロAI画像生成FLUXApple SiliconMacMLXLoRA実験
技術2026年5月8日(金)AIが同じ好みを聞き返すならVektor Memoryのsupersession chainsを見るVektor Memory v1.5.4のsupersession chainsを読む。意味的近傍で古い好みを退役させる仕組みを、YourMemoryの時間減衰、Cloudflareのキー上書き、CTXの取り出し分けと並べて整理し、自前エージェント(かなチャットのHeartbeatメモリ)への最小実装まで落とす。AIAIエージェントRAGMCPトークン管理Node.js
技術2026年5月7日(木)エージェントメモリは記憶ではなくメモという論文を読んだarXiv:2604.27707の主張を、CTXやOCR-Memoryのような検索系メモリと並べて読む。RAG、vector store、scratchpadは便利な検索棚だが、経験からルールを重みに畳み込む学習とは別物だ。AIAIエージェントRAGトークン管理AIセーフティ論文
技術2026年5月7日(木)Gemma 4 MTP drafterをM1 Max 64GBで実測、26B A4Bだけ速くなって31BとE4Bは遅くなったM1 Max 64GB + mlx-vlm 0.5.0でGemma 4 MTP drafterを実測。26B A4B (MoE) だけ+13%速くなり、公式が一番効くと言った31B DenseとE4Bは逆に遅くなった。コード生成と短文haikuで結論が反転する。AILLMGoogleGemmaローカルLLM推論MLX実験