技術2026年9月9日(水)Qwen3-EmbeddingをローカルとAPIで比べたWindows 11、AMD Ryzen 7 5800HS、RAM16GBの本番機で、Qwen3-Embedding-0.6BのローカルCPU実行とModelScope API経由を実測し、TTS・ASRが常駐した実運用状態で同時に動かした場合の干渉も測った。ローカルは音声応答も道連れに遅くしたが、API経由は劣化しなかった。QwenModelScopeRAGVector SearchEmbeddingSQLitePythonM5StackTTSSTTAPI実験
技術2026年9月9日(水)更新Qwen3-EmbeddingとQdrantのコストを測ったWindows 11、RTX 4060 8GB、RAM32GBの開発機で、Qwen3-Embedding-0.6BのCPU実行とQdrantのローカルモードを動かし、RAM消費と処理時間を実測した。StackChanの長期記憶設計で測れていなかった部分の続き。QwenRAGVector SearchEmbeddingPythonM5StackSQLite実験
技術2026年9月6日(日)更新QwenとQdrantで長期記憶付きStackChanの設計を固めたRTX 3050 TiノートとCoreS3の既存音声チャットへ、Qwen3-EmbeddingとQdrantによる長期記憶を足す。StackChanWorldのAPIへ依存せず、会話ログ、検索用メモリ、人格、身体を分離する実装前の設計をまとめた。QwenAIエージェントM5StackRAGTTSSTTPython
技術2026年5月11日(月)更新Gemini API File Searchのマルチモーダル化はゲームNPCの記憶にも使えそうGemini API File Searchがマルチモーダル対応し、画像とテキストを同じstoreで検索できるようになった。metadata filterでNPC記憶を章やキャラで絞り込める点と、1キャラ月$1未満の料金試算からゲーム用途の実用性を見る。AIGeminiRAGAPIゲーム
技術2026年5月8日(金)IFしか知らない人が3か月でCivicSurvivalを作れた理由DEVのCivicSurvival開発記録を読んだ。158K行のCities: Skylines II modを支えたのはAIへの丸投げではなく、CivicRAG、300超のRoslyn analyzer、ビルド失敗、目視確認でAIを縛る運用だった。AIAIエージェントClaude CodeMCPRAGゲーム
技術2026年5月8日(金)AIが同じ好みを聞き返すならVektor Memoryのsupersession chainsを見るVektor Memory v1.5.4のsupersession chainsを読む。意味的近傍で古い好みを退役させる仕組みを、YourMemoryの時間減衰、Cloudflareのキー上書き、CTXの取り出し分けと並べて整理し、自前エージェント(かなチャットのHeartbeatメモリ)への最小実装まで落とす。AIAIエージェントRAGMCPトークン管理Node.js
技術2026年5月7日(木)エージェントメモリは記憶ではなくメモという論文を読んだarXiv:2604.27707の主張を、CTXやOCR-Memoryのような検索系メモリと並べて読む。RAG、vector store、scratchpadは便利な検索棚だが、経験からルールを重みに畳み込む学習とは別物だ。AIAIエージェントRAGトークン管理AIセーフティ論文
技術2026年5月3日(日)CTXでClaude Codeに動くメモリを足すClaude CodeのUserPromptSubmitフックで文脈を自動注入するCTXを読んだ。auto-memory、YourMemory、WUPHF、Cloudflare Agent Memoryとの差をセッション跨ぎと保存先の軸で並べた。1Mコンテキストに揃っても足りない理由と、同じ1Mでもエージェントごとにウィンドウの使い方が違う点を確認した。Claude CodeAIエージェントトークン管理RAGOSS
技術2026年5月2日(土)FastAPI・Chroma・Open WebUI・Ollamaでマルチモーダル日本語RAGをM1 Maxで組んだDEV記事のPDF RAGをM1 Max 64GBで実装し、CLIPで画像、bge-m3 + Qwen3.6 35Bで日本語まで通した実験ログ。モダリティギャップ、推論サーバー並走クラッシュ、LLM-jp 4-8Bの指示追従失敗まで実機の挙動を記録。AILLMRAGローカルLLMFastAPIllama.cppChromaPythonApple SiliconOllama日本語LLM実験
技術2026年5月2日(土)更新FastAPI・llama.cpp・Chroma・Open WebUIでPDF用ローカルRAGを組む記事を読んだDEV Communityの記事をもとに、FastAPIでOpenAI互換RAG APIを作り、llama.cpp、Chroma、Open WebUIをつなぐ構成の位置づけと実装上の落とし穴を整理する。AILLMRAGローカルLLMFastAPIllama.cppChromaPythonDocker
技術2026年5月2日(土)OCR-Memoryはエージェントの履歴を画像として思い出すarXiv:2604.26622のOCR-Memoryを読んだ。エージェントの長い実行履歴を画像化し、Set-of-Markで該当箇所だけ選ばせ、元ログから逐語テキストを戻すメモリ方式だ。AIAIエージェントOCRVLMRAGトークン管理論文
技術2026年4月30日(木)Rust/WASM製VecLiteでブラウザ内RAGの検索部分が現実味を帯びたVecLiteはRust/WASM+SIMDでブラウザ内ベクトル検索を高速化するライブラリ。Transformers.jsで埋め込みを作り、IndexedDBに保存し、サーバーなしでRAGを組むときにどこが詰まるかを整理する。RustWebAssemblyRAGEmbeddingAI Coding