技術2026年9月27日(日)音声チャットサーバーに長期記憶を入れたら週末の予定だけ思い出せなかったQwen3-EmbeddingとQdrantの長期記憶をStackChan用の音声チャットサーバーに組み込み、会話から事実文を自動で抜き出して後から聞き返すテストを音声で通した。ラーメンとギターは思い出せたが、箱根の予定だけは疑問符の全角と半角で判定が変わるほど、しきい値0.45すれすれのスコアだった。QwenModelScopeRAGVector SearchEmbeddingLLMSTTTTSM5StackPython実験
技術2026年9月11日(金)更新検索した記憶に日付の加点を足してQwenの取りこぼしを直したQdrantで検索した記憶をQwenに渡す会話テストで、最新の作業が候補に入らない問題と新しい記憶がしきい値を割る問題を、類似度に新しさの加点1項を足すだけで直した。係数は4候補を機械的に選び、無関係な記憶が増える副作用まで実測した。QwenModelScopeRAGVector SearchEmbeddingLLMM5StackPythonAPI実験
技術2026年9月10日(木)更新検索した記憶をQwenに渡すとキャラの会話はどう変わるかStackChanに載せる前に、Qdrantで検索した記憶をQwen3.7-Plusへ渡す会話をPC側で10問固定のセットで試した。記憶の主語を省くとキャラが自分の話と取り違え、しきい値0.45の前後は文面差で判定が逆転し、途中でModelScopeの埋め込みAPIが消えてローカルに切り替わった。その分をLLM側で取り返せるかアンバサダー枠の5モデルも叩いた。QwenModelScopeRAGVector SearchEmbeddingLLMM5StackPythonAPI実験
技術2026年9月9日(水)更新Qwen3-EmbeddingをローカルとAPIで比べたWindows 11、AMD Ryzen 7 5800HS、RAM16GBの本番機で、Qwen3-Embedding-0.6BのローカルCPU実行とModelScope API経由を実測し、TTS・ASRが常駐した実運用状態で同時に動かした場合の干渉も測った。ローカルは音声応答も道連れに遅くしたが、API経由は劣化しなかった。QwenModelScopeRAGVector SearchEmbeddingSQLitePythonM5StackTTSSTTAPI実験
技術2026年9月9日(水)更新Qwen3-EmbeddingとQdrantのコストを測ったWindows 11、RTX 4060 8GB、RAM32GBの開発機で、Qwen3-Embedding-0.6BのCPU実行とQdrantのローカルモードを動かし、RAM消費と処理時間を実測した。StackChanの長期記憶設計で測れていなかった部分の続き。QwenRAGVector SearchEmbeddingPythonM5StackSQLite実験
技術2026年5月18日(月)SembleをAstroブログ(1595 MD + 152 ソース)で試したらhybridがコードを見失ったMinishLab/sembleを1595 MDと152ソースのAstroブログで実機検証した。ウォーム状態のBM25クエリは0.84sでシンボル定義を最上位に返すが、hybridモードはMD記事に引きずられて`seasonalBanner`のような短いシンボルを見失う。AIエージェントClaude CodeCodexMCPEmbeddingVector Search実験
技術2026年4月23日(木)Valkeyを中枢神経に据えた3エージェントAIスワーム「NeuroValkey Agents」の実装OpenAI API × Valkey × Node.jsの3エージェント構成でマルチエージェントスワームを組んだNeuroValkey Agentsのアーキテクチャを掘り下げる。Valkeyをキャッシュではなくオーケストレーション・メモリ・状態遷移の実行基盤として使う設計を読み解く。ValkeyAIエージェントRedisVector SearchNode.jsEmbedding
技術2026年2月18日(水)AliSQL 8.0 - MySQLにDuckDBカラムナエンジンとベクトルサーチを統合したアリババのOSSアリババがMySQL互換のOLTP、DuckDBベースの高速OLAP、HNSWベクトルサーチを1つのデータベースに統合した「AliSQL 8.0」をオープンソースで公開した。MySQLの停滞とPostgreSQLの躍進の中で、この動きが持つ意味を考える。MySQLDuckDBDatabaseVector SearchPostgreSQL