技術2026年5月4日(月)ファインチューニングでLLMの著作物丸暗記が再発火するというarXiv論文GPT-4o、Gemini 2.5 Pro、DeepSeek-V3.1を対象に、要約から全文展開するファインチューニングで著作権書籍の逐語再現が増えると報告したarXiv論文を読んだ。AILLM著作権OpenAIGeminiDeepSeekファインチューニング論文
技術2026年5月2日(土)FastAPI・Chroma・Open WebUI・Ollamaでマルチモーダル日本語RAGをM1 Maxで組んだDEV記事のPDF RAGをM1 Max 64GBで実装し、CLIPで画像、bge-m3 + Qwen3.6 35Bで日本語まで通した実験ログ。モダリティギャップ、推論サーバー並走クラッシュ、LLM-jp 4-8Bの指示追従失敗まで実機の挙動を記録。AILLMRAGローカルLLMFastAPIllama.cppChromaPythonApple SiliconOllama日本語LLM実験
技術2026年5月2日(土)更新FastAPI・llama.cpp・Chroma・Open WebUIでPDF用ローカルRAGを組む記事を読んだDEV Communityの記事をもとに、FastAPIでOpenAI互換RAG APIを作り、llama.cpp、Chroma、Open WebUIをつなぐ構成の位置づけと実装上の落とし穴を整理する。AILLMRAGローカルLLMFastAPIllama.cppChromaPythonDocker
技術2026年5月2日(土)Qwen-ScopeのSAEをM1 Max 64GBで動かして日本語特徴を取り出すQwen-ScopeのSparse AutoencoderをローカルのM1 Max 64GBで動かし、Qwen3-8B-Baseの中間層から日本語・英語・コード・中国語を弁別する特徴IDを取り出した記録。AILLMQwen解釈可能性実験Apple SiliconMPS
技術2026年5月1日(金)更新Qwen-ScopeはQwen内部特徴を推論制御やデータ合成に使うSAEスイートQwenチームがQwen3/Qwen3.5向けのSparse AutoencoderスイートQwen-Scopeを公開した。14グループのSAEで、推論時ステアリング、評価分析、毒性分類、データ合成、学習改善までを狙う。AILLMQwen解釈可能性AIセーフティ
技術2026年4月30日(木)GPT-5.5に湧いたゴブリンをOpenAIがスレイしたOpenAIがGPT-5.1以降で増えた特定の比喩表現について、人格カスタマイズ、報酬信号、SFTデータへの混入、Codexでの抑制まで調査結果を公開した。OpenAILLMCodex強化学習AI安全性
技術2026年4月30日(木)更新NIIの48,000時間音声音響データセットはTTSの材料になるNII/LLMCが公開したCC AudioとArchive.org Audio Datasetを、URLリスト、メタデータ、TTS学習、Embedding解析の違いから読む。AI音声AI音声合成音声認識TTSSTTLLM機械学習
技術2026年4月30日(木)Xiaomi MiMo-V2.5はMacやROCmで動かせるのかXiaomi MiMo-V2.5のウェイト公開後、Mac/ROCmとクラウドGPU(RunPod/GCE)での実行可否を調べた。手元機ではまだ厳しいが、RunPodの4x H200で約14ドル/時間、GCE SpotのH100なら約1.6ドル/時間で動かせる。AILLMローカルLLMXiaomiMoEApple SiliconROCmllama.cpp
技術2026年4月28日(火)Sarashina2.2-TTSは日本語寄りのゼロショット音声合成モデルSB Intuitionsが公開したsarashina2.2-ttsを調べた。日本語中心のLLMベースTTSで、短い参照音声から話者・話し方を再現し、日英生成やコードスイッチにも対応する。AITTS音声合成LLMボイスクローン
技術2026年4月27日(月)LLaDA2.0-Uniは拡散LLMで画像理解と生成を一本化したオープンモデルInclusion AIがLLaDA2.0-Uniを公開した。16B MoEの拡散LLMを中核に、画像理解、1024px画像生成、画像編集、テキストと画像の交互生成を単一モデルで扱う。AILLM画像生成VLMMoEオープンモデル拡散モデル
技術2026年4月27日(月)安全モニタの評価器を狙うsecond-order injectionLLM安全モニタの評価器が、監視対象のセッション本文に埋め込まれた命令で判定を上書きされる問題。second-order injectionの実験結果、防御の限界、実装上の分離ポイントを整理する。セキュリティLLMPrompt InjectionLLM安全性AIエージェント
技術2026年4月26日(日)WUPHFのKarpathy流LLM wikiはエージェント記憶をMarkdownとGitに戻すShow HNで伸びていたWUPHFのLLM wikiを読む。Markdownを正本にし、Git履歴・SQLite・Bleve・lintでエージェント共有記憶を扱う設計は、RAGやマネージドメモリとは違う場所を狙っている。AIエージェントMCPLLMMarkdownGitKarpathy