技術2026年2月2日(月)約5分Power Sampling:強化学習なしでLLMの推論能力を引き出すRLで学習させなくても、推論時のサンプリング戦略を変えるだけでLLMの推論性能が向上する。Haitham Bou Ammar氏の記事をもとに、Power Samplingの仕組みと実務的なインパクトを解説する。LLM推論強化学習サンプリングAI
技術2026年2月1日(日)約4分PageIndex — ベクトル検索なしでLLM推論だけのツリーRAGチャンキングもベクトルDBも使わず、LLMの推論で文書の階層ツリーを構築するRAGシステム「PageIndex」を調べた。段組認識やOCRパイプラインとの接続も考察。AIRAGLLMOCRPython
技術2026年1月31日(土)約3分Gradience: LoRAアダプタのランクが本当に必要か、スペクトル監査で測定するツールLoRAのrank設定が過剰かどうかを特異値分解で定量化するツールGradienceの紹介。Mistral-7Bでの実験ではrank半減で精度が向上した。LoRA機械学習LLMファインチューニング
技術2026年1月31日(土)約4分Kimi K2.5: 1兆パラメータMoEのネイティブマルチモーダルエージェントモデルMoonshot AIがリリースしたKimi K2.5の技術的特徴を紹介。1TパラメータMoEアーキテクチャ、MoonViTビジョンエンコーダー、Agent Swarm(PARL)、ベンチマーク結果など。AILLMオープンソース
技術2026年1月30日(金)約5分Not All Bits Are Equal: 推論モデルのメモリ配分に万能解はない推論モデルでメモリをどう配分すべきか。1700実験から導かれた量子化・KVキャッシュ・推論長のトレードオフを解説する。LLM量子化推論論文紹介
技術2026年1月22日(木)約5分Claude Code Best PracticesとAgent SDKの公式ガイドまとめAnthropicがClaude Codeの使い方とAgent SDKによるエージェント構築について公式ガイドを公開した。2つのドキュメントの要点を解説。Claude CodeClaudeAILLM
技術2026年1月13日(火)約5分AIと喋れる環境を作る(3)キャラクター設定編Gemini、Claude、OpenAIの各APIでキャラクター設定を行い、ロールプレイ的な会話を実現する方法を比較。System Prompt、Prefill、構造化出力などの実装例を紹介。AILLMAPIGeminiClaudeOpenAI実験
技術2025年12月9日(火)約7分【RAG】Mac mini M4 Pro + Difyで社内ヘルプデスクを構築する2025(前編)Mac mini M4 ProとDifyを使った社内ヘルプデスクRAGシステムの構築計画。2025年版Difyの進化ポイントと、ローカルLLM運用のコツをまとめました。AILLMRAGDifyMacApple SiliconOllamaDocker
技術2025年12月9日(火)約4分【生成AI】仕事でLLM / RAG導入するので空き時間でLoRA作ってみる2025(前編)社内RAG構築のためにMac mini M4 Proを導入予定。仕様が固まるまでの空き時間でLoRA学習環境を構築する計画をまとめました。AILLMRAGLoRAMacApple SiliconPythonComfyUIStable Diffusion画像生成実験