技術2026年4月2日(木)更新約13分SwiftLMはTurboQuantとSSDストリーミングをMetalシェーダーに統合したSwift製LLM推論サーバーApple Silicon専用のMLX推論サーバーSwiftLMが、TurboQuant V2+V3ハイブリッドKVキャッシュ圧縮とNVMe SSDエキスパートストリーミングをネイティブMetal実装で提供する。Apple SiliconLLMMLXローカルLLM推論最適化KVキャッシュMoESwift
技術2026年4月1日(水)約10分TRL v1.0がメジャーリリース、LLMポストトレーニングの安定基盤へHuggingFaceのLLMポストトレーニングライブラリTRLがv1.0に到達。Stable/Experimental二層モデルの導入、GRPO・DPO・SFTなど主要手法の安定化、非同期GRPOのロードマップが示された。AI機械学習強化学習LLMHuggingFace
技術2026年3月31日(火)約7分CloudflareがClient-Side SecurityのGNN+LLM検出を全ユーザーに開放、誤検知を200分の1に削減Cloudflareがクライアントサイドの悪意あるスクリプト検出にGNNとLLMの2段カスケードを導入し、ユニークスクリプトあたりの誤検知率を1.39%から0.007%に削減。有料アドオンだったAdvanced機能をセルフサーブ顧客にも開放した。CloudflareセキュリティGNNLLMXSSサプライチェーン機械学習
技術2026年3月31日(火)約6分OllamaがMLXバックエンドに移行、Apple Siliconでのローカル推論が劇的に高速化Ollama 0.19がApple SiliconでのバックエンドをMLXに切り替え、プリフィル1810トークン/秒・デコード112トークン/秒を達成。NVFP4量子化サポートとキャッシュ改善も同時投入された。OllamaMLXApple SiliconLLMローカルLLM推論最適化
技術2026年3月31日(火)約8分Qwen3.5-35B-A3Bでctx-sizeを4096→65536にしたらVRAM 800MB増で速度も変わらなかったQwen3.5-35B-A3BはSSM+Attentionハイブリッドで40層中10層しかKVキャッシュを使わない。llama-serverでctx-sizeを4096→65536に拡張してもVRAM増加は800MB、速度低下ゼロ。q8_0 KV量子化の実測とTurboQuantの現状も。LLMローカルLLMllama.cppAMDVulkanKVキャッシュQwen実験
技術2026年3月28日(土)更新約15分Radeon 8060S (gfx1151) のVulkanがAMDドライバ更新後に壊れたGMKtec EVO-X2 (Ryzen AI Max+ 395) 環境でAMD Software 26.3.1更新後、Vulkanバックエンドがデバイスメモリを正常に確保できなくなりCPUフォールバックする問題の調査と解決記録。BIOS VRAM配分を32GB/32GBに変更することで解決。AMDVulkanGPUllama.cppLLM実験
技術2026年3月28日(土)約8分LangChainとLangGraphに3件の脆弱性、ファイル・秘密情報・会話履歴が漏洩LangChain CoreとLangGraphに3件の独立した脆弱性が公開された。デシリアライゼーションによる秘密情報窃取、SQLインジェクションによる会話履歴漏洩、パストラバーサルによる任意ファイル読み取りと、それぞれ異なるデータクラスを侵害する。LangChainLangGraphCVEセキュリティLLMDeserialization
技術2026年3月27日(金)約7分Chroma Context-1、フロンティアLLMと同等の検索性能を20Bパラメータで実現Chromaが公開した20Bパラメータの自己編集型検索エージェント。コンテキストを動的にプルーニングしながらマルチホップ検索を行い、フロンティアモデルの1/10コスト・最大10倍速のレイテンシで同等以上の精度を示す。重みはApache 2.0で公開。Chroma検索エージェント強化学習RAGLLM
技術2026年3月25日(水)約18分HypuraのNVMeストリーミングとTurboQuantのKVキャッシュ量子化llama.cppのmmap設計を脱却してNVMe 3層配置でDenseモデルもストリーミングするHypuraと、極座標変換で量子化定数オーバーヘッドを排除するTurboQuant。Flash-MoEとの設計比較、KVキャッシュ圧縮が実際に効くシナリオの整理も。LLMローカルLLM量子化Apple Silicon推論最適化KVキャッシュRust
技術2026年3月25日(水)更新約4分TeamPCPがLiteLLM PyPIパッケージを汚染、50種以上の認証情報を窃取するマルウェアを埋め込むLiteLLM 1.82.7/1.82.8がPyPIで約46分間汚染された。TeamPCPがTrivyのCI/CDを通じてPyPIトークンを盗み、SSHキー・AWS・Kubernetes・Docker認証情報など50種以上を収集するマルウェアを注入。フォークボムの副作用で発覚した。セキュリティサプライチェーンPyPIマルウェアLLM
技術2026年3月23日(月)約9分NVIDIAの世界モデルCosmos 2.5系はペットロボットにも載るのかNVIDIAがGTC 2026で発表したCosmos 2.5系世界モデルは産業用途が中心だが、2Bパラメータモデルが500ドル以下のJetson Orin Nanoで動く段階まで来ている。産業ロボットからペットロボットまで、物理AIのエッジ展開を整理した。NVIDIALLMRoboticsSynthetic DataPhysical AI
技術2026年3月23日(月)約10分OpenClawのスキル7%に深刻な脆弱性、30,000インスタンス超が露出Composio社がOpenClawのセキュリティ分析を公開。SkillHub配布スキルの約7.1%に重大な脆弱性が見つかり、初期段階でインターネットに公開された30,000以上のインスタンスがプロンプトインジェクションや認証情報窃取のリスクにさらされていた。セキュリティAIエージェントOpenClawPrompt InjectionLLM