技術2026年6月28日(日)約7分DeepSeek-V4-Pro-DSparkは新モデルではなく投機的デコード用のV4-Pro派生Hugging Faceに出たDeepSeek-V4-Pro-DSparkは新しい基盤モデルではなく、V4-Proに投機的デコード(DSpark)用モジュールを足した約893GBの派生。config.jsonとDeepSpec、HFのストレージ差から中身を確認し、速度ベンチがまだ無いことまで整理した。LLMDeepSeek中華系AIMoE推論最適化オープンモデル
技術2026年6月16日(火)約10分Claude Fable停止後にKimi K2.7 CodeとQwen3.7 Maxがエージェント枠を取りに来ている2026年6月16日時点で、Claude Fable 5停止後の代替候補を中華系AIの最新リリースから見る。Kimi K2.7 Code、Qwen3.7 Max、DeepSeek V4、GLM-5.1の差分と、Claude Code互換ハーネスで使うときの制約を整理した。AILLM中華系AIKimiQwenDeepSeekMoEAIエージェント
技術2026年5月4日(月)約12分ファインチューニングでLLMの著作物丸暗記が再発火するというarXiv論文GPT-4o、Gemini 2.5 Pro、DeepSeek-V3.1を対象に、要約から全文展開するファインチューニングで著作権書籍の逐語再現が増えると報告したarXiv論文を読んだ。AILLM著作権OpenAIGeminiDeepSeekファインチューニング論文
技術2026年4月24日(金)約10分DeepSeek V4 Previewが1Mコンテキストで登場、V4-Pro 1.6T/V4-Flash 284BがMITで公開されV3.2比27% FLOPsを実現DeepSeekが2026年4月24日にV4 Previewを公開。V4-Pro(1.6T/49B active)とV4-Flash(284B/13B active)はどちらも1Mコンテキストに対応し、CSA+HCAハイブリッドアテンションとmHC、Muonオプティマイザで1Mトークン時のFLOPsをV3.2比27%まで削減している。Expert Mode / Instant Modeとして即日APIも更新された。LLMDeepSeek中華系AIMoEオープンモデルAIエージェント
技術2026年2月24日(火)約8分Claudeの大規模不正蒸留とSWE-benchの崩壊が同時に来たAnthropicが中国AI3社によるClaude蒸留を告発し、同日OpenAIがSWE-bench Verifiedを廃止。訓練の不正と評価の欠陥が同時に露呈した2026年2月23日の出来事を整理する。AISecurityAnthropicDeepSeekBenchmarkLLMOpenAISWE-bench
技術2026年1月20日(火)約4分VLMベースOCRの台頭 - DeepSeek-OCRとハイブリッド活用の可能性従来のOCRとVLM(Vision Language Model)ベースOCRの違いを解説。DeepSeek-OCRの紹介と、両者を組み合わせたハイブリッド手法の可能性を考察する。AIOCRDeepSeekVLM