技術2026年7月22日(水)約9分Claude Fable 5がヤコビアン予想の反例を出したというので、ヤコビ行列の基礎からSymPyで確かめたClaude Fable 5が87年未解決のヤコビアン予想の反例を生成したとAnthropicの数学者が発表した。ヤコビ行列式が定数−2のまま3つの点が同じ点に写ることを手元のSymPyで再現し、ヤコビ行列を知らない前提で1変数の微分から検証状況まで追う。数学数式AIClaudeAnthropic
技術2026年7月8日(水)更新約10分Claudeの中間層に思考用の共有作業領域J-spaceが自然にできていたというAnthropicの論文、J-lensで発話前の概念を読んで書き換えるクモの概念をアリに書き換えると回答が8本足から6本足に変わる。モデル内部から発話前の概念を読み出すJ-lensの仕組みと、テスト中だけ行儀よくする演技の検出、Qwenでの追試まで論文の実験を追う。AILLMAnthropicClaude
技術2026年7月2日(木)約11分AnimaのプロンプトをQwen Max・Claude・Codexに書かせて60枚比較、Qwen同士の相性仮説は外れた3キャラ合体LoRA(trio_v2)で、同じ日本語指示10シーンを3つのLLMに英語プロンプト化させ、同一シード60枚をM1 MaxのローカルComfyUIで生成して照合した。Qwen-DiT系だから変換もQwenが有利という仮説の検証と、人数ロック付きブリーフで直る崩れ・どう書いても直らない崩れの切り分け。QwenAnimaClaudeCodexLLMAI画像生成ComfyUI実験マルチキャラ
技術2026年6月13日(土)更新約10分Claude Fable 5とMythos 5全停止、米輸出管理とOpus 4.8代替の不安Anthropicが2026年6月12日にFable 5とMythos 5を全顧客向けに停止。米政府の輸出管理指令、外国籍社員、政府との対立、AI Safety対応の粗さ、Microsoft制限、Opus 4.8代替の不安を整理する。ClaudeAnthropicAIAIセーフティ輸出管理
技術2026年6月10日(水)約7分Claude Fable 5をOpus 4.8、Sonnet 4.6、Codex CLIとブログ修正で比較したClaude Code CLIでFable、Opus、Sonnetを回し、Codex CLIと同じ7テストの静的ブログフィクスチャを修正。実行時間、推定コスト、差分のズレを記録。ClaudeCodexAIエージェントベンチマーク実験
技術2026年5月26日(火)約7分Claude EnterpriseがMicrosoft Purviewに乗ってCompliance APIで何が見えて何が見えないかを整理したMicrosoftとAnthropicが5月に発表したClaude Compliance API for Microsoft Purview。監査イベントとチャット・ファイル本体はPurview側から見えるが、プロンプト中身や呼び出されたツールは見えない。Claude Codeは別経路でOpenTelemetry。対象プランと制限を整理したセキュリティAI AgentsClaudeMicrosoftPurview
技術2026年5月10日(日)約7分OrbisはGitHubリポジトリを3D依存グラフにしてClaudeへ渡すDEV Community発のOrbisをDockerで動かして、psf/requestsとexpressjs/expressを3D依存グラフにしてみた。tree-sitterのASTからnodeとedgeを作り、コードレビュー前の構造把握用UIとして使えるかをローカルで検証した記録。GitHubAI CodingAIエージェントPython3DClaude実験
技術2026年5月7日(木)約5分uvでClaude SDKの小さなPythonエージェント実験をすぐ始めるDEV記事のuv 0.11.11ベンチを材料に、Claude SDKのPython実験をuv init、uv add、uv run、uv.lockでどう扱うと壊れにくいかを見る。手元のuv 0.9.21では秒数を追試していない。ClaudePythonuvAIエージェント開発効率化
技術2026年4月19日(日)約10分AnthropicがClaude Designを発表、Opus 4.7で生成するプロトタイプとスライドAnthropic Labsが2026年4月17日にリリースしたClaude Designは、コードベースと既存デザインを読み込んでプロトタイプ・スライド・ランディングページを生成する新しいデザインツール。Figma / Canvaとの機能比較と、結局どの場面でどれを使うべきかをシナリオ単位で整理した。ClaudeAnthropicClaude CodeCanvaデザイン
技術2026年4月19日(日)約7分Claude Opus 4.7のトークナイザ更新で請求額が最大1.45倍に膨らむ独立計測データBill ChambersのTokenomicsリーダーボードとClaude Code Campの独立計測で、Opus 4.7が4.6比で1.2〜1.45倍のトークンを要求する実データが出揃った。Anthropic公式の1.0〜1.35倍レンジを上回るケースが実務で頻発している。ClaudeAnthropicOpusトークナイザAPIコスト
技術2026年4月17日(金)約12分Claude Opus 4.7がSWE-bench Verified 87.6%とxhighエフォートでエージェント能力を底上げAnthropicが4月16日にClaude Opus 4.7を公開。長時間エージェント向けのxhighエフォート、セルフベリファイ、3倍解像度の画像処理を搭載しつつ、Project Glasswingでサイバー能力を意図的に抑制した段階的ロールアウトになっている。ClaudeAnthropicClaude CodeAIエージェントProject Glasswing
技術2026年4月15日(水)約11分LLMの安全フィルタの仕組みとabliteratedモデルの実態LLMの安全性はRLHF・Constitutional AI・システムプロンプト・入出力フィルタの多層構造で成り立っている。クラウド各社の温度差、abliteratedとuncensoredの違い、ローカルLLMのデフォルト検閲レベルを整理した。AILLMローカルLLMセキュリティGeminiClaudeOllama