技術2026年9月2日(水)GPT-OSSの隠れ状態を記号構造の式に差し替えても答えがほぼ同じだった論文McCoy、Soulos、Linzen、SmolenskyのarXiv論文は、GPT-OSSの全層・全入力トークンの隠れ状態をテンソル積表現という閉じた式で作り直し、算術・論理・コード・言語の6タスクで本体の答えがほぼ変わらないことを示した。7つのLLMのピリオド位置の実験、役割を書き換える介入の成功率、足し算だけの解釈と何が違うのかを確かめた。AILLMOpenAI論文解釈可能性
技術2026年8月27日(木)更新Codexが suspended (tty input) で止まる原因をMac miniで調べたM4 Mac miniのCodex 0.150.1で、stdioのMCPサーバを起動するとzshがSIGTTINでCodexを停止させる。shellツールでは直っていてMCPだけ残っている端末の切り離しの差と、止まったCodexが残したコンテナのリークまで実機で切り分けた。CodexOpenAIMCPmacOSDockerTerminal実験
技術2026年7月23日(木)OpenAIのモデルが評価中にサンドボックスを脱出しHugging Faceに侵入、ベンチマークの解答を盗み出した事案OpenAIがExploitGymでサイバー能力を評価中、GPT-5.6 Solと未公開モデルが社内に置かれた第三者製キャッシュプロキシのゼロデイで評価用サンドボックスを脱出し、その後Hugging Faceの本番インフラに侵入して解答を取得した。与えられた評価目標を達成する『手段』をモデルが自律的にエスカレートさせた前例のない自律攻撃を、一次情報ベースで整理する。OpenAIHuggingFaceSecurityAI AgentsLLMRed Teaming
技術2026年6月23日(火)更新CodexのSQLiteログがSSDに37TB書いた報告と6月22日の修正PRCodexのlogs_2.sqliteが21日で37TB規模のSSD書き込みを起こしたGitHub Issueを確認した。TRACEログ、SQLite WAL、6月22日にマージされた修正PR、手元で確認するファイルを整理する。OpenAICodexトラブルシューティングAIエージェントCLI
技術2026年6月11日(木)更新CodexでSelected model is at capacityが出たらまず続行するCodexでSelected model is at capacityが出ても、同じスレッドで続行すると作業を再開できた。関連GitHub Issueと、capacityがコンテキスト容量ではなくモデル側の処理枠を指す点を整理。OpenAICodexトラブルシューティングAIエージェントCLI
技術2026年5月6日(水)LLMを温かみのある応答にチューニングしても協調的ペルソナを与えてもユーザーの誤った意見に同意しやすくなるという2論文Oxford Internet Institute(Nature 2026採録)の温かさファインチューニング実験と、Shahら arXiv 2604.10733の275ペルソナ協調性実験を並べる。ファインチューニングでもペルソナでも、ユーザーの感情や誤信念を入れると同じ方向にモデルが倒れる。AILLMAIセーフティ論文紹介OpenAI
技術2026年5月4日(月)ファインチューニングでLLMの著作物丸暗記が再発火するというarXiv論文GPT-4o、Gemini 2.5 Pro、DeepSeek-V3.1を対象に、要約から全文展開するファインチューニングで著作権書籍の逐語再現が増えると報告したarXiv論文を読んだ。AILLM著作権OpenAIGeminiDeepSeekファインチューニング論文
技術2026年4月30日(木)GPT-5.5に湧いたゴブリンをOpenAIがスレイしたOpenAIがGPT-5.1以降で増えた特定の比喩表現について、人格カスタマイズ、報酬信号、SFTデータへの混入、Codexでの抑制まで調査結果を公開した。OpenAILLMCodex強化学習AI安全性
技術2026年4月30日(木)OpenAI Codexのサンドボックス迂回をZDIがゼロデイとして公開ZDI-26-305として公開されたOpenAI Codexのサンドボックス迂回脆弱性。悪意あるJavaScriptを含むリポジトリをCodexで処理した場合に、サンドボックス外でユーザー権限のコード実行へつながるとされる。OpenAICodexセキュリティ脆弱性AIエージェントSandbox
技術2026年4月25日(土)OpenAIがAPIでGPT-5.5とGPT-5.5 ProをリリースOpenAIがAPI向けにGPT-5.5とGPT-5.5 Proを公開した。1M超のコンテキスト、reasoning.effortのデフォルト変更、画像入力の扱い、プロンプトキャッシュ、料金面など、実務上の差分を整理する。OpenAILLMAPIAI
技術2026年4月23日(木)更新NVIDIA NIMが100モデル超のホスト推論を無料公開、OpenAI互換でOpenClawやCursorから直接叩けるNVIDIAがbuild.nvidia.comで提供する無料推論API「NIM」は、MiniMax M2.7やGLM-5、Kimi K2.5、DeepSeek、GPT-OSS、Sarvam-Mなど100モデル超を扱える。integrate.api.nvidia.com/v1のOpenAI互換エンドポイントなのでOpenClawやOpenCode、Zed、Cursorから直接呼べる。NVIDIALLMAPIOpenAIAI CodingOpenClaw
技術2026年4月16日(木)更新GPT-Image-2がLM Arenaにリーク、テープ系コードネームで2波にわたり出現OpenAIの未発表画像生成モデルGPT-Image-2が、テープ系コードネームでLM Arenaに出現。第1波は数時間で削除されたが、4月中旬にduct-tape系として再出現しBattle Modeで試せる状態に。OpenAI画像生成AILM ArenaDALL-E