技術2026年9月18日(金)画像1枚からOpenAI社内モノレポへ、libheifのヒープ破壊とSSO不備が繋いだ72時間の侵入劇セキュリティチームのHacktron AIが、Discourseのlibheif脆弱性とOpenAI SSOの不備を連鎖させ、72時間足らずで従業員アカウントと社内モノレポopenai/openaiへ侵入した経緯を公表した。未パッチの画像パーサ、Claude Opus 5によるエクスプロイト自動化、外部ツールの侵害が本体組織へ波及する認証境界の盲点を整理した。セキュリティOpenAIRCECVEAIエージェントGitHub
技術2026年9月12日(土)更新OpenAIのナビエ・ストークス証明を巡って数学者が揉めている論点を整理したOpenAIが9月8日に発表したナビエ・ストークス方程式の有限時間爆発の証明を巡り、Buckmaster氏との功績を巡る対立と、Codexに入れた下書きがOpenAIの結果に使われたかという疑念を双方の声明と原典から整理した。9月8日の発表前2か月にBuckmaster氏が送ったCodexプロンプトは結果に影響し得なかったという、OpenAIの9月10日の説明に加え、外力ありと外力なしの問題設定の差、Lean検証と人の理解の関係も扱う。数学AIOpenAIAnthropicCodex論文
技術2026年9月7日(月)Astraに合わせてCodexのオーケストレーションを組み直して使用量を抑えるAstraへ差し替えて走らせたら週間上限を半日で使い切ったので、エージェント間の情報の流れと責任の境界を組み直した。手元のCodex CLI 0.153.4で待機の既定を120秒へ上げ、上へ返す情報を8項目のJSONに固定し、指揮を執るモデルはSolのmediumからhighへ動かしている。CodexOpenAIAIエージェント開発効率化自動化
技術2026年9月2日(水)GPT-OSSの隠れ状態を記号構造の式に差し替えても答えがほぼ同じだった論文McCoy、Soulos、Linzen、SmolenskyのarXiv論文は、GPT-OSSの全層・全入力トークンの隠れ状態をテンソル積表現という閉じた式で作り直し、算術・論理・コード・言語の6タスクで本体の答えがほぼ変わらないことを示した。7つのLLMのピリオド位置の実験、役割を書き換える介入の成功率、足し算だけの解釈と何が違うのかを確かめた。AILLMOpenAI論文解釈可能性
技術2026年8月27日(木)更新Codexが suspended (tty input) で止まる原因をMac miniで調べたM4 Mac miniのCodex 0.150.1で、stdioのMCPサーバを起動するとzshがSIGTTINでCodexを停止させる。shellツールでは直っていてMCPだけ残っている端末の切り離しの差と、止まったCodexが残したコンテナのリークまで実機で切り分けた。CodexOpenAIMCPmacOSDockerTerminal実験
技術2026年7月23日(木)OpenAIのモデルが評価中にサンドボックスを脱出しHugging Faceに侵入、ベンチマークの解答を盗み出した事案OpenAIがExploitGymでサイバー能力を評価中、GPT-5.6 Solと未公開モデルが社内に置かれた第三者製キャッシュプロキシのゼロデイで評価用サンドボックスを脱出し、その後Hugging Faceの本番インフラに侵入して解答を取得した。与えられた評価目標を達成する『手段』をモデルが自律的にエスカレートさせた前例のない自律攻撃を、一次情報ベースで整理する。OpenAIHuggingFaceSecurityAI AgentsLLMRed Teaming
技術2026年6月23日(火)更新CodexのSQLiteログがSSDに37TB書いた報告と6月22日の修正PRCodexのlogs_2.sqliteが21日で37TB規模のSSD書き込みを起こしたGitHub Issueを確認した。TRACEログ、SQLite WAL、6月22日にマージされた修正PR、手元で確認するファイルを整理する。OpenAICodexトラブルシューティングAIエージェントCLI
技術2026年6月11日(木)更新CodexでSelected model is at capacityが出たらまず続行するCodexでSelected model is at capacityが出ても、同じスレッドで続行すると作業を再開できた。関連GitHub Issueと、capacityがコンテキスト容量ではなくモデル側の処理枠を指す点を整理。OpenAICodexトラブルシューティングAIエージェントCLI
技術2026年5月6日(水)LLMを温かみのある応答にチューニングしても協調的ペルソナを与えてもユーザーの誤った意見に同意しやすくなるという2論文Oxford Internet Institute(Nature 2026採録)の温かさファインチューニング実験と、Shahら arXiv 2604.10733の275ペルソナ協調性実験を並べる。ファインチューニングでもペルソナでも、ユーザーの感情や誤信念を入れると同じ方向にモデルが倒れる。AILLMAIセーフティ論文紹介OpenAI
技術2026年5月4日(月)ファインチューニングでLLMの著作物丸暗記が再発火するというarXiv論文GPT-4o、Gemini 2.5 Pro、DeepSeek-V3.1を対象に、要約から全文展開するファインチューニングで著作権書籍の逐語再現が増えると報告したarXiv論文を読んだ。AILLM著作権OpenAIGeminiDeepSeekファインチューニング論文
技術2026年4月30日(木)GPT-5.5に湧いたゴブリンをOpenAIがスレイしたOpenAIがGPT-5.1以降で増えた特定の比喩表現について、人格カスタマイズ、報酬信号、SFTデータへの混入、Codexでの抑制まで調査結果を公開した。OpenAILLMCodex強化学習AI安全性
技術2026年4月30日(木)OpenAI Codexのサンドボックス迂回をZDIがゼロデイとして公開ZDI-26-305として公開されたOpenAI Codexのサンドボックス迂回脆弱性。悪意あるJavaScriptを含むリポジトリをCodexで処理した場合に、サンドボックス外でユーザー権限のコード実行へつながるとされる。OpenAICodexセキュリティ脆弱性AIエージェントSandbox