# OpenAI’s agentic software factory
Gergely Orosz(The Pragmatic Engineer)が OpenAI 本社を訪問し、7 名のエンジニアおよびエンジニアリングリーダーへの取材を通じて、社内における [[Codex]] の全面浸透と自律型「[[ソフトウェアファクトリ]]」の運用実態、それに伴う開発インフラ・CI/CD の急激なボトルネックを報告した記事。
## 概要とキーポイント
### 1. 全社的な Codex・エージェントの浸透
2026 年初頭以降、エンジニアのみならず法務・財務・採用などの非エンジニア組織でも Codex の利用率が急上昇し、約 4 か月で 0% から 90% に到達した。リッチな文書作成や調査タスクの遂行能力に加え、`/goal` コマンドによる長時間実行タスク(エージェントが自律的に完了まで実行し、必要に応じてサブエージェントを起動する)への対応がこの普及を牽引した。
![[_attachments/openai-software-factory/fig01-token-usage.png]]
OpenAI 社内における部門別 Codex トークン消費量の推移。エンジニア以外の組織でも急増している。
### 2. IDE の衰退と PR・CI/CD の負荷急増
エージェントがコード生成を主導するようになった結果、従来の多機能 IDE の利用頻度が低下している。さらに、エンジニア 1 人あたりのプルリクエスト(PR)数が急激に増加し、一部の CI/CD システムでは負荷が約 10 倍に達した。
### 3. 自律型ソフトウェアファクトリの構成
OpenAI の開発パイプラインは、以下の自律エージェントループにより構成されている。
![[_attachments/openai-software-factory/fig02-software-factory.png]]
OpenAI における自律型ソフトウェアファクトリの全体構造。
1. **人間の定義**: 人間は問題定義、優先順位付け、テイスト(品質基準)の提示に集中する。
2. **コンテキスト収集**: コードベース内のドキュメント、Git、Slack、Notion、Datadog 等の内部データソースから Codex が文脈を把握する。
3. **コード実装**: Codex がゴール達成までコードを変更し検証する。
4. **ビルド・テスト・CI**: エージェントが PR を作成し、CI がグリーンになるまで自律的に修正を繰り返す。性能検証用の perf harness も活用される。
5. **エージェントによるコードレビュー**: クラウド基盤やセキュリティ等のドメイン特化エージェントが多角的にレビューする。リスク評価に応じて低リスク変更の自動承認や、高リスク変更の人間レビュー要請を行う。
6. **自律デプロイ(Handhold)**: デプロイ専用エージェントが本番反映を追跡し、必要に応じて監視ダッシュボードを自律生成してシグナルを監視する。
7. **フィードバックループ(Perf Factory)**: 本番アラートや性能リグレッションを常時監視し、Codex エージェントが自動で修正 PR を起票する。
8. **障害対応(Sevbot)**: インシデント発生時にコンテキスト収集と緩和策提案を行う。
## 出典
- 原文: `.raw/articles/openai-software-factory-2026-09-15.md`
- 外部 URL: https://newsletter.pragmaticengineer.com/p/openai-software-factory