Implementation ArchiveIMPL
複数AI開発の運用設計

複数AI開発では、
進捗管理も承認整理も自動化しないと回らない

AIやCodexを複数同時に動かすようになると、作業速度より先に進捗管理が限界を迎える。どの案件が動き、何が止まり、どこに自分の判断が必要なのか。これを人間が毎回入力する運用では続かない。そこで、各プロジェクトの進捗、実行証跡、承認待ち、案件カルテ、失敗知見をAI側から自動で集約する「AI管制室」を作った。

複数のAIプロジェクトを状態別に一覧できるAI管制室のプロジェクトボード
プロジェクトを未着手・進行中・保留・停止・完了に分け、承認待ちや未完了タスクも同じ画面で確認する。

一番重要なのは、管理画面ではなく「AIが勝手に記録する仕組み」である

この管制室は、人間が一件ずつプロジェクトを登録し、ステータスを更新するためのボードではない。AIが作業を始めると開始イベントが入り、実装や検証が終われば成果と証跡が入り、判断が必要になれば承認事項が上がる。

人間が見るのは、AIでは決められない例外と承認だけである。承認か否決かを決めれば、その結果が案件側へ戻り、許可された範囲の作業は再開できる。危険な外部操作や取り返しのつかない処理まで無条件に自動化するのではなく、判断境界だけを人間に残す設計である。

作業をAIに任せても、進捗報告を人間が手入力しているなら、ボトルネックは消えていない。だから最初に自動化すべきなのは、作業そのものと同時に、作業を管理する情報の生成である。

複数AI開発では、作業を自動化するだけでは足りない。
進捗管理そのものも自動化する必要がある。

案件が増えるほど、記憶による管理はすぐに破綻する

一つの案件だけなら、会話履歴を読み返せば状況を思い出せる。しかし複数のAIが別々のプロジェクトを同時に進めると、頭の中だけでは管理できない。

手動管理
  • 案件ごとに進捗を転記する
  • どのAIが何をしたか履歴を探す
  • 承認待ちを会話の中から拾う
  • 失敗理由が別々の場所に残る
  • 同じ判断を何度もやり直す
AI管制室
  • 開始・完了イベントを自動登録する
  • 成果物と検証証跡を案件へ結びつける
  • 判断が必要な例外だけ承認へ上げる
  • 失敗と改善策を案件カルテへ残す
  • 過去の判断基準を次の作業へ渡す

状態だけでなく、止まっている理由まで見えるようにする

未着手、進行中、保留、停止、完了という列だけでは不十分である。カードには次の作業、未完了タスク、承認の有無、成果物の証跡を持たせる。停止中であれば、何の条件を待っているのかも残す。

この形にすると、画面を開いた瞬間に「今見るべき案件」が分かる。進行中の件数が多くても、人間の判断が必要なものがゼロなら割り込む必要はない。反対に、一件でも承認待ちがあれば、そこだけを優先して判断できる。

AIに任せる範囲と、人間が止める範囲を分ける

Step 01
AIが作業を進める安全なローカル作業、調査、実装、検証、記録はAI側で進める。
Step 02
判断が必要な問題を上げる公開、外部送信、削除、重要な方針変更など、人間の責任が必要な事項だけを承認待ちにする。
Step 03
人間が承認・否決する目的、リスク、証跡、推奨案を見て判断し、結果を案件へ返す。
Step 04
許可範囲の作業を再開する承認結果を引き継ぎ、許可された内部作業を続ける。最終的な外部操作は定めた権限境界を守る。

何が起き、何を学び、次に何をすべきかを一つに束ねる

案件カルテには、目的、制約、現在地、成果物、実行証跡、未完了タスク、承認履歴、判断基準、得られた知見を集める。単なるタスク一覧ではなく、後から別のAIが見ても仕事を再開できる状態を作る。

作業が完了したという報告だけでは、品質を判断できない。何を確認し、どの証拠があり、どこに不確実性が残るかまで持たせることで、「終わったつもり」を減らせる。

案件の目的、タスク、証跡、承認、知見をまとめたAI管制室の案件カルテ画面
案件ごとの目的、役割、次の判断、証跡、承認履歴、知見を一つのカルテへ集約する。

失敗を記録しなければ、AIは別の案件で同じミスをする

AIは速く作業できる一方、前提や制約を渡さなければ、以前と同じ誤りを別の場所で繰り返す。人間が毎回「前にも言った」と説明する運用では、並行開発の利点が消える。

そこで、失敗の内容だけでなく、なぜ起きたか、次回どの確認を先に行うか、どの操作は承認対象かを知見として残す。次の案件では、その知見を作業前の注意事項や完了条件としてAIへ返す。

知見を一箇所へ体系的に集約する意味は、記録を増やすことではない。同じ判断と同じ失敗を減らし、AIの仕事を使うほど運用全体が強くなる状態を作ることである。

複数のAIを同時に動かすなら、
人間は進捗を入力する人ではなく、
例外を判断する人になった方がいい。