要点

OpenAIの公式Python SDK 3.22.0は、βエージェントにcomputer useを追加しました。画面上の操作を伴う処理を扱う開発者にとっては、モデルへ指示を渡すだけの実装から、操作対象・実行境界・確認手順をコードで設計する段階へ進む更新です。

何が変わったのか

OpenAI Python 3.22.0は、2026年9月29日に「computer useをbeta agentsへ追加」と記載しました。公開リリースノートには、対応するAPI呼び出しの詳細、権限モデル、対応環境までは載っていません。そのため、この更新だけから、任意のブラウザ操作が本番用途で利用可能になったとは断定しません。

どこで効くのか

社内の限定画面で、定型の入力確認やテスト用のブラウザ手順を自動化したいPythonプロジェクトが検討対象です。画面操作は、テキスト生成よりも誤操作の影響が直接出ます。対象URL、許可する操作、入力してよいデータ、操作前後の確認を、モデルのプロンプトではなく実行側の制約として置く必要があります。

ここからは編集部の見立てです。最初に試すべきなのは、送信・購入・削除を含まない読み取り専用の画面です。成功率だけでなく、想定外の要素を選んだときに停止できるかを、実行ログと画面のスクリーンショットで確認すると、導入可否を具体的に判断できます。

導入するか

採用判断

様子見。 SDKが入口を追加したことは確認できますが、公開リリースノートだけではAPI仕様と権限境界を十分に判断できません。公式のβエージェントとcomputer useの仕様を読み、非破壊の検証環境に限定できる場合だけ試します。

15分ミニ課題

対象: 自分のプロジェクトにあるブラウザテスト、管理画面、または操作手順書を一つ選びます。外部サービスの操作は実行しません。

  1. その手順から「読むだけ」の操作を一つ、「状態を変える」操作を一つ書き出します。
  2. 読むだけの操作だけで完了する最小テストを一文で定義します。
  3. 状態変更を含む操作を自動化しないための停止条件を一つ決めます。

完了条件: 自動化候補の対象画面、許可操作、禁止操作、停止条件をそれぞれ一つ説明できることです。

前提知識

参照元

一次情報を確認する ↗