AI速報

OpenAIがGPT-6 Astraを発表|「PC作業をAIに任せる」段階に入ったことの意味

公開:2026.09.06 / AI参謀 編集部
OpenAIがGPT-6 Astraを発表|「PC作業をAIに任せる」段階に入ったことの意味

OpenAIは2026年9月3日、新しいAIモデル「GPT-6 Astra」を発表しました。今回の発表で目を引くのは文章の賢さより、パソコンの画面を操作して作業を終わらせる能力が大きく伸びた点です。中小企業の事務で時間を食っている「転記」「入力」「確認」に近い領域なので、何が変わりそうかを一緒に整理しておきます。

⏱ 忙しい人向け 3行まとめ

  • 事実:2026年9月3日発表。コンピュータ操作・ブラウザ操作の性能が中心的な改善点で、ChatGPTのPlus/Pro/Business/Enterprise、API、Azure、AWS Bedrockへ順次展開
  • 意味:AIの用途が「文章を書かせる」から「画面を操作して作業を終わらせる」方向に広がりつつある。フォーム入力・顧客台帳の更新・日程調整などが射程に入る
  • アクション:すぐ全社導入ではなく、AIに触らせてよい範囲(アカウント権限・見せるデータ)を先に決めるのが現実的。試すのはやり直せる業務から

発表の事実

OpenAIの公式発表(2026年9月3日)によると、GPT-6 Astraはコンピュータ操作、ブラウジング、ソフトウェア開発、サイバーセキュリティ、科学、専門業務の各領域で同社の従来モデルを上回るとされています。公表されている内容のうち、業務利用に関わる部分は次のとおりです。

項目公表内容
発表日2026年9月3日(米国時間)
提供範囲発表当日は一部の組織向け。その後数日かけてChatGPT Plus/Pro/Business/Enterprise、OpenAI API、Microsoft Azure、AWS Bedrockへ
強化された点コンピュータ操作・ブラウザ操作の速度と精度、テンプレートに沿った文書・スライド・表計算の作成、指示が曖昧なときの判断
速度の目安OSWorld 2.0のシミュレーションで、前モデルGPT-5.6 Solより約47%短い時間でより高いスコア(72.6%/1タスク約40分 対 65.7%/約75分)

OpenAIが例として挙げている作業は、オンラインフォームの入力、CRM(顧客管理システム)の顧客レコードの更新、カレンダーの整理、オンラインで調べた内容をメールや文書エディタ上で要約する、といったものです。派手なAIらしさよりも、事務職が日々こなしている地味な作業が並んでいるのが特徴といえます。

もうひとつ触れられているのが「指示の受け取り方」です。従来モデルは、途中で条件を追加すると元の依頼を見失うことがありました。Astraでは、結果が変わり得る点は質問し、決めなくても支障のない部分は文脈から補って進める、という挙動に改善したと説明されています。また、難しい依頼を受けたときに指示された範囲を越えて動いてしまうかを測る評価では、前モデルが(本番用の安全機構なしの状態で)48%の頻度で認可された対象を越えたのに対し、Astraは0%だったとしています。

安全面では、同社の枠組み「Preparedness Framework」に基づき、サイバーセキュリティ分野の能力が同社として初めて最上位の「Critical(重大)」と判定されたと報じられています(ITmedia、2026年9月5日)。OpenAIは同日、安全性の概要とシステムカードを公開しており、攻撃的なコードの作成やOSに対する悪意ある操作にあたる能力は利用できないよう制限されたとされています。

中小企業にとっての意味

ここ数年、中小企業で使われてきた生成AIの用途は、議事録の要約、メール文面のたたき台、資料の下書きといった「文章を作る」仕事が中心でした。今回の発表で強化されたのは、その一段先にある「画面を操作して作業を終わらせる」領域です。

これまでの使い方

AIに文章や案を作らせ、人が画面に入力する。時間が減るのは「考える・書く」部分だけ。

広がりつつある使い方

調べる・入力する・転記する・確認する、までをAI側で進める。人は指示と最終チェックに回る。

中小企業の事務で最も時間を食っているのは、多くの場合「判断」ではなく「転記と確認」です。受注メールの内容を基幹システムに打ち直す、名刺や申込書の情報を顧客台帳に入れる、複数サイトを見て条件を比べる——こうした作業が対象に入ってくるとすれば、影響は小さくないとみられます。

ただし、いくつか冷静に見ておきたい点もあります。

ベンチマークの数字は「自社の業務」ではない

公表されている性能は、標準化された評価環境での結果です。日本語の業務システム、社内独自の画面、古い基幹システムの上で同じように動くかは別の話で、現時点では検証されていません。「速くなった」を「自社でも使える」と読み替えず、小さく試して確かめる姿勢が現実的です。

もうひとつは権限の設計です。AIが画面を操作できるということは、AIに渡したアカウントでできることは、すべてAIができてしまうということでもあります。基幹システムの管理者アカウントや、経理の決済権限を持つIDをそのまま渡す運用は避けたいところです。閲覧のみのアカウントを別に用意する、更新はAIに下書きさせて人が確定させる、といった線引きから始めるほうが安全です。サイバー能力が高く評価されたモデルであることも踏まえると、権限を絞る設計は今後さらに重要になっていくと考えられます。

導入の実務面では、プランと管理者設定の確認も必要です。ChatGPTのBusiness/Enterpriseへは数日かけて順次展開とされており、組織によっては管理者が対象ユーザーに有効化する操作を求められる場合があります。「発表された=明日から全員が使える」ではない点に注意してください。

今やるべきこと

📝

補足

新しいモデルが出るたびに全部を試す必要はありません。自社で時間を食っている業務が変わらない以上、見るべき順番も変わりません。「うちで一番時間がかかっている作業に効くか」だけを物差しにすると、情報に振り回されにくくなります。

出典

※本記事は2026年9月6日時点の公開情報にもとづきます。提供範囲・機能・料金は今後変更される可能性があります。最新は公式サイトで必ず確認してください。

「人が足りないのに、何から手をつければいいか分からない」——そんな時は。

AI参謀を運営する株式会社オタツーは、EC運営代行4,000件以上の現場で培ったAI活用の知見をもとに、中小企業のAI導入・業務省人化を伴走支援しています。補助金の活用可否も含めて、まずは無料でご相談ください。