「AIがもっと自律的に仕事を進められるようになった」
そんな話を聞くと、僕はまず試したくなる。
資料づくり。記事の整理。毎回ちょっと面倒な作業。
「あれも任せられる? これもいける?」と、お願いしたい仕事が増えていく。笑
2026年9月3日、OpenAIはGPT-6 Astraを公開した。公式のシステムカードには、能力の評価と、それに対応する安全対策が記されている。公式資料
こうした進歩に「AGI時代」という言葉が重なると、期待はさらに膨らむ。
そこで僕が確かめたいのは、こんなことだ。
「その新しい力で、僕らの仕事はどこまでラクになる?」
Human OSでは、人とAIが一緒に働くとき、何を任せ、どう結果を確かめるかを考えている。
その立場から、クラウド君と整理した確認点は3つ。
新しいAIを試すときの、小さな実験メモとして読んでもらえたらうれしい。
①「すごいスコア」を、自分の仕事で確かめる
ベンチマークの数字を見ると、「おお、そこまで来たか!」となる。
ただ、その数字を、そのまま自分の仕事の成功率に置き換えることはできない。
評価で使った課題、操作できる環境、与えられた道具。
自分の現場では、何が同じで、何が違うだろう。
たとえば、記事を整える仕事を任せるなら、文章がきれいになったかに加えて、
元資料の数字や条件が残っているか
読みやすくする途中で、意味が変わっていないか
指定した形式で受け取れるか
まで見たい。
「いい感じにお願いします」だけだと、僕とAIで“いい感じ”が違うかもしれない。
こっちは軽く散髪のつもりなのに、別人の髪型で帰ってくるやつ。笑
だから、試す前に「何ができたら成功か」を短く決める。
そのうえで、出てきた実物を見比べる。
公式資料でも、失敗が観測されなかったことだけで、さまざまな状況での信頼性が確立するわけではないと説明されている。システムカード・9月9日更新
一度できたら、まず喜ぶ。
次は資料や条件を少し変えて、どこまで同じようにできるか試す。
「今回できた」が積み上がれば、任せ方も更新できる。
②「任せられる仕事」を、一つ切り出す
次に考えたいのは、自分の仕事のどの部分を渡すか。
いきなり「広報を全部よろしく!」だと、範囲が広い。
記事の整理、画像づくり、投稿、反応の確認。実は、いくつもの仕事が混ざっている。
まず試すなら、こんな切り出し方がある。
記事を短い投稿文にする
渡すもの:元記事・媒体・残したい要点
終わったあとに見るもの:意味や事実が変わっていないか
会議メモを整理する
渡すもの:メモ・ほしい項目
終わったあとに見るもの:決定事項と未決定事項が混ざっていないか
表の表記をそろえる
渡すもの:元の表・統一ルール
終わったあとに見るもの:行の欠落や、数値の変更がないか
これは試し方の例で、GPT-6 Astraでの検証結果ではない。
僕がHuman OSで目指しているのも、こうやって任せられる仕事を、実物を見ながら増やしていくことだ。
その際は、完成物だけでなく、人間の手間も見る。
頼むための説明にどれくらいかかったか。
直す箇所はどれくらいあったか。
次も同じ方法で頼めそうか。
確認に時間がかかりすぎたなら、それも改善材料になる。
渡す資料を変える。依頼を小さくする。別のAIや道具を試す。
ゴールを持ったまま、やり方はどんどん工夫していい。
失敗したら、AIと反省会。
「で、次はどこを変えて試す?」までつなげたい。
③「できること」と「任せてよい範囲」を合わせる
最後は、AIが動ける範囲の話。
下書きを作る。
公開ボタンを押す。
有料サービスを契約する。
同じように画面を操作できても、その結果の重さは違う。
OpenAIはAstraの公式資料で、サイバー能力が同社の評価枠組みの「Critical」水準に達したと説明し、対策の強化や、正当な防御用途に対する段階的なアクセス提供を記している。公式資料・能力評価と安全対策
ここから「安全策があるから能力が低い」と判断することはできない。
能力が高まったときに、その力をどう使える形にするかも大事になる。
僕らの日常の仕事でも、先に決めておくと進めやすい。
たとえば、
元ファイルを残して、作業用コピーを編集してよい
承認した内容・相手・範囲で送信してよい
新しい契約や予算超過は、人間に確認する
という具合だ。
任せると決めた範囲では、進んでもらう。
途中で方法が合わなければ、その範囲内で別の方法を試してもらう。
毎回「ここまでやっていいですか?」と止まっていたら、
僕の新しい仕事が「承認ボタン係」になってしまう。笑
大事な判断は人間が持つ。
そのうえで、AIが自分で進めてよい部分を具体的にする。
そして最後は、実際の状態を確かめる。
投稿なら公開ページ、ファイル編集なら編集後のファイル。
「できました!」の報告と、できた実物をつなげる。
今日、ひとつ試すなら
まずは、繰り返している仕事を一つ選んでみてほしい。
その仕事について、次の4行を埋めるだけでも、試し方が具体的になる。
試したい仕事:
AIに渡す資料:
できたと判断する条件:
AIが進めてよい範囲/人間に確認する条件:
最初は、戻せる作業からでいい。
試したあとに「できたこと・困ったこと・次に変えること」を一言ずつ残す。
僕は、新しいAIへの期待を、そのまま次の実験につなげたい。
ワクワクしたら、試す。
結果を見たら、任せ方を更新する。
ちゃんとできたら?
そりゃ、祝勝会です🙌
AIと人間、次はどんな仕事を一緒にできるだろう。
参照:OpenAI「GPT-6 Astra System Card」(2026年9月3日公開、9月9日更新記載あり/2026年9月21日確認)。公式発表の説明と、本記事で提案する仕事の試し方は区別しています。本記事はGPT-6 Astraの独自実測レビューではありません。