AI News×Hiro

一番強いAIは、お金を出せば買えるものではなくなった|9月2日 AIニュースまとめ

・約16分で読めます

新しいAIが出たというニュースは、これまでずっと「今日から誰でも使えます」とセットでした。

昨日(9月1日)、その前提が崩れました。AnthropicとOpenAIが同じ日に、それぞれの最上位モデルについて「一番強い版は審査を通った組織にしか渡さない」という判断を出しています。示し合わせたわけではないはずですが、結果として同じ形になりました。

値下げのニュースもあります。ただし安くなったのは特定の使い方だけで、多くの会社には関係ありません。そこを切り分けるところから書きます。


昨日書いた「来週の注目ポイント」の答え合わせ

このシリーズでは、前回書いた注目ポイントを翌日必ず検証しています。今日は4つのうち、1つ前進しました。

✅ 補助金の「食い違い」、原因の見当がついた

デジタル化・AI導入補助金の第6次締切について、3日間ずっと「事務局のページには載っていないのに、別のページには10月30日と書いてある」と書き続けてきました。

今日、事務局のスケジュールページをあらためて開いて、同じページの中に10月30日という日付があることに気づきました。

| 枠 | 確定している締切 | |---|---| | 通常枠・インボイス枠・セキュリティ対策推進枠 | 1〜5次:9月29日(火)17:00 | | 複数者連携デジタル化・AI導入枠 | 1〜3次:10月30日(金)17:00 |

複数者連携枠の第3次締切が、ちょうど10月30日です。

つまり「第6次=10月30日」という記載は、枠が違う日付を取り違えている可能性が高い。3日かけてやっと、確認すべき問いが1文になりました。「第6次の締切は決まっていますか。10月30日は複数者連携枠の3次締切ではないですか」——これなら電話1分で終わります。

ただし断定はしません。中小企業庁側のページが今日も開けず、突き合わせて確かめたわけではないからです。仮説が立っただけで、確認はまだしていません。

支援先に説明するときは、今日時点でも「確定しているのは9月29日17時の5次まで。6次は未公表」で統一してください。

🔮 省力化投資補助金 第8回:「9月中旬」のまま

申請受付開始は「2026年9月中旬(予定)」のまま動いていません。確定しているのは公募開始日(8月18日)だけです。

もう日付を待つのはやめます。基準年度の定義が後ろにずれたことで、賃上げ計画の組み方が変わる——ここが実務に効く変更なので、次回は実際に1社分の数字で試算した結果を書きます。

🔮 Claude Codeの利用上限変更:3日連続で公式に記載なし

9月14日施行とされている週次利用上限の変更について、公式のリリースノートと発表ページを今日も確認しましたが、記載はありません。3日連続です。

ここで気づいたことがあります。同じリリースノートに、昨日出た新モデルの情報は当日中に載っています。 機能が増えたことは即日わかるのに、使える量が変わることは公式からはわからない。

施行まで12日。このまま当日を迎えたら、「公式に確認できない変更が実施された」という事例が1件、記録として残ります。ツールを人に勧める立場だと、この記録には値打ちがあります。

✅ GitHub Copilotの件:ページは開けた。でも答えは書いていなかった

一昨日403で開けなかった公式ページに、今日はアクセスできました。内容は報道どおりで、9月28日以降、チャットの保存期間が28日間から「アカウントがある限りずっと」に変わります。

ただ、知りたかったこと——個人向けプランが対象に含まれるのか——は、公式ページにも書かれていませんでした。対象がプランではなく「どの画面で使うか」で決まる書き方になっているためです。

「まだ確認できていない」から「確認したうえで、書かれていないと分かった」に変わりました。地味ですが、ここは進歩だと思っています。


注目ニュース TOP3

① 同じモデルを、性能ではなく「安全装置の水準」で2つに割った

何が起きたか

Anthropicが新しいモデルを2つ同時に出しました。Claude Fable 5.1とClaude Mythos 5.1です。ただし公式の説明によると、この2つは同じモデル。違うのは安全装置の強さだけです。

  • Fable 5.1:一般提供。誰でも使えます
  • Mythos 5.1:審査を通った組織だけ。サイバーセキュリティとライフサイエンスの業務向けに制限が緩めてある。今のところ米国の組織限定

同じ日に、GitHub CopilotでもFable 5.1が使えるようになりました。

なぜ重要か

「性能違いの上位版・下位版」ではなく、中身は同じで、安全装置の設定だけが違う2つを別の名前で出した。これが新しいところです。

価格の話もします。入力・出力の料金は据え置き(100万トークンあたり入力$10、出力$50)。動いたのはキャッシュ読み込みで、$1.00から$0.25へ、75%下がりました。

トークンというのは、AIが文章を扱うときの文字のかたまりのことです。ここでの「キャッシュ読み込み」は、毎回同じ前提文書を読ませるときの料金だと思ってください。

この料金は普通、入力料金の10%くらいが相場です。今回は2.5%になりました。つまり「毎回同じ長い前提を読ませて、そのうえで短く質問する」使い方だけが、集中的に安くなった。

→ 採用・中小企業への影響

10〜50人の会社が採用でAIを使うとき、実は「毎回同じものを読ませる」使い方が中心になります。自社の求人要件、評価基準、過去の面接メモ、社風の説明。それを毎回頭に置いたうえで「この応募者をどう見るか」を聞く。今回の値下げは、まさにこの型を狙い撃ちしています。

逆に、思いついたことを都度短く聞いているだけなら、この値下げはほとんど効きません。同じ「25%安くなりました」というニュースでも、効く会社と効かない会社に分かれます。

→ 個人の実務・副業への影響

GitHub Copilot経由なら昨日から使えます。Copilot Proは月10ドルなので、API(プログラムから直接AIを呼ぶ仕組み)の従量課金を気にせず新しいモデルを試すなら、こちらのほうが入口として現実的です。

もうひとつ、見落としやすい変更があります。 9月1日以降に新しく作ったAPIアカウントでは、会話の途中でAIの過去の発言を書き換えながら、その思考の記録を保ったままにする、という操作ができなくなりました。他社が出力を吸い上げて自社モデルを作るのを防ぐための措置です。既存のアカウントは当面そのままですが、将来のリリースで適用されると公式に書かれています。

APIを使った仕組みを組んでいる人は、この「将来」がいつ来るかを監視項目に入れておいたほうがいいと思います。

僕はこう思う

Terminal-Bench-Scienceという評価で52.6%(前の世代は24.7%)という数字が出ていて、正直に言えば目を引きます。ただ、まだ自分の仕事では触れていません。 数字の出どころが公式ページであることは確認しましたが、それ以上のことは書けない。

明日以降、求人票のたたき台づくりで実際に回してみて、キャッシュの効き方が体感でわかったら報告します。


② AI面接と採用管理を一体化したツールが、月3万円を6か月無償で開放

何が起きたか

AI面接と採用管理システムを一体化した「QRUU(クルー)」というサービスが、月額30,000円のプランを6か月無償提供するプログラムを始めました(8月31日発表)。申込期限は12月31日で、期間終了後に自動で有償に移行しないと明記されています。

応募者がブラウザのリンクを開いてAI面接官と音声で話し、システムが録画・文字起こし・評価の下書きまで作る。採用管理の側は、候補者リスト、選考の進み具合の管理、選考にかかった日数や離脱理由の分析、Googleしごと検索やIndeedへの求人配信を含みます。

そして**「合否はAIが決めません。一次選考のたたき台で、最終判断は採用のご担当者が行います」**と公式リリースに明記されています。

なぜ重要か

リリースに載っている数字が、この製品の狙いを説明しています。採用担当者の72.4%が他の仕事と兼任していて、中小企業では主担当の85%以上が役員か管理職。つまり一次面接の実施が、社長や部長の時間を直接削っている、という前提に立っています。

6か月という長さも意味があります。中小企業の採用は、求人を出してから決まるまで3〜4か月かかることが珍しくない。6か月あれば、導入して1周回して、効果を判断するところまで届きます。

→ 採用・中小企業への影響

ひとり人事にとっては、面接の実施そのものより**「日程調整」と「面接後に評価をまとめる作業」**のほうが重い、というのが現場でよく聞く話です。この製品は両方に手を入れています。

ただ、試す前に確認してほしいことが2つあります。

1つ目、解約したときに応募者のデータをどう持ち出せるか。 採用管理システムは会社の採用履歴が全部入る場所です。6か月無償の終わりが「データの終わり」にならないか、契約前に文書で確認してください。CSVで全件出せるのか、画面で見るだけなのか。

2つ目、提供元は設立2024年2月・資本金300万円の会社です(リリース記載)。製品の良し悪しとは別の話として、応募者の個人情報を預ける先としてどう考えるかは、社長と一度話しておくべき論点だと思います。

無償だから軽く始められる、は正しい。無償だから確認を省いていい、は違います。

→ 個人の実務・副業への影響

応募する側から見ると、AI面接に当たる確率がこれから上がります。この製品が「合否はAIが決めない」と書いていることは、裏を返せば「評価の下書きはAIが作る」ということです。

話した内容が文字起こしされて残る前提だと、結論から先に言う、具体的な数字を1つ入れる、といった話し方が効いてきます。

僕はこう思う

「AIが合否を決めない」と最初に書いてある採用ツールは、個人的に信用度が上がります。採用は間違えたときのコストが応募者の側に偏る仕事なので、どこで人間が責任を取るのかを製品側が先に宣言しているかどうかは、けっこう大きな差だと思っています。


③ OpenAIの新モデル、「これは危ない水準かもしれない」と自分で言って配布を絞った

何が起きたか

OpenAIが近く出すモデル「Astra」について、自社の評価で**「重大」レベルのサイバーセキュリティ能力に達している可能性を否定できない**と公表しました。

専門家による検証で、堅牢に守られたブラウザとOSに対して未知の弱点を見つけ、実際に動く攻撃の連鎖を組み上げたとされています。HTMLファイルを開かせるだけで隔離環境を抜け出し、パソコン本体の側でコマンドを実行するところまで到達した、という記述です。

対応として、サイバーセキュリティ用途の提供は当初ごく少数のテスターに限定し、その後、防御目的の利用に向けて段階的に広げるとしています。

なぜ重要か

ここが今日いちばん興味深いところです。

Anthropicの「Mythos 5.1」(審査を通った組織のみ・米国限定)と、OpenAIの「Astra」(少数のテスターから段階的に)が、同じ日に、同じ形の判断に着地しました。

能力を上げること自体は止めない。ただし一番強い版は、誰にでも売る対象から外す。

これまで新しいモデルの発表は「今日から誰でも使えます」がセットでした。昨日の2件は「一番強い版は審査を通った組織だけ」です。 業界の前提が1段階動いた日だと思っています。

→ 採用・中小企業への影響

「せっかくなら一番いいモデルを使いたい」と言われたときの説明が、今日から変わります。

「一番いいモデル」は、お金を払えば買えるものではなくなりつつある。 まずこの事実を共有する。そのうえで、採用や人事の仕事に必要な能力は、一般に提供されている版で十分に足ります——この順序で話すと、性能競争の話に引きずられずに済みます。

実際、求人票を書く、応募書類を整理する、面接の記録をまとめる。このあたりの仕事で「最上位モデルでないと届かない」ものは、今のところ見当たりません。

→ 個人の実務・副業への影響

副業でセキュリティ関連の仕事に関わっている人には、直接効いてきます。能力の高いモデルが「所属組織の審査」を前提にする方向なので、個人事業主の立場だと入口が狭くなる可能性がある。今のうちに、どのプログラムがどんな条件なのかを見ておく価値はあります。

僕はこう思う

正直に書いておきます。この項目だけ、一次情報を自分の目で読めていません。 OpenAIの公式ページが今日もアクセスできず、URLは特定できているのに本文に届きませんでした。

検索経由で読める抜粋と、TechCrunchの記事の内容は一致しています。だから内容としては書いていますが、「公式ページを自分で開いて確認した」状態ではない。 人に話すときは、そこは正直に添えます。


AIツール・アップデート情報

・GitHub Copilot のコードレビューが、プルリクエストを承認できるように(9月1日) → ここは設計が丁寧です。既定では承認しません。管理者が明示的に有効にする必要があり、有効にすると必須承認の数にカウントされます。そして承認したあとに新しい変更が加わると、承認は自動で取り消されます。対象を特定のファイルだけに絞ることもできる。

この「既定はオフ・範囲を限定・前提が変わったら自動で取り消し」という3点セットは、採用の仕組みにそのまま移せる考え方です。たとえば「応募書類が差し替わったら、一次通過の判定は無効に戻る」。AIに何かを任せるときの設計として覚えておくと使えます。

・Anthropic「Enterprise Frontier Safeguards」(9月1日) → 監視のログをAI会社側ではなく、顧客自身のクラウドに保存する仕組み。暗号化の鍵も顧客が持ちます。100社以上が開発に参加。中小企業がそのまま契約できる話ではありませんが、「ログは自社に置く・鍵は自社が持つ・確認は自社がする」という構造は、社内ルールを作るときの考え方として借りられます。

・Hugging Face、ブラウザ上でAIを動かすための部品を200種類以上公開(9月1日) → 手元のパソコンの中だけで処理を完結させたい場合の選択肢が増えました。応募者の情報を外に出したくない場面で、いずれ効いてくる方向性です。

・「履歴書作成できるくん」提供開始(9月2日) → 会員登録もログインも不要、完全無料、最短3分。求職者側のツールですが、自社の応募フォームがこれより手間だったら見直す価値がある、という基準として使えます。

ツール選びのワンポイント:今日は新しいものが多い日でしたが、僕は基本的に「増やすより1つを深く使う」派です。今日の中で言えば、Copilotの承認機能のように既定がオフになっているものは、慌てて有効にしなくていい。設定を触る前に、自分の仕事のどこに効くかを1行で言えるか確かめてからで間に合います。


AIが中小企業の採用・現場をどう変えるか

今日のニュースから、10〜50人の会社に効く話を2つに絞ります。

1.「毎回同じものを読ませているか」を棚卸しする(15分)

昨日の値下げが自社に効くかどうかは、価格表ではなく使い方の型で決まります。紙1枚で判定できます。

  1. AIに毎回読ませている「変わらない情報」は何か(求人要件・評価基準・社風の説明・過去の面接メモ)
  2. それは毎回コピペで貼り直しているか、仕組みとして固定してあるか
  3. 1回のやりとりで、読ませる文章と質問文はどちらが長いか

3で「読ませる文章のほうが長い」かつ2が「毎回コピペ」なら、今回の値下げが効く型です。前提を固定して置いておく形に変えるだけで、コストの構造が変わります。

逆に、都度思いついたことを短く聞いているだけなら、この値下げは自社に関係ないと判断していい。ニュースを見て焦る必要はありません。

「安くなったらしいから使おう」ではなく「この使い方だからこう効く/この使い方には効かない」と切り分けられること。これが今日いちばん実務に近い話だと思います。

2. AI面接ツールを試すなら、契約前に「出口」を決めておく

無償や低額で始められるAI面接ツールは、これから増えます。試すこと自体は勧めますが、入口ではなく出口から確認してください。

  • 解約したとき、応募者データをどの形式で持ち出せるか(CSVで全件出せるか、画面で見るだけか)
  • AIが作る「評価の下書き」を、誰がどこまで見て最終判断するかを、社内で先に決めてあるか

2つ目が特に大事です。「合否はAIが決めない」と製品が明記していても、下書きが目の前に出てくると、人の判断はそれに引きずられます。

「下書きは読む。ただし判断の理由は自分の言葉で書き直す」——このルールを導入前に決めておくと、あとで応募者や社内から理由を聞かれたときに困りません。


個人の副業・実務への影響

新しいモデルは、まず自分の手元で1回動かしてから評価する。

Fable 5.1はGitHub Copilotで昨日から使えます。Copilot Proは月10ドルなので、従量課金を気にせず試せる。評価の数字は前の世代の倍以上が出ていますが、自分のコードで1回動かしてから信じるかどうか決める、が順当な進み方だと思います。

そしてもう1つ。Copilotのコードレビューが承認できるようになった件は、既定がオフです。勝手に有効にはなりません。ただ、ひとりでリポジトリを回していて必須レビューを設定している人は、有効にすると承認の相手ができることになる。新しいコミットを積むと承認が消える仕様も込みで確認しておくと安心です。


今日のまとめ:能力が上がるほど、配り方は狭くなる

昨日1日で起きたことを一言でまとめると、**「一番強いAIは、お金を出せば買えるものではなくなった」**です。

AnthropicもOpenAIも、能力を上げること自体は止めていません。止めたのは配り方のほうです。最上位の版は審査を通った組織だけ。示し合わせたわけではないのに同じ形になったのは、両社が同じ問題に直面しているからだと思います。

僕が一番気になったのは、値下げのニュースのほうです。 「25%安くなった」という見出しだけ見ると全体が安くなったように読めますが、実際に下がったのはキャッシュ読み込みという一部分でした。効く会社と効かない会社が、使い方の型ではっきり分かれる。

こういうニュースが増えるほど、**「自社に効くかどうかを自分で判定できること」**が効いてきます。今日書いた紙1枚の棚卸しは、そのための道具です。

補助金の件も同じでした。3日かけて分かったのは、別のページの数字を見ていた可能性が高いということ。答えではなく、確認すべき問いが1文になっただけです。それでも前には進んでいます。


来週の注目ポイント

① 補助金事務局に電話して、「10月30日は複数者連携枠の3次締切ではないか」を確認する → 3日かけてようやく、問いが1文になりました。調べ物としてはここが限界で、あとは電話1本です。3日先送りした自覚があるので、次回は結果を最初の行に書きます。

② 省力化投資補助金 第8回:日付ではなく「試算」を出す → 受付開始まで2週間を切りましたが、日付を待つのはやめます。基準年度の定義が変わったことで賃上げ計画の組み方が変わるので、実際に1社分の数字を当てた結果を書きます。

③ Claude Codeの利用上限変更(9月14日):あと12日、公式記載は3日連続でなし → 新モデルの情報は即日載るのに、使える量の変更は載らない。 この非対称が3日続いています。このまま当日を迎えるなら、事例として記録が完成します。

④ Fable 5.1の「新規アカウントへの制限」が、既存アカウントにいつ来るか → 9月1日以降に作ったAPIアカウントには既に適用済みで、既存アカウントは「当面は影響なし、将来のリリースで適用」と公式に書かれています。APIで仕組みを組んでいる人には、この「将来」がいつかが直接効きます。

新しいモデルが出た日ほど、数字より先に「自分の使い方に効くか」を確かめるほうが早いです。気になったら、まず手元で1回動かしてみてください。


この記事はHIRO(@hiro_tsumugu)のAIニュースまとめシリーズです。 情報は2026年9月2日時点のものです。

今日の取りこぼしについても書いておきます。OpenAIとxAIの公式ページ、経済産業省のAI政策ページ、中小企業庁の補助金ページは、今日もアクセスできませんでした。 The Verge、Axios、Ars Technica、CNBCも同様です。国内のHR領域は主要サイトを回りましたが、HRzineはアクセスを拒否され、ASCII.jpと日経クロステックはこちらが開こうとしたページが見つかりませんでした。取りこぼしがある前提で読んでください。

TSUMUGU — 採用AI内製化コーチ 地方中小企業の採用を、AIを使って内製化する伴走サービスを提供しています。

NEXT STEP

採用AIの内製化を、自社で始める。

この記事を読んで「自分の状況でも整理したい」と感じた方は、SUNAOの各入口から現在地を一緒に整理できます。

採用AI内製化チェックリストと週1メルマガで、何から手をつけるかが具体になる。情報収集の段階から、自社で動ける状態へ。

SUNAO FAMILY

SUNAOブランドの3つのサイト