【AIニュース 10/4】AIがブラウザを操る時代へ — 今日の注目9選

こんにちは、まこっちです。今日は10月4日、日曜日ですね。

今日のAIニュースは9本なんですが、個人的に一番面白かったのが、AIエージェントがブラウザを自分で開いて操作できるようになった、というOpenAIのニュースです。「今まで人間がやっていたリサーチが丸ごとAIに渡せるかも」と思って、これは現場にインパクトあるなと感じています。

ほかにもGrokがWord・Excelで使えるようになったり、NVIDIAが75万円のローカルAIスーパーコンピュータを出したりと、盛りだくさんです。では早速いきましょう。

—

1. ChatGPT モバイルスキャン — iPhoneで複数ページを一気に撮ってPDFにしてAIと話せる

📺 画面表示用

  • 公式/主要ソース: https://help.openai.com/en/articles/6825453-chatgpt-release-notes
  • ChatGPTのiPhoneアプリで、書類や手書きノートを複数ページ一気にスキャンして、自動でPDF一冊にまとめてくれる機能が追加されました。カメラを開いてメニューから「Scan」を選ぶだけで使えるんですね。手元の紙をAIに読ませてから相談したい、という場面って結構あると思うんですよ。そのひと手間がずいぶん楽になった感じで、地味に見えてじわじわ嬉しいアップデートです。

    講師視点コメント: 受講生からの手書きのワークシートや感想用紙を撮影して、そのままChatGPTに「傾向をまとめて」と投げられるようになりますね。今まではスキャナーを使うか1枚ずつ写真を撮るかでしたが、複数ページを一気に読み込めるのは地味に助かります。セミナー現場や個別コンサルで紙を使っている方は、1回試してみてほしいです。今日使えるアップデートなので、iPhoneを持っている方はすぐ触ってみるといいんじゃないかなと思います。

    —

    2. Gemini Skills — GoogleのAIカスタマイズ機能がWorkspaceとGeminiアプリに広がる

    📺 画面表示用

  • 公式/主要ソース: https://workspaceupdates.googleblog.com/2026/09/skills-gemini-app-workspace.html
  • GeminiアプリとGoogle Workspaceに「スキル」という新機能が展開されます。スキルっていうのは、繰り返し使う指示をあらかじめ登録しておいて、いつでも呼び出せる仕組みのことで、今まであったGemsの後継なんですね。10月5日からWorkspaceへの展開が始まって、10月13日からGeminiアプリにも広がる予定です。Markdownで書けるので、他のAIツールで作ったものをそのまま持ち込めるのも便利そうですよ。

    講師視点コメント: 「台本の骨格を作って」「メール文案を書いて」「このテーマで質問を5個作って」といったよく使う指示をスキルとして保存しておけば、毎回長いプロンプトを打たなくて済むようになります。Google Workspaceをメインで使っている方にとっては、Gmailや Docsの中でそのまま呼び出せるのがポイントですね。明日10月5日からWorkspaceへの展開が始まるので、Googleアカウントを持っている方はすぐ確認できます。自分がよく使う指示を3つくらいメモしておいて、スキルとして登録する準備をしておくといいんじゃないかなと思います。

    —

    3. OpenAI Agents API Hosted Browser — エージェントがブラウザを自分で操作できるようになった

    📺 画面表示用

  • 公式/主要ソース: https://aiagentsdirectory.com/news/ai-agents-news-brief-october-1-2026
  • OpenAIのAgents APIに、「Hosted Browser」という機能が追加されました。エージェント、つまり指示すると自分で段取りして動いてくれるAIのことなんですけど、そのエージェントがブラウザを直接開いて操作できるようになったんですよ。例えば「このページの情報をまとめて」と言うと、AIが実際にブラウザを起動してやってくれます。今まではAPIでデータを取るしかなかった部分がブラウザ操作で済むようになって、自動化できることがかなり広がった感じですね。

    講師視点コメント: これは「コードが書けない人には関係ない話」と思うかもしれないんですが、実はそうじゃないんですよ。この技術が進むと、「〇〇についての最新情報を複数サイトから集めてまとめて」という指示を、ツールなしでAIだけに任せられるようになります。コンテンツ制作のリサーチ作業が、ほぼ丸ごとAIに渡せる日が近づいている感じです。今すぐ自分で試せるわけじゃないですが、「AIがリサーチしてくれる前提でコンテンツ制作フローを組み直したらどうなるか」を想像してみると、準備できることが見えてくると思います。

    —

    4. Grok × Microsoft Copilot — Word・Excel・PowerPointにxAIのGrokが加わった

    📺 画面表示用

  • 公式/主要ソース: https://www.microsoft.com/en-us/copilot/blog/copilot-studio/more-choice-more-flexibility-xai-grok-4-1-fast-now-available-in-microsoft-copilot-studio/
  • GrokっていうXが作ったAIが、Microsoft CopilotのWord・Excel・PowerPointで使えるようになりました。今までOpenAIのモデルとAnthropicのClaudeが並んでいたところに、Grokも仲間入りしたんですね。まだFrontierプログラムっていう、先行テスターの方向けの段階なんですが、近いうちに広く展開される予定です。企業のオフィス文書をGrokで処理できる時代が、ちょっとずつ近づいている感じです。

    講師視点コメント: Grokを使ったことない方も、Copilot経由で触れる機会が近いうちに来そうです。複数のAIを同じ画面で使い比べられるようになると、「自分の仕事はどのAIが一番合うか」を試せる環境が整ってきますよね。まだ先行テスターの段階なので焦る必要はないんですが、「Microsoft Officeをよく使っていてCopilotの設定をそもそもしていない」という方は、一度設定を見直してみるいい機会かもしれないです。Officeの自動化に関心がある方は、Frontierプログラムへの申し込みを確認してみてほしいですね。

    —

    5. Adobe × ChatGPT — マーケティングワークフロー全体がChatGPTから動かせるように

    📺 画面表示用

  • 公式/主要ソース: https://aimagazine.com/news/adobe-openai-new-chatgpt-capabilities-with-a-plugin
  • AdobeとOpenAIが組んで、企業向けの大きな連携を始めました。AdobeのWorkfront、これは仕事のプロジェクト管理ツールなんですけど、そこにOpenAIのエージェントが入ってきて、コピーライティングから素材チェックまで自動でやってくれるようになります。さらに「CX Enterprise Coworker」というプラグインを使えば、ChatGPT経由でAdobeのマーケティングワークフロー全体を動かせるんですよ。AdobeとOpenAIが一緒になって、制作とAIをどんどん近づけているのを感じますね。

    講師視点コメント: 今すぐ個人で使えるものではなく、どちらかというと企業規模の話ではあるんですよ。ただ、AdobeとOpenAIがここまで深く組むということは、今後のクリエイティブツールがAI前提で設計されていく、という流れが加速しているということです。Adobeのツールを使っている方は、どんな連携が出てくるか注目しておくといいです。制作の外注先や協力会社がAIでどこまで自動化できるようになるか、という視点でも見ておくと、今後の仕事の仕方が見えてきそうですね。

    —

    6. NVIDIA DGX Spark 64GB — 約75万円で自分のデスクにAIスーパーコンピュータを置ける

    📺 画面表示用

  • 公式/主要ソース: https://techaeris.com/2026/10/03/nvidia-unveils-64gb-dgx-spark-at-4999/
  • NVIDIAが、自分のデスクの上に置けるAIスーパーコンピュータを発表しました。価格は4999ドル、日本円でざっくり75万円ぐらいですね。これが面白くて、クラウドに頼らずに1000億パラメータ級のモデルを自分のパソコンで動かせるんですよ。2台つなげるとさらに性能が上がる仕組みもあって、10月23日に発売予定です。「AIはネットにつないで使うもの」という感覚が、少しずつ変わってきているなと思います。

    講師視点コメント: 75万円と聞くと「ちょっと無理」と感じると思うんですが、ここで大事なのは「クラウドに情報を出さずにAIが使える」という選択肢が生まれてきた、ということだと思います。個人情報を扱うコーチや医療・教育分野の方にとって、クラウドに情報を流さないAIは重要な選択肢です。今すぐ買う必要はないですが、「ローカルAI」というキーワードを頭に入れておいて、自分の仕事でどんな場面に使えそうかを想像しておくといいんじゃないかなと思います。

    —

    7. Claude Opus 5.5 リリース — フラッグシップ品質のまま40%コストが下がった

    📺 画面表示用

  • 公式/主要ソース: https://www.thurrott.com/a-i/anthropic/341913/anthropic-releases-claude-opus-5-5
  • Anthropicが9月22日に、Claude Opus 5.5という最新のフラッグシップモデルをリリースしました。性能はFable 5.1と同じくらいなのに、以前のOpus 5と比べてコストが40%下がっているんですよ。スピードも30%以上速くなっていて、AWS・Google Cloud・Microsoft Azureのどのクラウドでも使えます。今後はSonnet 5.5とHaiku 5.5も順番に出てくる予定で、Claudeがまた一段階アップグレードされましたね。

    講師視点コメント: Claude APIを使ったツールやサービスを使っている方には、このコスト削減がじわじわ効いてきます。提供側がコストを下げてくれれば、使う側の料金も安くなる可能性がありますからね。Claude API自体を使って自分のツールを作っている方や、Claude Codeを使っている方は、Opus 5.5に切り替えることで以前より安く同じ品質を出せるようになります。「高くて使いにくかった」と感じていた方は、今一度プランを見直してみるといいタイミングですね。

    —

    8. Meta Muse Spark 1.3 — MetaがLlamaとは別の独自有料AIを本格展開中

    📺 画面表示用

  • 公式/主要ソース: https://artificialanalysis.ai/models/muse-spark
  • Metaが独自の有料AIモデル「Muse Spark」を本格的に展開しています。もともとMetaってLlamaという中身を公開したモデルで知られていたんですが、それとは別に、ビジネス向けの独自モデルに力を入れ始めているんですよ。9月にリリースされたMuse Spark 1.3は、テキスト・画像・動画を扱えて、コンテキストウィンドウ、一度に処理できる文章の量なんですけど、それが100万トークンとかなりの規模です。AIの大手がみんな有料の独自モデルを持つ時代になってきましたね。

    講師視点コメント: Metaはこれまで「無料で公開」が売りだったんですが、独自の有料モデルを出したことで、OpenAI・Anthropic・Google・Meta・Microsoftが全員「独自の有料AIモデル」を持つ構図になってきました。どのAIを使うかを選ぶ視点が、講師としてもどんどん大事になっています。Meta AIアプリを使ったことがない方は、一度触ってみて「自分の仕事にどう使えそうか」を試してみるといいです。競争が激しいほど使う側にとっては選択肢が増えて、価格も下がりやすいので、この状況はユーザーにとってはプラスだと思います。

    —

    9. Claude Code 信頼性・UX大幅アップデート — 中断再開・プラグイン・MCPがかなり安定

    📺 画面表示用

  • 公式/主要ソース: https://support.claude.com/en/articles/12138966-release-notes
  • Claude Codeが、使い勝手の面で大きく改善されました。途中で止まった作業を再開するresumeの動きが賢くなったのと、プラグインやMCP、これはAIとツールをつなぐ窓口みたいなものなんですけど、その信頼性がグッと上がっています。クラウド環境やSDKとの相性もよくなって、全体的に「落ちにくく、スムーズになった」感じなんですよ。日々Claude Codeを使っている方には体感できる変化があると思います。

    講師視点コメント: Claude Codeを使った自動化作業が「途中で止まって最初からやり直し」になった経験がある方には、今回のresumeの改善は本当に嬉しいアップデートです。長い処理を任せているときの「どこまでやった?」という不安が減ります。プラグインやMCPで外部ツールをつないでいる方も、つながりが安定したことで長時間の処理が通りやすくなっているはずです。Claude Codeを最近使っていなかった方も、今日のタイミングでアップデートして使い直してみるといいんじゃないかなと思います。

    —

    今日の一番 — 現場に入れる1アクション

    今日の9本から選ぶなら、3番「OpenAI Agents API Hosted Browser」。

    理由は「AIが自分でブラウザを動かせる」という技術が広がると、コンテンツ制作のリサーチ作業の前提が変わるからです。

    今日すぐできることとして、自分のリサーチ作業を1つ書き出してみてほしいんですよ。「このテーマの最新情報を調べて」「〇〇についてのブログを5本読んでまとめて」みたいな、今は自分でやっているリサーチ作業です。それをAIに任せられたとしたら、何が変わるか。何の時間が空くか。そのイメージを持っておくだけで、ツールが出てきたときにすぐ動けるようになります。

    AIが自動化してくれる範囲が広がれば広がるほど、自分の「目利き力」と「発信の個性」が大事になってきます。情報収集はAIに任せて、自分は「見方を伝える人」になる準備を、今から少しずつしておくといいんじゃないかなと思います。

    —

    今日のニュースは以上です。

    今週のキーワードを一言でまとめるとしたら、「AIが自律的に動ける範囲が広がってきた」週だったなと思います。ブラウザを動かすエージェント、オフィスソフトに入ってきた新しいAI、手元で動くローカルAI。どれも「AIを使う人」より「AIが動いてくれる環境」が整ってきている感じですね。

    明日からもいい学びを。チャンネル登録・コメントもお待ちしています。ありがとうございました。

    —


    この記事はAI音声コンテンツをもとに構成しています。

    メールマガジン

    1日1問毎朝届く講師力に効く質問力