AI注目記事のキュレーターページ

← 一覧へ戻る

重要度 高2026-02-18 01:45:41

エージェント時代におけるAIの活用ガイド

サマリー

AIの利用方法が変化する中、モデル、アプリ、ハーネスの3つの要素を考慮する必要があります。最新のAIモデルは、より高度な機能を提供し、特定のタスクに応じた選択が重要です。特に、AIが実際の作業を行う能力が向上しており、ユーザーはその利点を活かすことが求められています。

本文

私はChatGPTが登場して以来、これまでに8つのガイドを執筆してきましたが、今回のバージョンは過去とは大きく異なります。なぜなら、「AIを使う」という意味が劇的に変わったからです。数ヶ月前までは、ほとんどの人にとって「AIを使う」とは、チャットボットとの対話を意味していました。しかし、最近ではAIをエージェントとして利用することが実用的になり、タスクを割り当てるとAIが適切なツールを使ってそれを実行します。この変化により、どのAIを使うかを決める際には、モデル、アプリ、ハーネスの3つの要素を考慮する必要があります。

同じモデルであるClaude Opus 4.6が、異なるアプリやハーネスで「ChatGPTとClaudeとGeminiを比較せよ」という同じ質問をしました。ハーネスがない場合、情報は古くなりますが、Claude.aiサイトでは最新の情報と検証可能なソースが得られ、Claude Coworkを使用すると洗練された分析と適切にフォーマットされた比較が得られます。

モデルはAIの基盤となる脳であり、主要な3つはGPT-5.2/5.3、Claude Opus 4.6、Gemini 3 Proです。これらはシステムの賢さ、推論能力、ライティングやコーディング、スプレッドシートの分析能力、画像の認識や生成能力を決定します。モデルはベンチマークで測定され、AI企業が改善を競う対象です。人々が「Claudeはライティングが得意」とか「ChatGPTは数学が得意」と言うとき、彼らはモデルについて話しています。

アプリは、モデルと対話するために実際に使用する製品であり、モデルが実際の作業を行うことを可能にします。最も一般的なアプリは、これらのモデルのウェブサイトであるchatgpt.com、claude.ai、gemini.google.comです。最近では、各AI企業が提供する他のアプリも増えており、OpenAI CodexやClaude Codeのようなコーディングツール、Claude Coworkのようなデスクトップツールも含まれます。ハーネスは、AIモデルの力を実際の作業に活かすためのシステムです。アプリにはハーネスが付属しています。ウェブサイト上のClaudeは、Claude 4.6 Opusがウェブ検索を行い、コードを書くことを可能にするハーネスを持っていますが、スプレッドシートの作成やグラフィックデザインの問題に取り組むための指示も含まれています。Claude Codeはさらに広範なハーネスを持ち、Claude 4.6 Opusに仮想コンピュータ、ウェブブラウザ、コード端末を提供し、実際にウェブサイトをゼロから構築、テストすることができます。

最近Metaに買収されたManusは、複数のモデルをラップするスタンドアロンのハーネスでした。最近大きなニュースとなったOpenClawは、主にローカルで任意のAIモデルを使用するためのハーネスです。最近までは、これを知る必要はありませんでした。モデルが製品であり、アプリがウェブサイトで、ハーネスは最小限でした。あなたが入力し、AIが応答し、再度入力するという流れでした。しかし、同じモデルがどのハーネスで動作しているかによって、非常に異なる体験をすることができます。Claude Opus 4.6がチャットウィンドウであなたと話すのは、Claude Opus 4.6がClaude Code内で自律的にソフトウェアを数時間にわたって書き、テストするのとは非常に異なります。GPT-5.2が質問に答えるのは、GPT-5.2がウェブサイトをナビゲートし、スライドデッキを構築するのとは非常に異なります。

これにより、「どのAIを使うべきか?」という質問に対する答えが難しくなりました。なぜなら、答えは今や何をしたいかによって異なるからです。では、現状のモデルについて見ていきましょう。現在のトップモデルは、全体的な能力が非常に近く、一般的に「賢い」ものであり、エラーも少なくなっています。しかし、高度なAIを真剣に使用したい場合は、月額少なくとも20ドルを支払う必要があります(ただし、一部の地域ではより安価なプランもあります)。その20ドルで得られるのは、使用するモデルの選択肢と、より高度なフロンティアモデルやアプリを使用する能力です。現在利用可能な無料モデルが有料モデルと同じくらい優れているとは言えません。無料モデルはすべてチャット向けに最適化されており、非常に速く、話すのが楽しいことが多いですが、正確性や能力は大幅に低下します。誰かがAIが何か愚かなことをする例を投稿する場合、それは無料モデルを使用しているか、賢いモデルを選択していないからです。

フロンティアモデルの大手3つは、AnthropicのClaude Opus 4.6、GoogleのGemini 3.0 Pro、OpenAIのChatGPT 5.2 Thinkingです。すべてのオプションを利用することで、音声モード、画像や文書の表示、コードの実行、良好なモバイルアプリ、画像や動画の作成が可能な最先端のAIモデルにアクセスできます(ただし、Claudeはここでは劣ります)。それぞれ異なる個性と強み、弱みがありますが、ほとんどの人にとっては、自分が最も好きなものを選ぶだけで十分です。現時点では、この分野の他の企業は、モデルやアプリ、ハーネスのいずれかで後れを取っていますが、一部のユーザーにはそれらを選ぶ理由があるかもしれません。カジュアルなチャットでは、正確性が重要でない場合は小型モデルを使用できますが、そうでない場合は高度なモデルを選んでください!

AIアプリ(これについては後で詳しく説明します)を使用する際、電話アプリやウェブサイトを含め、最も重要なことは正しいモデルを選ぶことです。AI企業はこれを簡単にはしていません。単にチャットをするだけなら、デフォルトモデルで問題ありませんが、実際の作業を行いたい場合はそうではありません。ChatGPTの場合、無料版でも有料版でも、与えられるデフォルトモデルは「ChatGPT 5.2」です。問題は、GPT-5.2が1つのモデルではなく、非常に弱いGPT-5.2 miniから非常に優れたGPT-5.2 Thinking、さらに強力なGPT-5.2 Proまで多くのモデルがあることです。GPT-5.2を選択すると、実際には「自動」モードが選択され、AIが使用するモデルを決定しますが、しばしばより弱いモデルになります。有料プランに加入すると、どのモデルを使用するかを選択でき、さらに複雑なことに、モデルが回答について「考える」程度を選択することもできます。複雑な問題には、常にGPT-5.2 Thinking Extended(20ドルプラン)またはGPT-5.2 Thinking Heavy(より高価なプラン)を手動で選択します。非常に難しい問題には、最も強力なモデルであるGPT-5.2 Proを選択できますが、これはより高いコストのプランでのみ利用可能です。

Geminiの場合、3つのオプションがあります:Gemini 3 Flash、Gemini 3 Thinking、そして一部の有料プランでは3 Proです。ウルトラプランに加入すると、非常に難しい問題に対してGemini Deep Thinkにアクセスできます(これは別のメニューにあります)。真剣な問題には、常にGemini 3 ProまたはThinkingを選択してください。Claudeの場合は、Opus 4.6を選択する必要があります(新しいSonnet 4.6も強力ですが、少し劣ります)し、「拡張思考」スイッチをオンにする必要があります。

再度言いますが、ほとんどの人にとって、モデルの違いは小さくなっているため、アプリとハーネスがモデルよりも重要です。これが、より大きな質問に繋がります。チャットボットインターフェースの大多数は、ChatGPT、Claude、Geminiの主要なウェブサイトやモバイルアプリを通じてAIモデルにアクセスするために使用されます。実際、チャットボットは最も重要で広く使用されているAIアプリと呼ぶことができます。ここ数ヶ月で、これらのアプリは互いにかなり異なるものになっています。

いくつかの違いは、AIにバンドルされている機能です。Geminiチャットボットにバンドルされているもの(プラスボタンでアクセス可能):nano banana(現在の最高のAI画像生成ツール)、Veo 3.1(リーディングAI動画生成ツール)、Guided Learning(学習時にAIがよりチューターのように振る舞うのを助ける)、Deep Researchです。ChatGPTには、プラスボタンでアクセスできるオプションのハードポジションがさらに多くあります。画像を作成する(画像生成器はnano bananaにほぼ匹敵しますが、チャットボットを通じてSora動画クリエイターにはアクセスできません)、学習と学ぶ(GeminiのGuided Learningに相当しますが、なぜか別のクイズ作成者もあります)、Deep ResearchとShopping Research(驚くほど良く、見落とされがち)など、他にもあまり使われないオプションがいくつかあります。ClaudeにはバンドルされたオプションはDeep Researchのみですが、プロジェクトを作成し、学習プロジェクトを選択することで学習モードにアクセスできます。すべてのAIモデルは、AIにメールやカレンダーを読ませたり、ファイルにアクセスさせたり、他のアプリケーションに接続させたりすることができます。これにより、AIははるかに便利になりますが、再度、各AIツールには異なる接続機能があります。

これらは混乱を招くものです!実際の作業を行うほとんどの人にとって、最も重要な追加機能はDeep ResearchとAIをあなたのコンテンツに接続することですが、他の機能を試してみることもできます。しかし、ますます重要なのはハーネスです。AIがアクセスできるツールです。ここで、OpenAIとAnthropicはGoogleに対して明確なリードを持っています。Claude.aiとChatGPTは、コードを書く、ファイルを提供する、広範な研究を行うなどの能力を持っていますが、GoogleのGeminiウェブサイトははるかに能力が低いです(そのAIモデルは同じくらい優れていますが)。

同様の質問をすると、ChatGPTとClaudeからは作業用のスプレッドシートやPowerPointが得られ、明確な引用をフォローアップできます。しかし、Geminiはどちらの文書も生成できず、引用や研究も提供しません。Googleはここで追いつくことを期待しています。

チャットボットについての最後の注意点。GPT-5.2 Proは、付属のハーネスを持つ非常に賢いモデルです。物理学の新しい結果を導き出すのを助けたモデルであり、複雑な統計的および分析的作業を行う能力が最も高いと感じています。これは、より高価なプランを通じてのみアクセス可能です。GoogleのGemini 3 Deep Thinkも非常に能力が高いようですが、同じハーネスの問題に悩まされています。

他のアプリやハーネスについて、チャットボットのウェブサイトはほとんどの人がAIと対話する場所ですが、最も印象的な作業が行われる場所ではなくなりつつあります。これらの同じモデルをより強力なハーネスでラップする他のアプリが増えており、重要です。Claude Code、OpenAI Codex、Google Antigravityは、これらの中で最も発展したものであり、すべてコーダーを対象としています。これらは、AIモデルにあなたのコードベース、端末、独自にコードを書く、実行する、テストする能力を提供します。あなたが構築したいものを説明すると、AIがそれを構築し、完了したら戻ってきます。もしあなたがコーディングを生業にしているなら、これらのツールはあなたの仕事を変えています。最も広範なハーネスを持っているため、コーディングをしない場合でも、非常に多くのことを行うことができます。

例えば、数年前、私はGPT-1の内部重みとパラメータ(AIのコード、117百万の数字としてリストされている)をすべての本に提供することで、完全に紙ベースのLLMを作る方法に興味を持ちました。理論的には、十分な時間があれば、これらの数字を使ってAIの数学を手作業で行うことができると思いました。これは面白いアイデアのように思えましたが、当然やる価値はありませんでした。1週間前、Claude Codeにそれをやってもらうように頼みました。約1時間の間に(主にAIが作業し、いくつかの提案をしました)、GPT-1を含む80冊の美しくレイアウトされたボリュームを作成し、数学のガイドを作成しました。また、各ボリュームのカバーを視覚化し、非常にエレガントなウェブサイトを作成し、Stripeで支払いを接続し、Luluでオンデマンド印刷を行い、全体をテストし、私のために立ち上げました。私はコードを一切触れず、見ずに済みました。コストで20冊を提供するようにして、何が起こるかを見ましたが、同じ日に売り切れました。すべてのボリュームは、サイト上で無料のPDFとして利用可能です。今では、かなりの労力を要するプロジェクトアイデアを持っていても、非常に少ない労力で実行してもらうことができます。しかし、コーディングハーネスはアマチュアにはリスクがあり、当然コーディングに焦点を当てています。新しいアプリやハーネスは、他のタイプの知識作業に焦点を当て始めています。

Claude for ExcelやPowerPointは、アプリケーション内の特定のハーネスの例です。どちらもこれらのプログラムに非常に印象的な拡張機能を提供します。特にClaude for Excelは、スプレッドシートの作業において大きな変化をもたらすように感じられ、Excelを生業にしている人々にとってはClaude Codeと同様の影響を持つ可能性があります。AIにやりたいことを伝えると、AIがジュニアアナリストのように振る舞い、作業を行います。結果がExcelにあるため、簡単に確認できます。GoogleはGoogle Sheetsとの統合を行っていますが(それほど深くはありません)、OpenAIには本当に同等の製品はありません。

Claude Coworkは本当に新しいものであり、独自のカテゴリに値します。Anthropicが1月にリリースしたCoworkは、基本的に非技術的な作業のためのClaude Codeです。デスクトップ上で動作し、ローカルファイルやブラウザと直接連携できます。しかし、Claude Codeよりもはるかに安全で、非技術的なユーザーにとっては危険が少ないです(詳細を気にする人のために、デフォルトでネットワークを拒否し、堅牢な隔離が組み込まれたVMで動作します)。あなたは結果を説明し(これらの経費報告書を整理する、これらのPDFからデータをスプレッドシートに引き出す、要約を作成するなど)、Claudeが計画を立て、サブタスクに分解し、あなたが見ている間(または見ていない間)にそれを実行します。これはClaude Codeと同じエージェントアーキテクチャに基づいて構築されており、実際にはClaude Codeによって約2週間で構築されました。OpenAIやGoogleには、少なくとも今週は直接の同等物はありません。Coworkはまだ研究プレビューであり、初期段階であり、使用制限をすぐに消費しますが、これはすべての方向性を示す明確なサインです:AIがあなたの仕事について話すだけでなく、あなたの仕事を実行する時代が来るということです。

NotebookLMは、研究報告書を作成し、ソース文書を収集する(左)、ソースや資料に質問する(中央)、スライドショーのようなものに変換する(右)ことができます。NotebookLMは、情報の山を理解するためにAIをどのように使用するかという異なる問題に対するGoogleの答えです。NotebookLMに独自の深い研究を行わせるか、自分の論文、YouTube動画、ウェブサイト、ファイルを追加すると、NotebookLMはインタラクティブな知識ベースを構築し、クエリを行い、スライド、マインドマップ、動画、そして最も有名なAI生成ポッドキャストを作成します。ポッドキャストでは、2人のホストがあなたの資料について議論し、ホストに質問を中断することもできます。学生、研究者、または文書の山を理解する必要がある人にとって、NotebookLMは非常に便利なツールです。

そして、OpenClawについても触れておきたいのですが、これはこれらのカテゴリにきれいに収まるものではなく、ほとんどの人が使用すべきではありません。OpenClawは、1月下旬にバイラルになったオープンソースのAIエージェントです。あなたのコンピュータ上でローカルに実行され、任意のAIモデルに接続し、WhatsAppやiMessageのような標準的なチャットを使って人と話すように会話します。ウェブをブラウズしたり、ファイルを管理したり、メールを送信したり、コマンドを実行したりできます。これは、あなたのマシン上に住む24時間年中無休のパーソナルアシスタントのようなものです。しかし、これは重大なセキュリティリスクでもあります。あなたはAIにコンピュータやアカウントへの広範なアクセスを与えており、誰もその危険性を正確に知りません。

Contact us

ご質問・ご相談等ございましたらお気軽にご相談ください。

  • フォームでのご相談
    フォームでのご相談

    ホームページ制作、運用・更新における
    ご相談はお気軽にご連絡ください。

    お問い合わせ・ご相談
  • お電話でのお問い合わせ
    お電話でのお問い合わせ

    お電話でのご相談も随時受け付けております。
    見積依頼などもお気軽にご連絡ください。

    052-700-8712 平日 10:00~19:00