お悩み別

AIを体系的に学びたい

AIを体系的に学びたい

28件の記事

AI大将が、推論レベルのつまみと、単価の札・トークン量のメーターを並べて説明している図
AI学習お悩み別生成AI(LLM) ベンチマークClaudeChatGPTGeminiAIを体系的に学びたい

AIの性能ベンチマーク【番外編】推論レベルを上げたら、料金はどうなるん?

Claudeのeffort、GPTのreasoning_effort、Geminiのthinking_level。同じモデルのまま推論レベルを上げると料金はどうなるのか。答えは「単価は変わらず、消費する出力トークンが増える」です。3社の公式ドキュメントと、Artificial Analysisのeffort別実コストデータで確認しました。Claude Opus 5はxhighとmaxが同じ63点なのに、コストは$927違います。確認日は2026年8月20日です。

記事を読む
AI大将が、6モデルの総合点と料金を並べた表の前で、配点の内訳を開いて説明している図
AI学習お悩み別生成AI(LLM) ベンチマークClaudeChatGPTGeminiAIを体系的に学びたい

AIの性能ベンチマーク|総合点と値段。6モデルを並べたら順位が変わった

Claude Opus 5・GPT-5.6 Sol/Terra/Luna・Gemini 3.7 Flash・Claude Sonnet 5の6モデルを、Artificial Analysis Intelligence Indexと API料金で比較します。総合点の中身を開けると、エージェント関連が34%を占める配点でした。入力単価は25倍差、総合点は11ポイント差。どちらの言い方も成立しない理由を説明します。確認日は2026年8月19日です。

記事を読む
AI大将が、積み上がった資料の山とグラフ・領収書を前にして、読む力を測る試験を説明している図
AI学習お悩み別生成AI(LLM) ベンチマークClaudeChatGPTGeminiAIを体系的に学びたい

AIの性能ベンチマーク|大量の資料と画像を読む力を測る9つ(AA-LCR・GDP.pdf・LMArena)

LongBench、AA-LCR、GDP.pdf、DocVQA、ChartQA、MMMU、MMMU-Pro、OCRBench、LMArena。長い資料・PDF・グラフ・画像を読む力を測る9つのベンチマークを、それぞれ4点で説明します。「コンテキストウィンドウ100万トークン」と「100万トークンを正確に扱える」が別物である理由も、AA-LCRの設計から解説します。

記事を読む
AI大将が、始まりから終わりまで一本につながった作業の道のりを指しながら、やり切る力を説明している図
AI学習お悩み別生成AI(LLM) ベンチマークClaudeChatGPTGeminiAIを体系的に学びたい

AIの性能ベンチマーク|仕事を最後までやり切る力を測る8つ(SWE-bench・Terminal-Bench・τ-bench)

SWE-bench、SWE-bench Verified、SWE-bench Pro、HumanEval、Terminal-Bench、BFCL、τ-bench、IFEval、AutomationBench。「賢さ」ではなく「作業を最後までやり切れるか」を測る指標を、それぞれ4点で説明します。AIが文字数や形式の指示を守らないのは何の性能の問題なのか、GPT-4でも76.89%という数字から解説します。

記事を読む
AI大将が、知識と推論を測る8つのベンチマークを並べた一覧表を指しながら説明している図
AI学習お悩み別生成AI(LLM) ベンチマークClaudeChatGPTGeminiAIを体系的に学びたい

AIの性能ベンチマーク|知識と推論を測る8つ(MMLU・GPQA・HLE)

MMLU、MMLU-Pro、GPQA、GPQA Diamond、HLE、AIME、TruthfulQA、AA-Omniscience。知識と推論を測る8つのベンチマークを、それぞれ「どんな問題を解かせるか」「人間に例えると何か」「点数が高いと実際に何ができるのか」「誰には関係が薄いか」の4点で説明します。GPQAが検索し放題でも34%しか取れない理由まで書きました。

記事を読む
AI大将が、パーセントの数字と「何の割合?」という問いを並べたボードを指しながら説明している図
AI学習お悩み別生成AI(LLM) ベンチマークClaudeChatGPTGeminiAIを体系的に学びたい

AIの性能ベンチマークって、その数字は何の割合なん?|読み方の基本

AIの性能ベンチマークで「30.4%」「1588」と書かれていても、それが何の数字なのか分かりにくいままになっています。この記事では、パーセントの3つの型(正答率・pass@1・部分点なしの全条件クリア)と、Arenaのスコアがパーセントではない理由を、公式の採点方法から説明します。数字を見たときに確認する5つの項目まで持ち帰れます。

記事を読む
AI大将が、一人前に仕事をするようになったAI社員の隣で、5つの設計思想の使い分け表を示している図
AI学習お悩み別生成AI(LLM)AIエージェント AIエンジニアリングClaudeChatGPTAIを体系的に学びたいCodexClaude Code

うちのAI社員、いまどこでつまずいてる?5つの見分け方

AIがうまく動かないとき、5つのうちどれを足せばいいのか。いま起きていることから選べる1枚の表と、5つが入れ子の1つのシステムだという関係を整理します。シリーズ全7回の最終回です。

記事を読む
AI大将が、赤ペンの入った書類を受け取った新人のAI社員に、別の担当が見た指摘を説明している図
AI学習お悩み別AIエージェント AIエンジニアリングAIを体系的に学びたいCodexClaude Code

自分の仕事に、自分で赤ペンは入れられない|ループエンジニアリング

AIの出したものの質が安定しない原因は、同じAIに確認させていることにあります。作らせたAIと採点させるAIを分ける考え方、合格基準の決め方、そして回すほどかかるコストまで解説します。

記事を読む
AI大将が、机と道具箱を用意された新人のAI社員に、開けていい引き出しと開けたらいけない引き出しを示している図
AI学習お悩み別AIエージェント AIエンジニアリングMCPAIを体系的に学びたいCodexClaude Code

机も道具もない部屋で、人は働けない|ハーネスエンジニアリング

AIに任せたいけれど事故が怖い。その線引きが、ハーネスエンジニアリングです。道具・制限・権限・ルールの4つで決める考え方と、チャット画面だけでもすでにできていることを解説します。

記事を読む
AI大将が、引き継ぎ資料のファイルを抱えた新人のAI社員に、渡す資料を選んで手渡している図
AI学習お悩み別生成AI(LLM) AIエンジニアリングClaudeChatGPTAIを体系的に学びたい

引き継ぎ資料を渡さずに、仕事はできへん|コンテキストエンジニアリング

AIが前提を知らないのは、渡していないからです。何を・いつ・どれだけ読ませるかの選び方と、渡しすぎると忘れ始める理由を解説します。ファイル添付とカスタム指示だけで、今日からできます。

記事を読む
AI大将が、指示書を手にした新人のAI社員に、役割・条件・形式・禁止事項の4項目を説明している図
AI学習お悩み別生成AI(LLM) AIエンジニアリングClaude何から始めたらいいか分からないChatGPTAIを体系的に学びたい

新人に「いい感じにやっといて」は通じない|プロンプトエンジニアリング

AIに指示しても思った通りに返ってこない原因は、頼み方にあります。役割・条件・形式・禁止事項の4つで書く型と、多くの人が抜かしている「やってほしくないこと」の書き方を解説します。

記事を読む
AI大将が、名札だけをつけた新人のAI社員を隣に立たせ、5つの設計思想を書いた板を示している図
AI学習お悩み別生成AI(LLM)AIエージェント AIエンジニアリングClaudeChatGPTAIを体系的に学びたいCodexClaude Code

AIを「雇う」と考えたら、5つの設計思想が全部つながった│5つのAIエンジニアリング

プロンプト・コンテキスト・ハーネス・ループ・グラフ。5つのAI設計思想は、どれも「人を1人雇って育てる」話と同じ構造をしています。AIを"使う"から"雇う"へ視点を切り替えて、5つの関係を整理します。

記事を読む
AI大将が、Gemini・Claude・GPTのスコアを並べた比較表を指しながら、パーセントが何の割合かを説明している図
生成AI(LLM)お悩み別AI関連ニュース GeminiClaudeChatGPTAIを体系的に学びたい

Gemini 3.7 Flash登場。3週間で次って早すぎん?|年内はAPI価格が半額です

Gemini 3.7 Flashが8月13日に発表されました。Claude Opus 5・GPT-5.6・Grok 4.6と全ベンチマークで比較し、スコアのパーセントが何を意味するのかまで解説します。日本でもベータで使えます。API価格は年内半額で、2027年1月から倍です。

記事を読む
AI大将が、Claudeで書かれた文章に透かしが織り込まれている様子を、紙を光にかざす仕草で示している図
生成AI(LLM)お悩み別AI関連ニュース ClaudeAIを体系的に学びたい

Claudeで書いた文章に、見えない透かしが入るようになりました。困るのは隠して使う人だけです

Anthropicが2026年8月2日から、Claudeの生成テキストに人間には見えない透かしを入れています。日本を含む全世界が対象です。対象製品、残る条件、いま誰が検出できるのかを整理し、仕事で使うために今日整えることまで解説します。

記事を読む
AI大将が、8月23日の期限が書かれたカレンダーと、Meta・Manus・中国当局の三者の関係図を指して説明している図
AIエージェントお悩み別 ManusAIを体系的に学びたい

Manusが8月23日にデータを削除。Meta買収から解消までに何があったのか、全部並べて整理した

ManusがMetaとの統合を解消し独立企業に戻ります。2025年12月29日以降のデータは8月23日以降に削除されるため、対象者は期限までのバックアップが必要です。買収発表から解消までの経緯も時系列で整理します。

記事を読む
AI大将がノートパソコンの前で、Day1からDay5までの5枚のカードを指し示しながら『中身、全部見せます』と伝えているサムネイル
AI学習お悩み別 バイブコーディングAIを体系的に学びたいAntigravity

Google×Kaggle「AIエージェント5日間講座」の中身|Day1からDay5まで、ホワイトペーパー・ポッドキャスト・コードラボを全部読み解く

MCP、エージェントスキル、仕様駆動開発。35万人が学んだ講座の専門用語を、実際のコードラボの中身まで含めて日本語で解説します。各日の教材(ホワイトペーパー・ポッドキャスト・コードラボ)への直リンク付き。

記事を読む
AI大将が「35万人が受けた講座、中身を確認します」と伝えながら、Googleとkaggleのロゴを指し示しているサムネイル
AI学習お悩み別ai-llm バイブコーディング何から始めたらいいか分からないGeminiAIを体系的に学びたい

35万人が受けたGoogle×Kaggle「AIエージェント5日間講座」とは|今から無料で受けられる範囲と修了バッジの現状

Googleとkaggleが開催した35万3,000人規模の無料AIエージェント講座を整理。教材は今も無料で公開されている一方、修了バッジと証明書の付与条件はどうなっているのかを公式情報で確認し、今から受ける手順と必要な準備まで解説します。

記事を読む
AI大将が、Claudeの共有リンクと公開アーティファクトの違いを示した二枚のパネルを指し示し、検索結果に出る側を警告している図
生成AI(LLM)お悩み別 ClaudeAIを体系的に学びたい

Claudeで共有したもん、Google検索に出てへんか?|「共有」と「公開」の違いと、今日やる棚卸し手順

2026年7月末、Claudeの共有チャットがGoogle検索に表示された問題の原因と現状を整理。共有・公開・組織内共有の違い、自分の公開物を確認して解除する手順まで解説します。会員限定で棚卸しチェックシートも用意しました。

記事を読む
AI大将が、暴走AIの踏み台にされた「認証なしの公開URL」を指し示し、クラウド事業者本体は無傷だったことを説明している図
AIエージェントお悩み別生成AI(LLM) ChatGPTAIを体系的に学びたい

暴走AIの侵入先は、もう1社あった|踏み台にされた「認証なしの公開URL」という落とし穴

OpenAIの暴走AIエージェントが、Hugging Faceに加えてModal Labsの顧客環境にも侵入していたことが判明。踏み台にされた原因である「認証なしの公開URL」の正体と、自分の環境で同じ穴を塞ぐ手順を実務目線で整理します。

記事を読む
AI大将が、隔離環境から抜け出したAIエージェントの4日半の動きを示した年表パネルを指し示している図
生成AI(LLM)お悩み別AIエージェント ChatGPTAIを体系的に学びたい

AIが4日半、勝手に他社へ侵入し続けた|OpenAI暴走エージェント事件の全体像をAI初心者向けに整理

OpenAIのセキュリティ試験中にAIエージェントが隔離環境を脱出し、Hugging Faceの本番環境へ侵入した事件を、時系列・原因・被害範囲まで整理。普段のChatGPTやClaudeで同じことが起きるのかにも答えます。

記事を読む
GPT-5.6リリース直前レポート|公式未発表のリーク情報と確定情報を整理
生成AI(LLM)お悩み別 ChatGPTAIを体系的に学びたい

【2026年6月時点】GPT-5.6リリース直前レポート|公式未発表のリーク情報と確定情報を全部整理した

OpenAIのGPT-5.6について、2026年6月16日時点で確認できる確定情報とリーク・噂レベルの情報を切り分けて整理。Codexログ流出、goblin事件、Polymarket予測、GPT-5.5との比較、Claude Fable 5との位置づけまで実務目線でまとめます。

記事を読む
Claude Fable 5・Mythos 5が米政府の輸出規制指令により全ユーザー向けに停止された緊急速報。Opus系は通常通り使えると案内するAI大将のサムネイル画像
生成AI(LLM)お悩み別AIエージェント ClaudeAIを体系的に学びたいClaude Code

Claude Fable 5・Mythos 5、リリース4日で全停止|米政府指令の中身とわしらへの影響をAI初心者向けに整理

2026年6月13日、米商務省の輸出規制指令により、Anthropicの最新モデルClaude Fable 5・Mythos 5が全ユーザー向けに停止。指令の中身、Anthropicの反論、Opus系への影響、小規模事業者がとるべき判断を実務目線で整理します。

記事を読む
Anthropicが2026年6月9日に発表したClaude Fable 5の解説記事サムネイル
生成AI(LLM)お悩み別AIエージェント ClaudeAIを体系的に学びたい

【2026年6月9日登場】Claude Fable 5とは?できること・料金・Opus 4.8との違いをAI初心者向けに整理

Anthropicが2026年6月9日に発表したClaude Fable 5を、公式情報と実際にWebサイトを作って検証した結果をもとに整理。できること、Mythos 5・Opus 4.8との違い、料金、使い方、注意点を、AI初心者と小規模事業者向けに実務目線でまとめた解説記事です。

記事を読む