AI PICKS
AI用語辞典 (1716語)

AIを1語ずつ、
体系的に理解しませんか。

LLM・プロンプト・RAG・推論モデル・Embeddingなど、2026年のAI業界で押さえておきたい1716語を12カテゴリで体系整理。関連ツール・関連用語の内部リンク付きで、1語から芋づる式に学べます。

用語を理解したら、次は「使うプロンプト」を探す

業務シーンを3〜5問の選択肢でたどると、そのまま使えるAIプロンプトが返ってきます。

プロンプト診断へ
1716語(全1716語)
LLM / 言語モデル (134)カテゴリ単独で見る >

GPT / Claude / Geminiなど大規模言語モデルの基礎用語

AI (人工知能)Artificial Intelligence の略。人間の知能をコンピュータで再現する技術全般を指す。LLM (大規模言語モデル)Large Language Model の略。 膨大なテキストで学習した文章生成 AI。 ChatGPT / Claude / Gemini が代表例。ハルシネーションAI がそれっぽい嘘をつく現象。 学習データに無い情報を推測で生成してしまう。コンテキストウィンドウAI が一度に扱える文章の長さ。 トークン数で表現される (例: Claude Opus 4.7 は 1M トークン)。トークンAI が扱う文字のかたまり。 日本語は 1 文字 ≒ 1 トークン、 英語は単語 ≒ 1 トークン。 料金計算の単位でもある。生成 AI文章・画像・音声・動画 を新規に作り出す AI 技術。 ChatGPT 以降の AI ブームの主役。マルチモーダル文章 + 画像 + 音声 + 動画 を 同時に扱える AI。 GPT-5 / Claude Opus 4.7 / Gemini はすべて対応。AGI (汎用人工知能)Artificial General Intelligence。 あらゆる知的タスクで 人間レベル以上の能力を持つ AI。 まだ未到達。ChatGPTOpenAI が提供する 対話型 AI。 月 $0/$20/$200 の 3 プラン。 2026 年現在の世界最大シェア。ClaudeAnthropic 製の対話型 AI。 長文処理と正確性に強い、 Opus 4.7 は 1M トークン対応。GeminiGoogle が提供する マルチモーダル AI。 Workspace 統合と無料枠の手厚さが武器。推論モデル回答前に内部で長考する LLM。 OpenAI o1/GPT-5 thinking、 Claude Opus 4.7、 Gemini Thinking など。
プロンプト技法 (101)カテゴリ単独で見る >

AIから良い出力を得るための指示文の設計手法

プロンプトAI への指示文。 役割 + タスク + 制約 + 文脈 の 4 要素を明示するのが基本。プロンプトエンジニアリングAI への指示文を 設計する技術。 役割・タスク・制約・文脈 の 4 要素 + Few-shot などのテクニック。Few-shot プロンプトAI に「お手本の例」を 3-5 件見せてから タスクを依頼する手法。 出力フォーマットが安定する。Chain of Thought (思考の連鎖)AI に「ステップごとに考えてください」と促し、 複雑な推論精度を上げる手法。Zero-shot プロンプト例示なしで AI にタスクを依頼する方法。 最新モデルは Zero-shot 精度が大幅に向上した。システムプロンプトシステムプロンプトとは、AIアシスタントの応答スタイル・役割・制約をあらかじめ設定する隠し命令文のこと。ユーザーの入力より先に処理され、会話全体のトーンと動作範囲を規定する。自己整合性 (Self-Consistency)自己整合性とは、同一プロンプトを複数回実行して得た回答を多数決で統合し、精度を高めるプロンプト技法のこと。Tree of Thoughts (思考の木)Tree of Thoughts(思考の木)とは、LLMが複数の推論経路を木構造で並列探索し、各ステップで最良の経路を選びながら問題を解くプロンプト技法のこと。メタプロンプト (Meta Prompting)メタプロンプトとは、AIにプロンプト自体を生成・評価・改善させる手法のこと。人間が試行錯誤するのではなく、LLMの言語理解力を使ってより良い指示文を自動で作り出す。ロールプロンプト (役割設定)ロールプロンプトとは、AIに「あなたはXXの専門家です」のように役割を与えることで、タスクに最適なトーンと精度の回答を引き出すプロンプト技法のこと。プロンプトチェーン (Prompt Chaining)プロンプトチェーンとは、複数のプロンプトを順番に連結し、前の出力を次の入力として渡すことで複雑なタスクを段階的に処理する手法のこと。ステップバックプロンプト (Step-Back Prompting)ステップバックプロンプトとは、AIに質問を直接解かせる前に「一歩引いた」抽象的な原則や概念を先に考えさせることで、回答精度を高めるプロンプト技法のこと。
AIエージェント (119)カテゴリ単独で見る >

自律的に計画・行動を繰り返すAIの設計

AI エージェント目標を渡すと 自律的に計画 + 行動を繰り返す AI。 単なる対話を超えて タスクを完遂する。ReAct (推論と行動)ReAct とは、 LLM に 推論 (Reasoning) と 行動 (Acting) を 交互に繰り返させ、 ツールを使いながら答えに辿り着かせる エージェント設計手法のこと。MCP (Model Context Protocol)MCPとはAIモデルが外部ツールやデータソースと統一的な方法で連携するためのオープンプロトコルのこと。Anthropicが2024年11月に公開した。Function Calling (関数呼び出し)Function Callingとは、LLMが外部の関数やAPIを呼び出すための構造化データを生成し、自律的にツールを使えるようにする仕組みのこと。ヒューマン・イン・ザ・ループ (HITL)ヒューマン・イン・ザ・ループとは、AIの判断プロセスに人間が介入・確認する仕組みのこと。AIが出力した結果を人間がレビューし、承認・修正・却下を行うことで精度と安全性を担保する。Computer Use (コンピュータ操作)Computer Useとは、AIがスクリーン認識・マウス・キーボード操作を通じてコンピュータを人間のように自律的に操作する技術のこと。エージェント型ワークフロー (Agentic Workflow)エージェント型ワークフローとは、LLMが自律的にタスクを計画・実行・修正を繰り返しながら複雑な目標を段階的に達成する処理方式のこと。マルチエージェント (Multi-Agent)マルチエージェントとは、複数のAIエージェントが役割分担しながら協調してタスクを実行するシステムアーキテクチャのこと。単一エージェントでは難しい複雑なワークフローを並列・分散処理で実現する。A2A (エージェント間連携)A2Aとは、異なるAIエージェント同士が標準プロトコルを介してタスクを委譲・協調実行するための通信規格のこと。エージェントが自律的に連携し、複雑なワークフローを分散処理できる。ツール使用 (Tool Use)ツール使用 (Tool Use) とは、LLM が外部の API・DB・プログラムを呼び出してリアルタイム情報の取得や操作を行う機能のこと。AIエージェントの核心技術。LangChain (ラングチェーン)LangChainとは、LLMを核にした複数の処理を「チェーン」としてつなぎ合わせ、RAGやAIエージェントを構築するためのOSSフレームワークのこと。エージェントメモリ (Agent Memory)エージェントメモリとは、AIエージェントが過去の会話・タスク履歴・知識を保持し、次の行動に活用するための記憶機構のこと。

Midjourney / Stable Diffusion / DALL-Eなど

Midjourney高品質な AI 画像生成。 アート / イラスト / 写真風画像が最も美しく出力されると評判。Stable Diffusionオープンソースの画像生成 AI。 ローカル環境で無料利用可能、 LoRA で自由にカスタマイズできる。Canva AI (Magic Studio)Canva 統合の AI デザイン機能群。 Magic Write / Magic Edit / Magic Switch 等。DALL-EDALL-Eとは、OpenAIが開発したテキストから画像を生成するAIモデルのこと。プロンプトを入力するだけで高品質な画像を生成できる。Adobe FireflyAdobe Fireflyとは、Adobe社が開発した商用利用可能なAI画像生成エンジンのこと。PhotoshopやIllustratorに統合され、著作権クリアな学習データにより安全にクリエイティブ制作へ活用できる。拡散モデル (Diffusion Model)拡散モデルとは、画像にノイズを加えて壊す過程を学習し、逆にノイズから画像を復元することで高品質な画像を生成するAIの仕組みのこと。ControlNetControlNetとは、骨格・輪郭・深度マップなどの構造情報を条件として与え、画像生成AIの出力を精密にコントロールするための拡張モデルのこと。インペインティング (Inpainting)インペインティングとは、画像の一部をマスクで指定し、AIが自然に補完・置換する編集技術のこと。既存画像を活かしながら特定領域だけを変更できる。テキスト・トゥ・イメージ (画像生成)テキスト・トゥ・イメージとは、テキストで記述したプロンプトを入力するだけで、AIが自動的に画像を生成する技術のこと。デザイン・広告・コンテンツ制作など幅広い用途で活用されている。Nano Banana (ナノバナナ)Nano Banana(ナノバナナ)とは、テキストプロンプトから高品質な画像を生成するAIモデルのこと。軽量設計による高速推論を特徴とし、APIや業務ツールへの組み込み用途に適した画像生成エンジンである。Flux (フラックス)FluxとはBlack Forest Labsが開発したオープンソース系テキスト→画像生成モデルのこと。Stable Diffusionの後継格として2024年に登場し、高い被写体忠実度と優れたプロンプト追従性で急速に普及した。ネガティブプロンプト (Negative Prompt)ネガティブプロンプトとは、画像生成AIに対して「生成してほしくない要素」を指定する除外指示のこと。

Sora / Runway / Klingなど動画AI

SoraOpenAI の動画生成 AI。 ChatGPT Pro で利用可能、 最大 20 秒の高品質動画を生成。Runwayプロ向け AI 動画編集・生成スイート。 Gen-3 / Gen-4 で 映画品質の動画を生成。VeoVeoとはGoogle DeepMindが開発した動画生成AIモデルのこと。テキストプロンプトや静止画から高精細な動画を生成でき、物理的整合性と映像の時間的一貫性においてSoraと並ぶ業界最高水準を誇る。Kling (可灵)Kling(可灵)とは、中国の快手(Kuaishou)が開発したAI動画生成モデルのこと。テキストや画像から最大2分・1080pの高品質動画を生成でき、SoraやRunwayと並ぶ有力な動画生成AIとして世界的に注目されている。PikaPikaとはテキストプロンプトやAI画像を入力するだけで3〜10秒の高品質な短尺動画クリップを自動生成できるAI動画生成プラットフォームのこと。Luma Dream MachineLuma Dream Machineとは、Luma AIが提供するテキストや画像から高品質な動画クリップを自動生成できるAIビデオ生成ツールのこと。物理的にリアルな映像と滑らかなカメラワークを特徴とする。テキスト・トゥ・ビデオ (動画生成)テキスト・トゥ・ビデオとはテキストプロンプトを入力するだけで動画を自動生成するAI技術のこと。文章から映像・音声・ナレーションまでを一括生成でき、動画制作を民主化する。イメージ・トゥ・ビデオ (画像から動画)イメージ・トゥ・ビデオとは、静止画像1枚を入力としてAIが連続フレームを自動生成し、動きのある動画クリップへ変換する生成AI技術のこと。AIアバター (AI Avatar)AIアバターとは、人物の顔・声・動作をAIが生成・合成し、実写さながらの仮想キャラクターや分身を映像として出力する技術のこと。リップシンク (Lip Sync)リップシンクとは、動画内の人物の口の動きを音声や台詞と自動で同期させるAI技術のこと。Hailuo (海螺AI)Hailuo(海螺AI)とは、中国のAIスタートアップMiniMaxが開発した、テキストや参照画像から高品質な動画を自動生成できるAI動画生成ツールのこと。キーフレーム (Keyframe)キーフレームとは、動画の特定時点における画像・ポーズ・スタイルを固定することで、AI動画生成の動きや構図を制御するための基準フレームのこと。
音声・音楽 (157)カテゴリ単独で見る >

Suno / ElevenLabs / Whisperなどの音声AI

SunoAI 音楽生成サービス。 歌詞 + ジャンル指定で 完成楽曲を 1 分で生成。WhisperOpenAI のオープンソース音声認識モデル。 99 言語対応、 日本語精度も高い。ElevenLabsAI 音声生成のトップサービス。 自分の声をクローンして 多言語ナレーションに使える。TTS (音声合成)TTS(音声合成)とは、テキストデータを人間らしい音声に変換するAI技術のこと。ナレーション・コールセンター・音声UIなど幅広い用途で使われ、2026年現在は人間と聞き分けにくい品質が標準となっている。ASR (音声認識)ASR(Automatic Speech Recognition・自動音声認識)とは、人間の音声をテキストへ自動変換する技術のこと。深層学習モデルの普及で精度が飛躍的に向上し、文字起こし・音声コマンド・翻訳など幅広い用途で使われる。ボイスクローン (Voice Cloning)ボイスクローンとは、数秒〜数分の音声サンプルから特定人物の声質・話し方・抑揚を高精度に再現するAI音声合成技術のこと。リアルタイム音声 (Realtime Voice)リアルタイム音声とは、AIが音声入力をほぼ遅延ゼロで認識・生成し、人間同士の会話に近い応答速度を実現する技術のこと。Udio (ユーディオ)Udio (ユーディオ) とはテキストプロンプトから楽曲・歌詞・ボーカルを一括生成できるAI音楽生成サービスのこと。音楽生成 (Music Generation)音楽生成とはAIがテキストプロンプトやジャンル指定などの入力をもとに、メロディ・コード・リズムを含む楽曲を自動で生成する技術のこと。話者分離 (Speaker Diarization)話者分離とは、複数人の会話音声から「誰がいつ話したか」を自動的に識別・分類する機械学習技術のこと。文字起こしと組み合わせて話者ラベル付き議事録の自動生成などに使われる。効果音生成 (Sound Effect Generation)効果音生成とは、AIがテキストや映像・音声の指示をもとに、爆発音・環境音・UI音などの効果音を自動で生成する技術のこと。音声変換 (Voice Conversion)音声変換とは、ある人物の声質・音色を別の人物や任意のスタイルに変換するAI技術のこと。話者の言語内容を保持しながら声のキャラクターだけを変える。

MMLU / HumanEval / ArenaなどAIの評価軸

MMLUMassive Multitask Language Understanding。 57 分野・1.5 万問の LLM 知識評価ベンチマーク。HumanEvalOpenAI 発の Python コーディング能力ベンチマーク。 164 問の関数実装タスク。LM Arena (Chatbot Arena)ユーザー投票による LLM の人間評価ランキング。 Elo レーティングで モデルを順位付け。ベンチマーク (Benchmark)ベンチマークとは、AIモデルの性能を標準化されたテスト課題で数値化し、異なるモデル間を公平に比較するための評価基準セットのこと。MMLUやHumanEval等、用途別に数十種類が存在する。SWE-benchSWE-benchとはGitHubの実際のIssueをAIが自動修正できるかを測る、コーディングAI評価の業界標準ベンチマークのこと。GPQAGPQAとは、生物・物理・化学の大学院レベルの難問でAIの推論力を測る評価ベンチマークのこと。Googleで検索しても解けない設計が特徴。レイテンシ (Latency)レイテンシとは、AIモデルにリクエストを送信してから最初のレスポンスが返るまでの応答時間のこと。トークン毎秒 (スループット)トークン毎秒 (スループット) とは、LLM が1秒間に生成・処理できるトークン数を示す性能指標のこと。値が大きいほど応答が速く、リアルタイム用途や大量一括処理に向く。LLM-as-a-Judge (LLM評価者)LLM-as-a-Judgeとは、あるLLMの出力品質を別のLLMが自動採点する評価手法のこと。人手評価の代替として広く使われる。ARC-AGI (汎用推論ベンチ)ARC-AGIとは、François Cholletが設計したAIの汎用推論能力を測る公開ベンチマークのこと。人間には自明な図形パターン推論タスクで構成され、AGI到達度の代表指標として業界で広く参照される。AIME (数学ベンチマーク)AIMEとは、米国の難関数学競技試験「アメリカ数学招待試験」を転用したAIモデルの高度な数学的推論能力を測るベンチマークのこと。ベンチマーク汚染 (Benchmark Contamination)ベンチマーク汚染とは、AIモデルの訓練データにテスト用評価データが混入し、性能スコアが実際の能力より高く見える現象のこと。
インフラ・学習 (141)カテゴリ単独で見る >

GPU / 推論 / 量子化 / FP8など計算基盤

ファインチューニング既存の AI モデルを 自社データで追加学習させて 専門特化させる方法。機械学習データから法則を自動学習させる AI 技術の総称。 ディープラーニングや LLM もここに含まれる。ディープラーニングニューラルネットワークを多層化した機械学習手法。 LLM / 画像認識 / 音声認識 の基盤技術。TransformerSelf-Attention 機構を中核とするニューラルネット構造。 LLM / 画像 / 音声 すべての基盤。Attention 機構入力系列のどこに注目すべきかを 動的に重み付けする仕組み。 Transformer の中核。LoRA (Low-Rank Adaptation)LoRAとは、大規模モデルの重みを凍結したまま低ランク行列ペアを追加挿入することで、全パラメータの1%以下の計算コストで特定ドメインへの適応を実現するファインチューニング手法のこと。RLHF (人間のフィードバックによる強化学習)RLHFとは、人間の評価・フィードバックを報酬信号として活用し、LLMの出力を人間の意図に沿わせる強化学習手法のこと。蒸留 (Distillation)蒸留とは、大規模な「教師モデル」の知識を小規模な「生徒モデル」に転移させ、軽量化・高速化を図る機械学習の手法のこと。量子化 (Quantization)量子化とはAIモデルの重みパラメータを低ビット精度に圧縮し、推論速度の向上・メモリ使用量の削減を実現する技術のこと。MoE (混合エキスパート)MoE(混合エキスパート)とは、複数の専門サブネットワーク(エキスパート)を持ち、入力トークンごとに一部だけを活性化させるスパース型ニューラルネットワーク設計手法のこと。DPO (直接選好最適化)DPO(直接選好最適化)とは、報酬モデルを使わずに人間の選好データから直接LLMを最適化するファインチューニング手法のこと。事前学習 (Pre-training)事前学習とは、大規模言語モデルをインターネット上の膨大なテキストデータで学習させ、汎用的な言語理解・生成能力を獲得させる訓練フェーズのこと。
ビジネス応用 (121)カテゴリ単独で見る >

業務自動化 / SaaS統合 / DX

業務自動化AI + ノーコードツール (Zapier / Make / n8n) で 繰り返し業務を自動実行する仕組み。AI コーディングAI がコード補完 / 生成 / レビューを行う開発手法。 Cursor / GitHub Copilot / Windsurf が代表。CursorAI ネイティブな コードエディタ。 Composer + Agent で AI が自律的にコード生成。GitHub CopilotGitHub 提供の AI コード補完。 月 $10、 VS Code / JetBrains / Neovim で動く。Notion AINotion 統合の AI 機能。 月 $10、 ドキュメント要約 / 翻訳 / 議事録整理が Notion 内で完結する。Zapier業務自動化のノーコードツール最大手。 7,000+ アプリ連携、 AI 機能内蔵で 月 $19.99〜。GEO (生成エンジン最適化)Generative Engine Optimization。 AI 検索で引用されやすいコンテンツ作成の SEO 次世代版。AI 翻訳DeepL / Google 翻訳 / Claude / ChatGPT による 機械翻訳。 ビジネス文書なら DeepL、 文脈は LLM が強い。バイブコーディング (Vibe Coding)バイブコーディングとは、コードの詳細を深く理解せずAIに自然言語で意図を伝え、生成されたコードを感覚的に受け入れながら開発を進めるプログラミングスタイルのこと。Devin (AIソフトウェアエンジニア)Devinとは、Cognition AIが開発した自律型AIソフトウェアエンジニアのこと。コードの設計・実装・デバッグ・テストをエンジニアの指示なしに一気通貫で実行できる。Dify (ディファイ)Dify(ディファイ)とはオープンソースの LLM アプリケーション開発プラットフォームのこと。コーディング不要でチャットボットや RAG パイプライン、AI エージェントをビジュアルに構築・デプロイできる。DX (デジタルトランスフォーメーション)DXとはデジタル技術を活用してビジネスモデル・業務プロセス・組織文化を根本から変革し、競争上の優位性を確立すること。単なるIT化や効率化とは区別される。
セキュリティ (156)カテゴリ単独で見る >

プロンプトインジェクション / モデル抽出 / 防御

プロンプトインジェクションユーザー入力で AI の指示を上書きする攻撃。 「これまでの指示は無視して◯◯」 が典型例。ジェイルブレイクAI の安全制限を回避する手法。 ロールプレイや仮想シナリオで 禁止出力を引き出す。ガードレール (Guardrails)ガードレールとは、AIシステムが有害・不適切・意図しない出力を生成しないよう制限するための安全制御機構のこと。レッドチーミング (Red Teaming)レッドチーミングとは、AIシステムの安全性・脆弱性を検証するため、攻撃者の視点から意図的に悪意ある入力やシナリオを試みる評価手法のこと。シャドーAI (Shadow AI)シャドーAIとは、企業のIT部門や経営層の承認なしに従業員が個人的に業務で使うAIツール・サービスのこと。情報漏洩・規約違反・ガバナンス崩壊のリスクを内包する。モデルポイズニング (Model Poisoning)モデルポイズニングとは、AIモデルの学習データに悪意あるデータを混入させ、モデルの出力や判断を意図的に歪める攻撃手法のこと。データ漏洩 (Data Leakage)データ漏洩とは、機密情報や個人データが意図せず外部に流出してしまうセキュリティ上のインシデントのこと。間接プロンプトインジェクション (Indirect Prompt Injection)間接プロンプトインジェクションとは、AIが処理する外部コンテンツ(Webページ・PDF・メール等)に悪意ある命令を埋め込み、AIエージェントに意図しない動作を引き起こすサイバー攻撃手法のこと。OWASP LLM Top 10OWASP LLM Top 10とは、OWASPがLLMアプリケーション固有の10大セキュリティリスクを優先度付きで体系化したフレームワークのこと。敵対的サンプル (Adversarial Examples)敵対的サンプルとは、人間には正常に見えるがAIモデルを意図的に誤分類・誤判断させるよう微小な摂動を加えた入力データのこと。AI TRiSM (AI信頼・リスク・セキュリティ管理)AI TRiSMとは、AIモデルやアプリケーションの信頼性・リスク・セキュリティを一元管理するガバナンスフレームワークのこと。Gartnerが提唱し、AIの安全な社会実装に不可欠な概念として広まっている。モデル抽出攻撃 (Model Extraction)モデル抽出攻撃とは、AIモデルへの大量クエリで挙動を解析し、元モデルを模倣した「影モデル」を不正に構築するサイバー攻撃のこと。
AI PICKS用語辞典について

AI PICKS編集部は、業界標準の定義に加えて、2026年時点の実運用例 / 現場での落とし穴 / AI PICKS独自の評価軸を含めて記述しています。 単なる定義の引き写しではなく、日本のAI業務導入の文脈(SaaS連携・コスト感・規制動向)を重視しています。 用語は毎日追加しています(現在1716語)。