AIサービス設定
概要
AITuberKitでは、様々なAIサービス(OpenAI、Anthropic、Google Geminiなど)を選択して利用することができます。この設定では、利用するAIサービスとモデルの選択、APIキーの設定などを行います。
サポートされているAIサービス

AITuberKitは以下のAIサービスをサポートしています:
- OpenAI - GPT-5.6、GPT-5.5、GPT-5.4、GPT-5.3、GPT-5.2、GPT-5.1、GPT-4.1などの高性能モデルを提供
- Anthropic - Claude Opus 4.6、Claude Sonnet 4.6などを提供
- Google Gemini - Gemini 3.1、Gemini 3、Gemini 2.5シリーズなどを提供
- Azure OpenAI - Azureプラットフォーム上のOpenAIモデル
- xAI - Grokモデルを提供
- Groq - 高速推論に特化した様々なモデルを提供
- Cohere - Command-Rシリーズを提供
- Mistral AI - Mistral Large、Open Mistralなどを提供
- Perplexity - Sonarシリーズを提供
- Fireworks - Llama、Mixtralなどの最適化実装を提供
- DeepSeek - DeepSeek Chat、DeepSeek Reasonerを提供
- OpenRouter - 幅広いモデルを提供
- LM Studio - ローカルLLMを提供
- Ollama - ローカルLLMを提供
- Dify - カスタムチャットボット構築プラットフォーム
- カスタムAPI - カスタムAPIを提供
ほとんどのAIサービスでは、あらかじめモデルを選択肢から選べるようになっていますが、任意のモデルを使用したい場合は「カスタムモデルを使用」を有効にしてください。
モデル選択のアイコン
モデル選択欄では、モデル名の横に対応機能を示す絵文字が表示される場合があります。
| アイコン | 意味 |
|---|---|
| 📷 | 画像入力に対応しています |
| 🔍 | 検索対応モデルです。現在は Google Gemini のサーチグラウンディング対応モデルに表示されます |
| 💡 | 推論対応モデルです。推論努力レベルや推論トークン予算の対象になる場合があります |
OpenAI
# OpenAI API キー
OPENAI_API_KEY=sk-...対応モデル:
- gpt-5.6-sol
- gpt-5.6-terra
- gpt-5.6-luna
- gpt-5.5
- gpt-5.5-2026-04-23
- gpt-5.4-pro
- gpt-5.4-pro-2026-03-05
- gpt-5.4
- gpt-5.4-2026-03-05
- gpt-5.4-mini(デフォルト)
- gpt-5.4-mini-2026-03-17
- gpt-5.4-nano
- gpt-5.4-nano-2026-03-17
- gpt-5.3-chat-latest
- gpt-5.3-codex
- gpt-5.2-pro
- gpt-5.2-pro-2025-12-11
- gpt-5.2-chat-latest
- gpt-5.2
- gpt-5.2-2025-12-11
- gpt-5.2-codex
- gpt-5.1-codex-mini
- gpt-5.1-codex
- gpt-5.1-codex-max
- gpt-5.1-chat-latest
- gpt-5.1
- gpt-5.1-2025-11-13
- gpt-5-pro
- gpt-5-pro-2025-10-06
- gpt-5
- gpt-5-2025-08-07
- gpt-5-mini
- gpt-5-mini-2025-08-07
- gpt-5-nano
- gpt-5-nano-2025-08-07
- gpt-5-codex
- gpt-5-chat-latest
- gpt-4.1
- gpt-4.1-2025-04-14
- gpt-4.1-mini
- gpt-4.1-mini-2025-04-14
- gpt-4.1-nano
- gpt-4.1-nano-2025-04-14
- gpt-4o
- gpt-4o-2024-05-13
- gpt-4o-2024-08-06
- gpt-4o-2024-11-20
- gpt-4o-mini
- gpt-4o-mini-2024-07-18
- gpt-3.5-turbo
- gpt-3.5-turbo-0125
- gpt-3.5-turbo-1106
- o4-mini
- o4-mini-2025-04-16
- o3
- o3-2025-04-16
- o3-mini
- o3-mini-2025-01-31
- o1
- o1-2024-12-17
APIキーの取得: APIキーはOpenAIのAPI keysページから取得できます。
Anthropic
# Anthropic API キー
ANTHROPIC_API_KEY=sk-ant-...対応モデル:
- claude-opus-4-6
- claude-sonnet-4-6(デフォルト)
- claude-opus-4-5
- claude-opus-4-1
- claude-opus-4-0
- claude-sonnet-4-5
- claude-sonnet-4-0
- claude-haiku-4-5
APIキーの取得: APIキーはAnthropicコンソールから取得できます。
Google Gemini
# Google Gemini API キー
GOOGLE_API_KEY=...対応モデル:
- gemini-3.1-pro-preview
- gemini-3.1-flash-image-preview
- gemini-3.1-flash-lite-preview
- gemini-3-pro-preview
- gemini-3-pro-image-preview
- gemini-3-flash-preview
- gemini-2.5-pro
- gemini-2.5-flash(デフォルト)
- gemini-2.5-flash-lite
- gemini-2.5-flash-lite-preview-06-17
- gemini-2.0-flash
APIキーの取得: APIキーはGoogle AI Studioから取得できます。
Googleサーチグラウンディング機能
Google Geminiでは、AIの回答生成時にリアルタイムでウェブ検索を活用する「サーチグラウンディング」機能が利用できます。 また、一部のモデルでは、サーチグラウンディング機能を使用するかどうかを判定する動的しきい値を設定することが可能です。0の場合は常に検索を実行し、1の場合は検索を実行しません。
# サーチグラウンディング機能の有効化
NEXT_PUBLIC_USE_SEARCH_GROUNDING=true
# サーチグラウンディング機能の動的しきい値
NEXT_PUBLIC_DYNAMIC_RETRIEVAL_THRESHOLD=0.3TIP
サーチグラウンディング機能は、Google Gemini 3.1/3シリーズ、Gemini 2.5シリーズ、Gemini 2.0 Flashで利用可能です。
Azure OpenAI
# Azure OpenAI API キー
AZURE_API_KEY=...
# Azure OpenAI エンドポイント
AZURE_ENDPOINT="https://RESOURCE_NAME.openai.azure.com/openai/deployments/DEPLOYMENT_NAME/chat/completions?api-version=API_VERSION"APIキーの取得: APIキーはAzureポータルから取得できます。
xAI
# xAI API Key
XAI_API_KEY=...対応モデル:
- grok-4.5
- grok-4-1-fast-reasoning
- grok-4-1-fast-non-reasoning
- grok-4-fast-non-reasoning
- grok-4-fast-reasoning
- grok-4.20-0309-non-reasoning
- grok-4.20-0309-reasoning
- grok-4.20-multi-agent-0309
- grok-code-fast-1
- grok-4(デフォルト)
- grok-4-0709
- grok-4-latest
- grok-3
- grok-3-latest
- grok-3-mini
- grok-3-mini-latest
APIキーの取得: APIキーはxAIダッシュボードから取得できます。
Groq
# Groq API キー
GROQ_API_KEY=...対応モデル:
- gemma2-9b-it
- llama-3.1-8b-instant
- llama-3.3-70b-versatile(デフォルト)
- meta-llama/llama-guard-4-12b
- deepseek-r1-distill-llama-70b
- meta-llama/llama-4-maverick-17b-128e-instruct
- meta-llama/llama-4-scout-17b-16e-instruct
- meta-llama/llama-prompt-guard-2-22m
- meta-llama/llama-prompt-guard-2-86m
- moonshotai/kimi-k2-instruct-0905
- qwen/qwen3-32b
- llama-guard-3-8b
- llama3-70b-8192
- llama3-8b-8192
- mixtral-8x7b-32768
- qwen-qwq-32b
- qwen-2.5-32b
- deepseek-r1-distill-qwen-32b
- openai/gpt-oss-20b
- openai/gpt-oss-120b
APIキーの取得: APIキーはGroqダッシュボードから取得できます。
Cohere
# Cohere API キー
COHERE_API_KEY=...対応モデル:
- command-a-03-2025(デフォルト)
- command-a-reasoning-08-2025
- command-r7b-12-2024
- command-r-plus-04-2024
- command-r-plus
- command-r-08-2024
- command-r-03-2024
- command-r
- command
- command-nightly
- command-light
- command-light-nightly
APIキーの取得: APIキーはCohereダッシュボードから取得できます。
Mistral AI
# Mistral AI API キー
MISTRALAI_API_KEY=...対応モデル:
- pixtral-large-latest
- mistral-large-latest(デフォルト)
- mistral-medium-latest
- mistral-medium-2508
- mistral-medium-2505
- mistral-small-latest
- magistral-small-2507
- magistral-medium-2507
- magistral-small-2506
- magistral-medium-2506
- ministral-3b-latest
- ministral-8b-latest
- pixtral-12b-2409
- open-mistral-7b
- open-mixtral-8x7b
- open-mixtral-8x22b
APIキーの取得: APIキーはMistral AIダッシュボードから取得できます。
Perplexity
# Perplexity API キー
PERPLEXITY_API_KEY=...対応モデル:
- sonar-deep-research
- sonar-reasoning-pro
- sonar-reasoning
- sonar-pro(デフォルト)
- sonar
APIキーの取得: APIキーはPerplexityダッシュボードから取得できます。
Fireworks
# Fireworks API キー
FIREWORKS_API_KEY=...対応モデル:
- accounts/fireworks/models/firefunction-v1
- accounts/fireworks/models/deepseek-r1
- accounts/fireworks/models/deepseek-v3
- accounts/fireworks/models/llama-v3p1-405b-instruct
- accounts/fireworks/models/llama-v3p1-8b-instruct
- accounts/fireworks/models/llama-v3p2-3b-instruct
- accounts/fireworks/models/llama-v3p3-70b-instruct
- accounts/fireworks/models/mixtral-8x7b-instruct
- accounts/fireworks/models/mixtral-8x7b-instruct-hf
- accounts/fireworks/models/mixtral-8x22b-instruct
- accounts/fireworks/models/qwen2p5-coder-32b-instruct
- accounts/fireworks/models/qwen2p5-72b-instruct
- accounts/fireworks/models/qwen-qwq-32b-preview
- accounts/fireworks/models/qwen2-vl-72b-instruct
- accounts/fireworks/models/llama-v3p2-11b-vision-instruct
- accounts/fireworks/models/qwq-32b
- accounts/fireworks/models/yi-large
- accounts/fireworks/models/kimi-k2-instruct
- accounts/fireworks/models/kimi-k2-thinking
- accounts/fireworks/models/kimi-k2p5
- accounts/fireworks/models/minimax-m2
APIキーの取得: APIキーはFireworksダッシュボードから取得できます。
DeepSeek
# DeepSeek API キー
DEEPSEEK_API_KEY=...対応モデル:
- deepseek-chat
- deepseek-reasoner
APIキーの取得: APIキーはDeepSeekプラットフォームから取得できます。
OpenRouter
# OpenRouter API Key
OPENROUTER_API_KEY=...対応モデル:
OpenRouter Modelsを参照してください。
APIキーの取得: APIキーはOpenRouterダッシュボードから取得できます。
LM Studio, Ollama
# ローカルLLM URL
# ex. Ollama: http://localhost:11434/v1/chat/completions
# ex. LM Studio: http://localhost:1234/v1/chat/completions
NEXT_PUBLIC_LOCAL_LLM_URL=""
# 外部ホストのローカルLLMを許可するOrigin(カンマ区切り)
AITUBERKIT_ALLOWED_LLM_SERVER_ORIGINS=""ローカルLLMを利用する場合は、別途サーバーの設定と起動が必要です。同一マシンのループバックURLは既定の disabled モードでも利用できます。別ホストのLM Studio/Ollamaへ接続する場合は、そのOriginを AITUBERKIT_ALLOWED_LLM_SERVER_ORIGINS に追加してください。
Ollamaでは、推論対応モデルまたはカスタムモデルを使用する場合に推論モードを利用できます。推論レベルは none / low / medium / high から選択できます。
設定例: Ollamaの設定方法
Dify
Difyはカスタムチャットボットを簡単に構築できるプラットフォームです。
# Dify API キー
DIFY_API_KEY=""
# Dify API URL
DIFY_URL=""注意
Difyでは、「チャットボット」または「エージェント」タイプのアプリケーションのみ対応しています。
また、Dify使用時は過去のメッセージの保持数やシステムプロンプトは、Dify側で設定する必要があります。
上手く回答が得られない場合は、会話履歴を削除してから改めて質問してください。
カスタムAPI
カスタムAPIを利用する場合は、以下の環境変数を設定してください。
# カスタムAPI URL
NEXT_PUBLIC_CUSTOM_API_URL=""
# カスタムAPIヘッダー
NEXT_PUBLIC_CUSTOM_API_HEADERS=""
# カスタムAPIボディ
NEXT_PUBLIC_CUSTOM_API_BODY=""
# カスタムAPIでシステムメッセージを含めるかどうか(true/false)
NEXT_PUBLIC_INCLUDE_SYSTEM_MESSAGES_IN_CUSTOM_API=true
# 画像オブジェクトにMIMEタイプを含めるかどうか(true/false)
NEXT_PUBLIC_CUSTOM_API_INCLUDE_MIME_TYPE=trueサーバーサイド秘匿環境変数
APIキーやエンドポイントをブラウザに公開したくない場合は、サーバーサイド専用の環境変数を使用できます。これらの環境変数はNEXT_PUBLIC_版より優先されます。
# サーバー側のAPIキー、CUSTOM_API_*、書き込み/サーバーリソースAPIを匿名APIから使うかどうか
# disabled: デフォルト。リクエスト側APIキーのみ許可し、サーバー側秘匿値や保護対象リソースは拒否
# ただし同一マシンのローカルTTS/LLMループバック接続は許可
# protected: Authorization: Bearer AITUBERKIT_SERVER_SECRET_TOKEN が必要
# demo: allowed origins / same-origin のブラウザリクエストのみ許可。AITUBERKIT_DEMO_ACCESS_TOKEN設定時はdemoトークンも要求(レート制限併用推奨)
# unprotected: 従来互換。公開URLでは非推奨
AITUBERKIT_SERVER_SECRET_ACCESS_MODE="disabled"
# protectedモードで使用するBearerトークン
AITUBERKIT_SERVER_SECRET_TOKEN=""
# demoモードで許可するOrigin(カンマ区切り)。未指定時はHostと同一Originのみ許可
AITUBERKIT_ALLOWED_ORIGINS=""
# demoモードで X-AITuberKit-Demo-Token として要求する任意の専用トークン
AITUBERKIT_DEMO_ACCESS_TOKEN=""
# demoモードの簡易レート制限(IP・機能ごとの1分あたり回数、本番ではWAF等も併用)
AITUBERKIT_DEMO_RATE_LIMIT_PER_MINUTE="20"
# 信頼済みプロキシ配下でのみtrue。trueの場合だけ転送元IPヘッダーをレート制限に使用
AITUBERKIT_TRUST_PROXY_HEADERS="false"
# クライアント指定の外部ローカルTTSサーバーOrigin(カンマ区切り)
AITUBERKIT_ALLOWED_TTS_SERVER_ORIGINS=""
# クライアント指定の外部LM Studio/OllamaサーバーOrigin(カンマ区切り)
AITUBERKIT_ALLOWED_LLM_SERVER_ORIGINS=""
# Custom APIのreasoningやprovider metadataをクライアントへ転送する(通常はfalse推奨)
AITUBERKIT_FORWARD_CUSTOM_API_METADATA="false"
# カスタムAPI URL(サーバーサイド秘匿用、設定時はNEXT_PUBLIC版より優先)
CUSTOM_API_URL=""
# カスタムAPIヘッダー(サーバーサイド秘匿用、フロントエンド設定に上書きマージ)
CUSTOM_API_HEADERS=""
# カスタムAPIボディ(サーバーサイド秘匿用、フロントエンド設定に上書きマージ)
CUSTOM_API_BODY=""優先順位
- URL:
CUSTOM_API_URLが設定されている場合、NEXT_PUBLIC_CUSTOM_API_URLより優先されます - ヘッダー・ボディ: フロントエンド設定をベースに、サーバーサイド環境変数の値で上書きマージされます
公開URLでの利用
CUSTOM_API_* や OPENAI_API_KEY などのサーバー側秘匿値を使うAPIは、デフォルトでは AITUBERKIT_SERVER_SECRET_ACCESS_MODE="disabled" により拒否されます。同一マシンのローカルTTS/LLMループバック接続は例外として利用できます。公開デモでは demo と AITUBERKIT_ALLOWED_ORIGINS を設定し、外部アプリや管理用途から呼ぶ場合は protected と AITUBERKIT_SERVER_SECRET_TOKEN を使用してください。unprotected は従来互換用で、公開URLでは推奨されません。
セッションID(threadId)の自動送信
カスタムAPI利用時、ブラウザごとに一意のセッションID(UUID v4)が自動生成され、リクエストボディの threadId フィールドとして送信されます。
- セッションIDは
localStorageに保存され、クッキー/サイトデータを削除しない限り永続的に保持されます - 会話履歴をリセットすると、セッションIDも自動的にリセットされます(新しいIDが生成されます)
- 外部API側でスレッド管理や会話の継続に利用できます
- 不要な場合は外部API側で無視してください
送信されるボディの例:
{
"threadId": "550e8400-e29b-41d4-a716-446655440000",
"messages": [...],
...
}対応フォーマット
カスタムAPIのSSEストリーミングレスポンスは、以下の形式を自動的にVercel AI SDK形式に正規化します:
- OpenAI互換形式:
choices[0].delta.contentを含むレスポンス payload.text形式: 一部のLLM独自形式- Vercel AI SDK形式: そのまま通過
また、OpenAI互換形式の choices[0].delta.reasoning_content を思考プロセス(reasoning)として変換する機能にも対応しています。設定画面で「思考プロセスを表示」をONにすると、カスタムAPIからの思考プロセスを表示できます。
画像のMIMEタイプ送信
マルチモーダルを有効にしている場合、NEXT_PUBLIC_CUSTOM_API_INCLUDE_MIME_TYPE で画像オブジェクトに mimeType プロパティを含めるかどうかを切り替えられます。外部APIがMIMEタイプ付きの画像入力を要求する場合は有効にしてください。
注意
このAPIではストリーミングモードが常に有効になっています。返却形式にご注意ください。
なお、OpenAI互換のAPIや一部のAPIでは動作確認を行っていますが、全てのAPIでの動作を保証するものではありません。
