モデルのオプション設定
オプション設定
- LLMモデルとそのオプションを 1 行で指定できます。書式は
モデル名 [--option1=value] [--option2=value] ...です。オプションが指定されていない場合は、デフォルト値が使用されます。
AIモデル指定のオプション
| オプション | 説明 | デフォルト |
|---|---|---|
baseurl | APIエンドポイントのベースURL。OpenRouter以外を使用する場合に変更します。 | https://openrouter.ai/api/v1 |
reasoning | 対応しているモデルで推論モードを指定します。true, false, none, minimal, low, medium, high, xhigh | (なし) |
reasoning_effort | 指定方法がreasoning_effort タイプの推論モードを指定します。 | (なし) |
kwargs_reasoning | 指定方法がchat_template_kwargs.enable_thinkingタイプの推論モードを指定します。 | (なし) |
temperature | 生成のランダム性を制御します。低いほど決定的になります。 | (モデルのデフォルト) |
top_p | Nucleusサンプリングのパラメータ。 | (モデルのデフォルト) |
top_k | Top-kサンプリングのパラメータ。 | (モデルのデフォルト) |
frequency_penalty | 既存の頻度に基づいて新しいトークンにペナルティを与えます。 | (モデルのデフォルト) |
presence_penalty | テキスト中に既出かどうかに基づいて新しいトークンにペナルティを与えます。 | (モデルのデフォルト) |
repetition_penalty | トークンシーケンスの繰り返しにペナルティを与えます。 | (モデルのデフォルト) |
min_p | 考慮されるトークンの最小確率を設定します。 | (モデルのデフォルト) |
top_a | 最も可能性の高いトークンの累積確率に基づいてトークンをフィルタリングします。 | (モデルのデフォルト) |
max_tokens | 生成するトークンの最大数。 | 10240 |
timeout | ストーリー生成時のタイムアウト(ミリ秒) | 600000 |
only | (OpenRouter使用時のみ)特定のプロバイダのみを使用する | (なし) |
strict | 構造化出力で、trueの場合はjson_schema、falseの場合はjson_objectを指定します。 | false |
stream | ストリーミング生成の可否を指定します。 | true |
例
- DeepSeek V4 Flash 0731 を使用する場合:
deepseek/deepseek-v4-flash-0731 - ローカルのLM Studioインスタンスに接続する場合:
dummy --baseurl=http://127.0.0.1:1234/v1- モデル名を指定しない場合でも、ダミーテキストを入れてください。
- OpenRouter経由でGoogle AI StudioのGemini 3.5 Flash lite previewを使う場合:
google/gemini-3.5-flash-lite-preview --only=google-ai-studio- プロバイダにGoogle AI Studioを直接使う場合:
gemini-3.5-flash-lite --baseurl=https://generativelanguage.googleapis.com/v1beta/openai/
- プロバイダにGoogle AI Studioを直接使う場合:
オプションの有効性
- モデルが受け付けるオプションはモデルごとに異なります。受け付けないオプション指定は無効となります。
プリセットの利用
- 上記のオプション指定の代わりに、OpenRouterのプリセットを設定・使用すると、API呼び出しの際にその設定が自動適用されます。
OpenRouter以外への接続
- 本アプリはOpenAI SDKを利用しています。BaseURLでOpenAI SDK互換のURLを指定してください。
- 互換を謳うすべてのプロバイダへの接続を保証するものではありません。