よくある質問
利用を始めるには何が必要ですか
ダッシュボードでプロジェクトを選び、推論用のAPIキーを発行します。 APIキーと利用可能なモデルIDを確認してから、クイックスタートのリクエストを送ってください。
APIキーはどこで再確認できますか
APIキーの平文は、発行時または再生成時に一度だけ表示されます。 保存していない場合は元の値を確認できないため、APIキーを再生成し、利用中のアプリケーションへ新しい値を設定してください。
どのモデルを指定すればよいですか
GET /v1/models が返す data[].id から選びます。
一覧に auto が含まれる場合は、自動選択も利用できます。
固定のモデル一覧をアプリケーションへ埋め込まず、組織、ルール、APIキーの設定を変更した後は一覧を読み直してください。
指定したモデルと応答したモデルが違うのはなぜですか
自動選択またはフォールバックによって別のモデルが応答したためです。
レスポンスの model、X-AIGateway-Served-Model、X-AIGateway-Fallback-Count を確認してください。
OpenAI SDKとAnthropic SDKで同じAPIキーを使えますか
同じAPIキーを使えます。
ただし、OpenAI SDKはベースURLを https://ai-gateway.lolipop.jp/v1、Anthropic SDKは https://ai-gateway.lolipop.jp/anthropic に設定します。
401 Invalid API key が返るのはなぜですか
APIキーの入力誤り、期限切れ、無効化、再生成後の古い値が主な原因です。
認証ヘッダーが複数付いている場合も 401 になるため、Authorization、x-api-key、anthropic-api-key のいずれかひとつだけを送ってください。
402 Payment Required が返るのはなぜですか
前払いのクレジット残高が、リクエスト時に予約する見積額を満たしていません。 ダッシュボードで残高と処理中のチャージを確認してください。
403 Forbidden が返るのはなぜですか
組織やプロジェクトの状態、モデルの許可、予算上限、auto の必須設定を確認してください。
本文の code に応じた確認箇所はエラーとデバッグに記載しています。
429 Too Many Requests が返るのはなぜですか
認証試行、同時受付、組織、プロジェクト、APIキーのいずれかのレート制限に達しています。
retry-after がある場合はその秒数を待ち、再実行の間隔を広げてください。
パラメーターを指定しても応答が変わらないのはなぜですか
利用したエンドポイントで受け付けていないか、受け付けてもモデルへ渡さないフィールドである可能性があります。 パラメーターと各エンドポイントの「受け付けるフィールド」を確認してください。
ストリーミングが途中で終わったかどうかはどう判断しますか
Chat Completionsは [DONE]、Responsesは response.completed、Messagesは message_stop を確認します。
完了を示す値より前に接続が閉じた場合は、応答が中断されています。
プロンプトキャッシュが使われないのはなぜですか
モデルが指定した方式に対応しているか、共通の長い前提が入力の先頭に同じ順序で置かれているかを確認してください。
auto やフォールバックを使う場合は、すべての候補が同じキャッシュ方式に対応している必要があります。
BYOKではプロバイダーのAPIキーをリクエストへ含めますか
含めません。 プロバイダーのAPIキーはプロジェクトのBYOK画面へ登録し、推論リクエストの認証にはロリポップ!AIゲートウェイのAPIキーを使います。
マネジメントトークンで推論できますか
マネジメントトークンはダッシュボードの管理操作を自動化する認証情報であり、推論には使えません。
/v1/chat/completions などの推論APIには、プロジェクトで発行したAPIキーを使ってください。
利用額とトークン数はどこで確認できますか
ダッシュボードの「使用状況」で、組織、プロジェクト、APIキーごとの推移と内訳を確認できます。 組織の使用状況はCSVとして書き出せます。