文档

Mistral Large 4 API 与 Playground 指南

快速上手 Playground 和 API,了解模型 ID、请求示例、服务限制、免费额度和常见问题排查。

打开试验场

概览

登录后即可使用 Playground,或通过账户 API 密钥接入应用。接口模型 ID 为 mistral-large-4-0。请在账户设置中创建密钥,并使用下方基础 URL 和请求示例。 已公布的模型规格列出 1M token 上下文。API 当前接入按 524,288 token 配置,max_tokens 接受的上限为 262,144,实际还取决于上游支持和剩余上下文。Playground 有更小的限制,详见下文。支持文本和图片 URL,不支持直接上传 PDF、视频或音频。

开始第一次对话

登录即可免费使用 Playground。选择示例或输入你的提示词,开始对话。免费额度内的回答逐段显示;超出免费额度后,请求消耗积分,结算成功后显示回答。

  1. 登录你的账号。

  2. 描述任务和相关背景。

  3. 阅读回复,继续追问和完善。

编写有效的提示词

说明任务,提供相关原文,明确输出形式。写作时请补充受众、语言、语气和术语;文档问答请给段落编号,要求引用对应原文,没有依据时明确说明。PDF 需先提取文字再粘贴到输入框。代码问题请提供报错和预期行为。使用结果前应核对事实并运行代码。

目标:向新同事解释这段函数。
背景:一个小型 TypeScript 应用。
输出:简短说明、潜在边界情况,以及一个改进建议。

回复与历史记录

按 Enter 发送,Shift + Enter 换行。「停止」会中断当前回复,「清空对话」会重置 Playground。对话上下文在当前页面打开期间保留,刷新页面会开始新的对话。离开前可复制需要保留的回答。

模型 API

在“账户 → API Keys”中创建 API 密钥。执行 pip install openai 安装 Python 客户端,并将账户密钥存入服务器环境变量 MODEL_API_KEY,使用下方的基础地址和模型 ID。 POST /api/v1/chat/completions 需要 Authorization: Bearer <账户 API 密钥> 和 Content-Type: application/json。非流式响应包含 choices[0].message 与 usage。SDK 示例在服务器运行,密钥不要放入浏览器代码。

POST https://mistrallarge4.com/api/v1/chat/completions

model: mistral-large-4-0

创建账户 API Key
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://mistrallarge4.com/api/v1",
    api_key=os.environ["MODEL_API_KEY"],
)

response = client.chat.completions.create(
    model="mistral-large-4-0",
    messages=[{"role": "user", "content": "Hello!"}],
    max_tokens=2048,
    extra_body={"reasoning": {"effort": "none"}},
)
print(response.choices[0].message.content)

请求参数与限制

API 最多接受 128 条消息,JSON 请求体上限为 2 MiB。当前服务实例上,API 与 Playground 共用每账户每分钟 10 次请求的限额,请求超时为 120 秒。输出限制包含推理 Token;若推理耗尽预算导致没有可见回答,请增大 max_tokens 或选择 none。接口仅接受下表列出的参数。

参数允许值与说明
modelmistral-large-4-0;省略时使用此模型。
messages必填,包含 system、user、assistant 或 tool 消息。用户内容可为文本或 text/image_url 数组。工具结果需要 tool_call_id。
reasoning{ "effort": "none" | "high" },默认 none。也接受 reasoning_effort,但不能与 reasoning 同时传入。
temperature0–2;省略时使用模型默认值,Playground 默认为 0.7。
max_tokens1–262,144,默认 2,048。包含推理和可见输出,且不能超过剩余模型上下文空间。
stream布尔值,默认 false。设为 true 时可附加 stream_options: undefined 获取用量。
response_format{ "type": "text" | "json_object" },或 undefined }。使用 json_object 时请在提示词中要求返回 JSON。
tools最多 32 个函数定义。tool_choice 可为 auto、none、required 或指定函数。由你的应用执行工具并回传结果。
top_p / stop / seed / frequency_penalty / presence_penaltytop_p:0–1;stop:字符串或最多 4 个字符串;seed:整数;frequency_penalty 和 presence_penalty:−2 至 2。均为可选参数。

流式回复

设置 stream: true 接收 SSE data 事件。文本位于 choices[0].delta.content,工具调用增量位于 delta.tool_calls,请求用量后可从 usage 读取 Token 统计。最后一个事件为 data: [DONE]。流中断时可能返回 error 对象,请勿执行参数不完整的工具调用。 以下示例复用上方 API 示例中的 client。直接读取 HTTP 流时,需要缓存数据块,直到得到完整 SSE 事件后再解析。

stream = client.chat.completions.create(
    model="mistral-large-4-0",
    messages=[{"role": "user", "content": "Explain a retry strategy."}],
    stream=True,
    stream_options={"include_usage": True},
    max_tokens=2048,
)

for chunk in stream:
    if chunk.choices:
        print(chunk.choices[0].delta.content or "", end="", flush=True)
    if chunk.usage:
        print(chunk.usage)

图片与结构化输出

将 image_url 设置为可访问、不含账号密码的公开 HTTP 或 HTTPS 图片地址,再与文本内容组合。不支持视频和音频内容。 使用 json_object 获取 JSON 对象,或使用 json_schema 和命名 Schema 定义结构。请检查 finish_reason:length 表示输出预算耗尽,JSON 可能不完整。

response = client.chat.completions.create(
    model="mistral-large-4-0",
    messages=[{
        "role": "user",
        "content": [
            {"type": "text", "text": "Describe this image as JSON."},
            {"type": "image_url", "image_url": {"url": image_url}},
        ],
    }],
    response_format={
        "type": "json_schema",
        "json_schema": {
            "name": "image_summary",
            "strict": True,
            "schema": {
                "type": "object",
                "properties": {"summary": {"type": "string"}},
                "required": ["summary"],
                "additionalProperties": False,
            },
        },
    },
)

工具调用

定义 tools 后读取 message.tool_calls。API 返回函数名和 JSON 参数字符串,不会执行你的函数。由应用校验参数和权限,执行获准的调用,再追加助手消息和包含对应 tool_call_id 的 role: tool 结果,发送下一轮请求。 账户内的助手使用独立的工具配置和对话历史。

response = client.chat.completions.create(
    model="mistral-large-4-0",
    messages=[{"role": "user", "content": "Check order 123."}],
    tools=[{
        "type": "function",
        "function": {
            "name": "get_order",
            "description": "Look up an order the user is allowed to access.",
            "parameters": {
                "type": "object",
                "properties": {"order_id": {"type": "string"}},
                "required": ["order_id"],
            },
        },
    }],
    tool_choice="auto",
)
print(response.choices[0].message.tool_calls)

Playground 登录态接口

POST /api/playground 使用账户登录态,无需 API Key 或模型 ID。GET /api/playground 返回公开模型 ID 和可用设置。 Playground 最多接受 24 条消息,每条 24,000 字符,系统提示词最多 4,000 字符,请求体上限 96 KiB。maxTokens 为 16–16,384;reasoningEffort 为 none 或 high;outputFormat 为 text 或 json。用户消息可通过 media: undefined 附加图片。 此接口使用自定义 SSE 事件:delta 包含 content;done 包含 data.message、data.usage、data.creditsUsed 和 data.elapsedMs;error 包含 message。示例应在登录后的 Playground 页面运行。外部应用请使用上方的 API Key 接口。

const response = await fetch('/api/playground', {
  method: 'POST',
  credentials: 'same-origin',
  headers: { 'Content-Type': 'application/json' },
  body: JSON.stringify({
    messages: [{ role: 'user', content: 'Hello!' }],
    systemPrompt: 'Give a clear, concise answer.',
    reasoningEffort: 'none',
    temperature: 0.7,
    maxTokens: 2048,
    outputFormat: 'text',
  }),
});
if (!response.ok) throw new Error((await response.json()).message);
const reader = response.body.pipeThrough(new TextDecoderStream()).getReader();
while (true) {
  const { value, done } = await reader.read();
  if (done) break;
  console.log(value); // SSE bytes; events may span multiple chunks.
}

积分与方案

登录即可免费使用 Playground,免费额度按新加坡时间(UTC+8)每天零点重置。请求通过校验并获准调用模型时占用免费额度,之后生成失败或取消也计入用量;被拒绝的请求不占用免费额度。免费额度用完后,完整回答按模型实际美元费用 × 12,000 向上取整扣除积分,结算成功后返回回答;余额不足或缺少费用数据时返回错误,不返回回答。生成失败或取消不扣积分。后端限制每位用户每 3 秒一次。API 对话和媒体工具沿用各自现有规则。

价格

常见问题与支持

400:检查模型 ID、消息、参数或附件;401:Playground 请登录,API 请检查账户密钥;402:当天免费次数已用完且积分不足,请前往价格页充值或等待次日额度重置;413:缩小请求体;415:使用 application/json;429:等待 Retry-After 指定时间后重试,Playground 限每位用户每 3 秒一次;502/503:模型服务暂不可用。 HTTP 错误返回 undefined;流式失败通过流内事件返回。如果 high 推理耗尽输出预算,请增大 max_tokens 或切换为 none。持续失败请联系客服。

联系我们