概览
登录后即可使用 Playground,或通过账户 API 密钥接入应用。接口模型 ID 为 mistral-large-4-0。请在账户设置中创建密钥,并使用下方基础 URL 和请求示例。 已公布的模型规格列出 1M token 上下文。API 当前接入按 524,288 token 配置,max_tokens 接受的上限为 262,144,实际还取决于上游支持和剩余上下文。Playground 有更小的限制,详见下文。支持文本和图片 URL,不支持直接上传 PDF、视频或音频。
开始第一次对话
登录即可免费使用 Playground。选择示例或输入你的提示词,开始对话。免费额度内的回答逐段显示;超出免费额度后,请求消耗积分,结算成功后显示回答。
登录你的账号。
描述任务和相关背景。
阅读回复,继续追问和完善。
编写有效的提示词
说明任务,提供相关原文,明确输出形式。写作时请补充受众、语言、语气和术语;文档问答请给段落编号,要求引用对应原文,没有依据时明确说明。PDF 需先提取文字再粘贴到输入框。代码问题请提供报错和预期行为。使用结果前应核对事实并运行代码。
目标:向新同事解释这段函数。
背景:一个小型 TypeScript 应用。
输出:简短说明、潜在边界情况,以及一个改进建议。回复与历史记录
按 Enter 发送,Shift + Enter 换行。「停止」会中断当前回复,「清空对话」会重置 Playground。对话上下文在当前页面打开期间保留,刷新页面会开始新的对话。离开前可复制需要保留的回答。
模型 API
在“账户 → API Keys”中创建 API 密钥。执行 pip install openai 安装 Python 客户端,并将账户密钥存入服务器环境变量 MODEL_API_KEY,使用下方的基础地址和模型 ID。 POST /api/v1/chat/completions 需要 Authorization: Bearer <账户 API 密钥> 和 Content-Type: application/json。非流式响应包含 choices[0].message 与 usage。SDK 示例在服务器运行,密钥不要放入浏览器代码。
import os
from openai import OpenAI
client = OpenAI(
base_url="https://mistrallarge4.com/api/v1",
api_key=os.environ["MODEL_API_KEY"],
)
response = client.chat.completions.create(
model="mistral-large-4-0",
messages=[{"role": "user", "content": "Hello!"}],
max_tokens=2048,
extra_body={"reasoning": {"effort": "none"}},
)
print(response.choices[0].message.content)请求参数与限制
API 最多接受 128 条消息,JSON 请求体上限为 2 MiB。当前服务实例上,API 与 Playground 共用每账户每分钟 10 次请求的限额,请求超时为 120 秒。输出限制包含推理 Token;若推理耗尽预算导致没有可见回答,请增大 max_tokens 或选择 none。接口仅接受下表列出的参数。
| 参数 | 允许值与说明 |
|---|---|
| model | mistral-large-4-0;省略时使用此模型。 |
| messages | 必填,包含 system、user、assistant 或 tool 消息。用户内容可为文本或 text/image_url 数组。工具结果需要 tool_call_id。 |
| reasoning | { "effort": "none" | "high" },默认 none。也接受 reasoning_effort,但不能与 reasoning 同时传入。 |
| temperature | 0–2;省略时使用模型默认值,Playground 默认为 0.7。 |
| max_tokens | 1–262,144,默认 2,048。包含推理和可见输出,且不能超过剩余模型上下文空间。 |
| stream | 布尔值,默认 false。设为 true 时可附加 stream_options: undefined 获取用量。 |
| response_format | { "type": "text" | "json_object" },或 undefined }。使用 json_object 时请在提示词中要求返回 JSON。 |
| tools | 最多 32 个函数定义。tool_choice 可为 auto、none、required 或指定函数。由你的应用执行工具并回传结果。 |
| top_p / stop / seed / frequency_penalty / presence_penalty | top_p:0–1;stop:字符串或最多 4 个字符串;seed:整数;frequency_penalty 和 presence_penalty:−2 至 2。均为可选参数。 |
流式回复
设置 stream: true 接收 SSE data 事件。文本位于 choices[0].delta.content,工具调用增量位于 delta.tool_calls,请求用量后可从 usage 读取 Token 统计。最后一个事件为 data: [DONE]。流中断时可能返回 error 对象,请勿执行参数不完整的工具调用。 以下示例复用上方 API 示例中的 client。直接读取 HTTP 流时,需要缓存数据块,直到得到完整 SSE 事件后再解析。
stream = client.chat.completions.create(
model="mistral-large-4-0",
messages=[{"role": "user", "content": "Explain a retry strategy."}],
stream=True,
stream_options={"include_usage": True},
max_tokens=2048,
)
for chunk in stream:
if chunk.choices:
print(chunk.choices[0].delta.content or "", end="", flush=True)
if chunk.usage:
print(chunk.usage)图片与结构化输出
将 image_url 设置为可访问、不含账号密码的公开 HTTP 或 HTTPS 图片地址,再与文本内容组合。不支持视频和音频内容。 使用 json_object 获取 JSON 对象,或使用 json_schema 和命名 Schema 定义结构。请检查 finish_reason:length 表示输出预算耗尽,JSON 可能不完整。
response = client.chat.completions.create(
model="mistral-large-4-0",
messages=[{
"role": "user",
"content": [
{"type": "text", "text": "Describe this image as JSON."},
{"type": "image_url", "image_url": {"url": image_url}},
],
}],
response_format={
"type": "json_schema",
"json_schema": {
"name": "image_summary",
"strict": True,
"schema": {
"type": "object",
"properties": {"summary": {"type": "string"}},
"required": ["summary"],
"additionalProperties": False,
},
},
},
)工具调用
定义 tools 后读取 message.tool_calls。API 返回函数名和 JSON 参数字符串,不会执行你的函数。由应用校验参数和权限,执行获准的调用,再追加助手消息和包含对应 tool_call_id 的 role: tool 结果,发送下一轮请求。 账户内的助手使用独立的工具配置和对话历史。
response = client.chat.completions.create(
model="mistral-large-4-0",
messages=[{"role": "user", "content": "Check order 123."}],
tools=[{
"type": "function",
"function": {
"name": "get_order",
"description": "Look up an order the user is allowed to access.",
"parameters": {
"type": "object",
"properties": {"order_id": {"type": "string"}},
"required": ["order_id"],
},
},
}],
tool_choice="auto",
)
print(response.choices[0].message.tool_calls)Playground 登录态接口
POST /api/playground 使用账户登录态,无需 API Key 或模型 ID。GET /api/playground 返回公开模型 ID 和可用设置。 Playground 最多接受 24 条消息,每条 24,000 字符,系统提示词最多 4,000 字符,请求体上限 96 KiB。maxTokens 为 16–16,384;reasoningEffort 为 none 或 high;outputFormat 为 text 或 json。用户消息可通过 media: undefined 附加图片。 此接口使用自定义 SSE 事件:delta 包含 content;done 包含 data.message、data.usage、data.creditsUsed 和 data.elapsedMs;error 包含 message。示例应在登录后的 Playground 页面运行。外部应用请使用上方的 API Key 接口。
const response = await fetch('/api/playground', {
method: 'POST',
credentials: 'same-origin',
headers: { 'Content-Type': 'application/json' },
body: JSON.stringify({
messages: [{ role: 'user', content: 'Hello!' }],
systemPrompt: 'Give a clear, concise answer.',
reasoningEffort: 'none',
temperature: 0.7,
maxTokens: 2048,
outputFormat: 'text',
}),
});
if (!response.ok) throw new Error((await response.json()).message);
const reader = response.body.pipeThrough(new TextDecoderStream()).getReader();
while (true) {
const { value, done } = await reader.read();
if (done) break;
console.log(value); // SSE bytes; events may span multiple chunks.
}积分与方案
登录即可免费使用 Playground,免费额度按新加坡时间(UTC+8)每天零点重置。请求通过校验并获准调用模型时占用免费额度,之后生成失败或取消也计入用量;被拒绝的请求不占用免费额度。免费额度用完后,完整回答按模型实际美元费用 × 12,000 向上取整扣除积分,结算成功后返回回答;余额不足或缺少费用数据时返回错误,不返回回答。生成失败或取消不扣积分。后端限制每位用户每 3 秒一次。API 对话和媒体工具沿用各自现有规则。
价格常见问题与支持
400:检查模型 ID、消息、参数或附件;401:Playground 请登录,API 请检查账户密钥;402:当天免费次数已用完且积分不足,请前往价格页充值或等待次日额度重置;413:缩小请求体;415:使用 application/json;429:等待 Retry-After 指定时间后重试,Playground 限每位用户每 3 秒一次;502/503:模型服务暂不可用。 HTTP 错误返回 undefined;流式失败通过流内事件返回。如果 high 推理耗尽输出预算,请增大 max_tokens 或切换为 none。持续失败请联系客服。
联系我们