Playground 多模态输入
Playground 里的 Gemini 模型不只接受文本。你能附加什么,取决于当前选中的模型——模型选择器 会标注每个模型的输入能力,附件按钮也只提供当前模型真正能读的格式。
各类输入的处理方式
| 输入 | 如何到达模型 | 支持的模型 |
|---|---|---|
| 图片 | 原生——模型直接"看到"图片 | Gemini 2.5 / 3 系列 |
| 支持时原生传入,否则抽取其文字层 | Gemini 2.5 / 3 系列 | |
| 音频 | 原生——模型直接"听到" | Gemini 2.5 / 3 系列 |
| 视频 | 原生(mp4) | Gemini 2.5 / 3 系列 |
| 文本 / 代码文件 | 抽取文字并注入消息 | 任意模型 |
纯文本模型(DeepSeek、Kimi、Qwen)可以附加文本文件(因为它们最终变成文字),但不能接受 图片、音频或视频。
带着附件切换模型
如果你先附加了文件,又切到读不了该文件的模型,Playground 会阻止发送并提示你移除附件或 更换模型。它不会静默丢弃文件,也不会背着你把图片 OCR 成文字。
限制
- 每条消息最多 3 个文件
- 单个文件 ≤ 50 MB
- 原生媒体(图片 / 音频 / 视频)内联上限为单个 15 MB——这是与 50 MB 文本抽取上限 不同、且更低的一道限制
- 文本抽取:单文件约 10 万字符、每条消息约 15 万字符,超出会截断并提示
- 扫描版 PDF 不做 OCR——无文字层的 PDF 会提示无法提取内容
完整格式清单见文件上传。
隐私
文件在浏览器内编码后随请求发送,不在 Mafdet 服务器上保存;文件正文、base64 内容和抽取 出的文字都不会进入日志。
生成的图片可预览、可下载,但不会持久化进已保存的会话——重新打开会话时看到的是占位提示 而非图片。
计费
Playground 调用消耗你的 Playground 额度,绝不动用 API 钱包。附件由读取它的模型按普通 输入 token 计费——一个大 PDF 或一段视频不会因为来自 Playground 就免费。