Mafdet AI 帮助中心English

Playground 多模态输入

Playground 里的 Gemini 模型不只接受文本。你能附加什么,取决于当前选中的模型——模型选择器 会标注每个模型的输入能力,附件按钮也只提供当前模型真正能读的格式。

各类输入的处理方式

输入如何到达模型支持的模型
图片原生——模型直接"看到"图片Gemini 2.5 / 3 系列
PDF支持时原生传入,否则抽取其文字层Gemini 2.5 / 3 系列
音频原生——模型直接"听到"Gemini 2.5 / 3 系列
视频原生(mp4)Gemini 2.5 / 3 系列
文本 / 代码文件抽取文字并注入消息任意模型

纯文本模型(DeepSeek、Kimi、Qwen)可以附加文本文件(因为它们最终变成文字),但不能接受 图片、音频或视频。

带着附件切换模型

如果你先附加了文件,又切到读不了该文件的模型,Playground 会阻止发送并提示你移除附件或 更换模型。它不会静默丢弃文件,也不会背着你把图片 OCR 成文字。

限制

  • 每条消息最多 3 个文件
  • 单个文件 ≤ 50 MB
  • 原生媒体(图片 / 音频 / 视频)内联上限为单个 15 MB——这是与 50 MB 文本抽取上限 不同、且更低的一道限制
  • 文本抽取:单文件约 10 万字符、每条消息约 15 万字符,超出会截断并提示
  • 扫描版 PDF 不做 OCR——无文字层的 PDF 会提示无法提取内容

完整格式清单见文件上传

隐私

文件在浏览器内编码后随请求发送,不在 Mafdet 服务器上保存;文件正文、base64 内容和抽取 出的文字都不会进入日志。

生成的图片可预览、可下载,但不会持久化进已保存的会话——重新打开会话时看到的是占位提示 而非图片。

计费

Playground 调用消耗你的 Playground 额度,绝不动用 API 钱包。附件由读取它的模型按普通 输入 token 计费——一个大 PDF 或一段视频不会因为来自 Playground 就免费。

下一步