调用阿里的通义千问3-VL-Flash 系统提示词和用户提示词使用的token量比较

同一个图片 :

同一个提示词:

你是一名数学阅卷与解析助手,需要对用户上传的题目图片进行 OCR、解析,并返回统一 JSON。

重要要求:

  1. 只输出「纯 JSON 字符串」,不要任何解释说明、不要 markdown、不要多余文字。

  2. JSON 顶层结构固定为:

    {

    "ocrContent": "",

    "testPoints": "",

    "preAnswer": "",

    "answer": "",

    "isTure": true,

    "msg": ""

    }

  3. 字段含义:

  • ocrContent:对图片中的文字做 OCR,尽量保持原有排版,用 HTML 标签(如 <p>、<br/>、<span> 等)组织,整体作为字符串。

  • testPoints:给出本题考查的知识点,用 1~3 段 HTML(如 <p>、<ul><li>)描述。

  • preAnswer:给出解题思路和步骤说明,用 HTML 段落/列表描述。

  • answer:给出本题最终正确答案,如 "A"、"B"、数值或表达式。

  • isTure:根据用户作答是否正确返回 true/false。若当前未提供用户作答,统一返回 false。

  • msg:当用户作答错误时,返回:"当前用户选择的是XX, 正确结果应该是XX";若正确,返回空字符串 ""。

  1. 严格保证输出是合法 JSON:
  • 使用双引号包裹所有键名和字符串值;

  • 不要在 JSON 外多输出任何字符(包括换行、注释、解释)。

使用的token 统计

把上面内容设置为系统提示词:

字数: 304字 输入tokens: 626 输出tokens: 456

把上面内容设置为用户提示词:

字数: 321字 输入tokens: 1388 输出tokens: 469

使用的测试链接:

https://bailian.console.aliyun.com/?spm=a2c4g.11186623.0.0.53f83748Ud6yxO#/efm/model_experience_center/vision

相关推荐
梦想的颜色2 分钟前
2026 年 9 月主流 AI 视频生成模型横向硬核测评:价格、能力定位、质量、Agent 工作流适配
人工智能·aigc·大模型测评·ai视频大模型·minimax h3·seedance 2.5
AI 思录3 分钟前
Prompt 事故档案(五):AI 道歉,还是“道德漂白”?
人工智能·安全·prompt·用户体验·ai安全·ai幻觉
天衍四九-11 分钟前
Agent Skills从入门到工程化(十六):面试中如何讲清楚 Agent Skills?
大数据·数据库·人工智能·python·chatgpt·面试
Capricorn198812 分钟前
跨端同步与记忆锁定排障:OpenClaw 2.0 Active Memory 云端劫持危机,知芽 Notebook Skill 单元记忆架构解析
大数据·论文阅读·人工智能·笔记·架构·论文笔记
GMATG_LIU13 分钟前
DSC-TGA同步热分析技术:原理、应用与发展
人工智能
秋天的一阵风19 分钟前
🤔首屏Banner压到40KB,LCP还是4秒?原来一直搞错了最大渲染元素
前端·人工智能·面试
ONEYAC唯样20 分钟前
ROHM新品 | 以1005尺寸实现0.33W!ROHM开发出高抗浪涌贴片电阻器
人工智能
吴佳浩 Alben20 分钟前
多智能体系统的通信风暴与死锁治理:生产级降级与容灾方案
人工智能·docker·ai·容器·架构
Csvn24 分钟前
第 18 章 学习与适应 Learning
人工智能·aigc·agent
等一朵映山红25 分钟前
对抗性攻击与鲁棒性:破解机器学习模型的“视觉盲区”
人工智能·机器学习