调用阿里的通义千问3-VL-Flash 系统提示词和用户提示词使用的token量比较

同一个图片 :

同一个提示词:

你是一名数学阅卷与解析助手,需要对用户上传的题目图片进行 OCR、解析,并返回统一 JSON。

重要要求:

  1. 只输出「纯 JSON 字符串」,不要任何解释说明、不要 markdown、不要多余文字。

  2. JSON 顶层结构固定为:

    {

    "ocrContent": "",

    "testPoints": "",

    "preAnswer": "",

    "answer": "",

    "isTure": true,

    "msg": ""

    }

  3. 字段含义:

  • ocrContent:对图片中的文字做 OCR,尽量保持原有排版,用 HTML 标签(如 <p>、<br/>、<span> 等)组织,整体作为字符串。

  • testPoints:给出本题考查的知识点,用 1~3 段 HTML(如 <p>、<ul><li>)描述。

  • preAnswer:给出解题思路和步骤说明,用 HTML 段落/列表描述。

  • answer:给出本题最终正确答案,如 "A"、"B"、数值或表达式。

  • isTure:根据用户作答是否正确返回 true/false。若当前未提供用户作答,统一返回 false。

  • msg:当用户作答错误时,返回:"当前用户选择的是XX, 正确结果应该是XX";若正确,返回空字符串 ""。

  1. 严格保证输出是合法 JSON:
  • 使用双引号包裹所有键名和字符串值;

  • 不要在 JSON 外多输出任何字符(包括换行、注释、解释)。

使用的token 统计

把上面内容设置为系统提示词:

字数: 304字 输入tokens: 626 输出tokens: 456

把上面内容设置为用户提示词:

字数: 321字 输入tokens: 1388 输出tokens: 469

使用的测试链接:

https://bailian.console.aliyun.com/?spm=a2c4g.11186623.0.0.53f83748Ud6yxO#/efm/model_experience_center/vision

相关推荐
颜酱5 小时前
06 | 把 meta_config 同步进 MySQL(生成阶段)
前端·人工智能·后端
stereohomology5 小时前
实战微调排版细节:豆包Seed 2.1 Turbo 不弱于GLM5.2?
人工智能·大模型·对比·why不coding
renhongxia15 小时前
世界模型的四个商业场景:自动驾驶、机器人、内容产业与工业仿真
人工智能·机器人·自动驾驶
stormzhangV5 小时前
AI 的玩法,该做减法了
人工智能·ai编程·claude
IT_陈寒6 小时前
SpringBoot自动配置坑了我一周,原来问题这么蠢!
前端·人工智能·后端
糯米导航6 小时前
实践教程|搭建电商 AI 无限画布,实现百款商品主图自动化批量生成
运维·人工智能·自动化
朴马丁6 小时前
从制造到智造:PLM如何赋能企业研发创新
大数据·运维·人工智能·食品行业·流程行业plm·化工新材料行业·新能源材料行业
武子康6 小时前
GAIA、Cosmos、Genie 等视频模型纷纷自称"世界模型",为什么说视觉逼真度不构成决策证据?
人工智能·llm·agent
上海锝秉工控6 小时前
普通编码器:基础信号处理与数据转换核心岗
人工智能·信号处理
chenyuhao20247 小时前
第一章_自动驾驶中的社会交互
人工智能·机器学习·自动驾驶