国内三家大模型修图能力对比

因为工作需要,想找一个UART数据帧的图片做PPT用,于是就在网上搜了一下,最后感觉下面这张图最合适:

但这张图的背景是黑色的,字和线条都是蓝色的,感觉还是白底黑字的格式最好。于是就想用word里的图片编辑功能,试了很久效果也不好,背景虽然可以通过设置透明色去掉,但字和线条始终改不好。突然想到了大模型,于是就把这张图片分别发给了三家支持图片处理的国产大模型:

  1. 百度文心助手(https://chat.baidu.com/

  2. 豆包(https://www.doubao.com/chat/

  3. 千问(https://www.qianwen.com/

使用的提示词都是"把背景的黑色变成白色,把内容线条变成黑色"。以下是三家返回的结果:

  1. 百度文心助手:
  1. 豆包:
  1. 千问:

对比可以发现以下几点:

  1. 背景都从黑色变成了白色,字和线条都改成了黑色;

  2. 百度文心助手和豆包都有水印,而千问是没有水印的;

  3. 豆包的图片分辨率最高,千问次之,百度文心助手最低;

  4. 豆包的文字内容有错,比如起始位改成了起闲位,数据位改成了起始位,校验位改成了数验位,空闲位改成了校验位,最右侧的起始位改成了停止位。

因此,最后我使用了千问的图片。

相关推荐
牛马工作号9 小时前
RK3588 使用 rk-llama.cpp + RKNPU2 部署 Qwen3.5:从零开始的 NPU 本地大模型实战
人工智能·语言模型·llama
书源丶10 小时前
Qwen3-Embedding-0.6B 纯 CPU
网络·语言模型·embedding·llama
有Li1 天前
【AI答疑】MR数据预处理步骤
人工智能·笔记·算法·语言模型·医学生
阡陌数智1 天前
基于大语言模型的通用可配置 PII 隐私数据检测方案
人工智能·语言模型·自然语言处理
user_admin_god1 天前
第 11 篇:实践三 —— 表单 / 合同字段抽取
java·人工智能·spring boot·语言模型
gravity_w1 天前
【CS336】Lecture 2 PyTorch 与资源核算(Resource Accounting)
人工智能·深度学习·语言模型·llm·nlp·flops·cs336
像素科技1 天前
什么是LLM大语言模型
语言模型
硅谷秋水1 天前
GE-Act 2.0:面向机器人操作的“世界-动作”模型预训练与扩展
机器学习·计算机视觉·语言模型·机器人
Chloe.Zz1 天前
提示词工程
人工智能·语言模型·自然语言处理
海上小飞龙2 天前
LangChain 模型调用:invoke、stream、batch 到底该怎么选?
人工智能·语言模型·自然语言处理