国内三家大模型修图能力对比

因为工作需要,想找一个UART数据帧的图片做PPT用,于是就在网上搜了一下,最后感觉下面这张图最合适:

但这张图的背景是黑色的,字和线条都是蓝色的,感觉还是白底黑字的格式最好。于是就想用word里的图片编辑功能,试了很久效果也不好,背景虽然可以通过设置透明色去掉,但字和线条始终改不好。突然想到了大模型,于是就把这张图片分别发给了三家支持图片处理的国产大模型:

  1. 百度文心助手(https://chat.baidu.com/

  2. 豆包(https://www.doubao.com/chat/

  3. 千问(https://www.qianwen.com/

使用的提示词都是"把背景的黑色变成白色,把内容线条变成黑色"。以下是三家返回的结果:

  1. 百度文心助手:
  1. 豆包:
  1. 千问:

对比可以发现以下几点:

  1. 背景都从黑色变成了白色,字和线条都改成了黑色;

  2. 百度文心助手和豆包都有水印,而千问是没有水印的;

  3. 豆包的图片分辨率最高,千问次之,百度文心助手最低;

  4. 豆包的文字内容有错,比如起始位改成了起闲位,数据位改成了起始位,校验位改成了数验位,空闲位改成了校验位,最右侧的起始位改成了停止位。

因此,最后我使用了千问的图片。

相关推荐
Summer-Bright1 天前
深度 | Agent框架大洗牌:AutoGen退场后的新秩序
人工智能·ai·语言模型·ai软件
孪生质数-1 天前
AI 应用实践篇——让大模型真正开始工作
linux·运维·服务器·人工智能·深度学习·语言模型·llama
LDZKKJ2 天前
OpenAI暂停GPT-6训练:AI行业从“竞速“到“刹车“的分水岭
人工智能·gpt·语言模型·chatgpt·transformer
实验如有神祝女士2 天前
不同参数规模大模型在医学翻译场景的适配差异
论文阅读·人工智能·深度学习·学习·算法·语言模型·论文笔记
Black_Rock_br2 天前
闭源双雄 vs 2.8T 开源权重:Kimi K3 / Fable 5 / GPT-5.6 的调用成本与任务适配
人工智能·python·gpt·语言模型·开源
怪奇云呼军3 天前
真实电话环境下,闪电智能 Voice Agent 如何提取声音沟通特征?降噪、VAD 与偏差控制实战
前端·数据库·人工智能·语言模型·语音识别
Liudef063 天前
共生与进化:大语言模型与智能体的双向塑造
人工智能·语言模型·自然语言处理
蓦然回首却已人去楼空3 天前
Build a Large Language Model (From Scratch) 第7章 通过微调遵循人类指令
人工智能·语言模型·自然语言处理
学习中.........4 天前
并行 BPE 训练 与 手写 `Tokenizer`
人工智能·算法·机器学习·语言模型
AndrewHZ4 天前
【LLM技术全景】多模态大模型:当语言模型学会“看“和“听“
人工智能·gpt·深度学习·语言模型·自然语言处理·llm·多模态