大模型 json格式 修复

随着大模型应用越来越多,大模型返回的json应用也增多,这些json 时不时会出现破损。 如何修复json串,成为大模型应用要处理的一个问题。

工具

在网上看到这库,试了下效果不错。这是个js库,用typescript写的,可以前端调用;也可以用pythonmonkey 在python 中调用。其原理是BNF解析器,使用解析器的规则修复json格式问题。

安装

js 复制代码
$ npm install jsonrepair

import { jsonrepair } from 'jsonrepair'
try {
const json = "{name: 'John'}"
const repaired = jsonrepair(json)
console.log(repaired) // '{"name": "John"}'
} catch (err) {
console.error(err)
}
python 复制代码
pip install pythonmonkey

import pythonmonkey
jsonrepair = pythonmonkey.require('jsonrepair').jsonrepair
json = "[1,2,3,"
repaired = jsonrepair(json)
print(repaired) 
# [1,2,3]

能修复哪些问题

  • 在缺少的键周围添加引号
  • 添加缺少的转义字符
  • 添加缺失的逗号
  • 添加缺失的右括号
  • 修复截断的 JSON
  • 将单引号替换为双引号
  • "..." 用常规双引号替换特殊引号字符
  • 用常规空格替换特殊空格字符
  • 将 Python 常量NoneTrueFalse替换为nulltruefalse
  • 删除尾随逗号
  • 删除类似/* ... */和的评论// ...
  • 带围栏的代码块,如 ```json和```````````
  • 删除数组和对象中的省略号,例如[1, 2, 3, ...]
  • 删除 JSONP 符号,例如callback({ ... })
  • 从转义字符串中去除转义字符,例如{"stringified": "content"}
  • 删除 MongoDB 数据类型,如NumberLong(2)ISODate("2012-12-19T06:01:17.171Z")
  • 连接字符串,例如"long text" + "more text on next line"
  • 将换行符分隔的 JSON 转换为有效的 JSON 数组,例如:
json 复制代码
{ "id": 1, "name": "John" }
{ "id": 2, "name": "Sarah" } 

网上demo

我测试的情况如下,// 注释,另起一行就可以修复,在同一行的就处理不了。

arduino 复制代码
{
  'firstName': 'John'
  lastName: "Smith"
  fullName: John Smith,
  // 这是一个另  
    scores: [ 7.8 6.3 7.3, ],
  "about": "John loves a challenge, "
// 这是一个另 }

处理有问题:

arduino 复制代码
{
  'firstName': 'John'
  lastName: "Smith"
  fullName: John Smith, // 这是一个另  
    scores: [ 7.8 6.3 7.3, ],
  "about": "John loves a challenge, "
// 这是一个另 }

类似库

相关推荐
量子位3 小时前
20亿美金苏度科技具身首秀即大招!0真机数据,zero-shot,跑出98%首次抓取成功率
llm·aigc
飞翔的SA5 小时前
从6.75%到100%!大模型Function Calling终极方案:Harness工程如何驯服
开发语言·ai·llm·harness
_张一凡7 小时前
【大语言模型学习】2026年最适合新手的小型LLM训练项目全指南:从26M到1B,3块钱就能从头训练
llm·aigc·大语言模型·大语言模型微调
AIFrontiers8 小时前
LLM核心参数配置指南:原理篇
llm
韩师傅9 小时前
12GB 小模型路由器(推理篇):INT4、vLLM 与双 QLoRA 切换
pytorch·架构·llm
404号扳手9 小时前
03大模型核心原理
人工智能·llm
EdisonZhou10 小时前
MAF快速入门(24)整合多个Skill来源
llm·agent·.net core
智慧地球(AI·Earth)10 小时前
用 Python 构建一个“记性好”的 AI 助手:JSON本地存储和向量检索
人工智能·python·json
程序员三明治10 小时前
【AI探索】程序员到底该怎么理解 LLM?
人工智能·ai·大模型·llm·量化·java后端·api调用
呆呆敲代码的小Y1 天前
从LLM到Agent Skill:AI核心技术全拆解与系统化学习路线
人工智能·ai·llm·agent·优化·skill·mcp