gpt

YH55269848 小时前
java·jvm·人工智能·gpt·算法·chatgpt
GPT‑5.6 Sol 原本支持 1M 上下文,Codex 现已放开此前限制,如何看待这次调整?因为很多人第一眼看到这个消息,可能会理解成:“Codex上下文从20多万升级到100万了,性能直接翻四倍。”
最强小杰1 天前
java·人工智能·gpt·ai
gpt-5.6-sol 频繁报 503 怎么办?区分容量熔断和限速 429 的排查方法 + 可复用 retry wrapper上周三我在跑一个图像理解的 pipeline,用的 gpt-5.6-sol,跑了大概 200 张图之后开始疯狂 503。一开始以为是 OpenAI 又炸了,但切回 gpt-5.5 同样的请求量完全没问题。折腾了大半天才搞明白——gpt-5.6-sol 的 Ultrafast 推理模式走的是独立集群,区域容量不足时返回的是 503(容量熔断),不是我们熟悉的 429(限速)。重试策略必须用指数退避,固定间隔重试只会让情况更糟。
奇牙coding1234 天前
linux·服务器·gpt·ai
GPT-5.6 Sol 接入全流程:stream 参数配置不当会导致响应静默降速,这篇记录我踩过的所有坑上周三 OpenAI 博客发了篇关于 gpt-5.6-sol 的介绍,紧接着又传出降价的消息(目前仍是传闻,待官方确认)。我当天晚上就开始往项目里接,结果折腾到很晚——不是接不通,是接通了但速度完全不对。最后定位到原因:gpt-5.6-sol 的 stream 参数配置与 gpt-5.5 存在不兼容之处,沿用老配置时 API 会静默回退到标准模式,连个 warning 都不给你。这篇把我踩过的坑都写出来,供参考。
奇牙coding1232 天前
gpt·ai
gpt-5.6-luna 频繁 429 但 gpt-5.5 正常怎么办?不是配额问题,是 luna 独立的并发 session 限速桶上周三我在跑一个批量摘要任务,把模型从 gpt-5.5 切到 gpt-5.6-luna,代码一行没改,结果 429 错误持续涌现。查了半小时余额、查了半小时 Tier 等级,最后才发现:luna 的限速机制跟 gpt-5.5 完全不一样——gpt-5.5 按 token/min(TPM)计,luna 按并发 session 数计,重置窗口也从 60s 变成了 30s 滑动窗口(个人实测值,非官方文档值)。 你的 429 大概率不是"请求太快",而是"同时在飞的请求太多"。下面把排查路径、Retry-Aft
自律懒人2 天前
gpt
Codex token 计费 4 个隐藏加价点:同一段代码两个模型计费差 30%,3 步算清真实账单同一段文字,扔给两个模型,一个切出 766 个 token,另一个切出 1170 个。单价都是 5 美元/百万 token,前者却比后者便宜 34.5%。这不是估算,是 OpenAI Codex 负责人 Tibo 上周亲自贴出来的对比数据。
ITKEY_2 天前
gpt
gpt-5.6-luna max 1%周额度有多耐用?经常听人说gpt-5.6-luna max 性价比高,非常的耐用。我只是听听,没有实际使用过。 今天在做RuoYi的前端国际化时突然想测试一下,与是就开始了近2小时的测试。
澳鹏Appen4 天前
人工智能·gpt·ai·语言模型
AppenTalk | GPT-Red:AI 自动攻防,能替代人类红队吗?当 AI 系统开始自主浏览网页、读取邮件、调用工具,攻击面也在同步扩大。将恶意指令隐藏在网页、文件或工具中的提示注入(Prompt Injection)已成为大模型安全面临的最棘手挑战之一。
大模型丫丫3 天前
gpt·深度学习·transformer
Transformer架构详解:从Attention到GPT的演进之路Transformer 是近年来自然语言处理(NLP)领域最具革命性的架构之一。自 2017 年 Google 在论文《Attention Is All You Need》中提出以来,它彻底改变了序列建模的范式,取代了传统的循环神经网络(RNN)和卷积神经网络(CNN),成为大语言模型(如 GPT、BERT、T5 等)的核心基础。
JavaPub-rodert3 天前
人工智能·gpt·chatgpt
Codex 从 0 开始:安装 ChatGPT,并接入 DeepSeek最近我一直在折腾 Codex。很多朋友知道 Codex 可以直接使用 ChatGPT,但可能不知道,现在我们还可以通过一些工具,把 DeepSeek 等模型接入 Codex,继续使用 Codex 本身的 Agent、项目管理和工具调用能力。
阿祖zu3 天前
linux·gpt·agent
开源项目-让本地 Codex 临时接管远程 Linux 服务,实现快速运维让 Codex 临时连接远程 Linux 完成诊断与维护,并通过分级权限、自动过期和执行审计控制运维风险。
ASKED_20194 天前
人工智能·gpt·语音识别
从 ASR+LLM+TTS 到 GPT‑Live:解读语音智能新范式本文围绕视频《This is the new ChatGPT Voice, powered by GPT‑Live》展开,结合公开资料,梳理当前语音智能的主要技术路线、代表性模型和 GPT‑Live 的技术意义。
chunmiao30324 天前
gpt·目标检测·目标跟踪
GPT-5.6 Sol 视觉评测:目标检测翻三倍,大模型开始“干视觉活“第三方视觉评测机构 Roboflow 最近把 OpenAI 的 GPT-5.6 全家桶(Sol、Terra、Luna)拉进自己的视觉基准跑了一轮,结果里有个数字很扎眼:目标检测这一项,上一代 GPT-5.5 只拿到 13.8 分,GPT-5.6 Sol 直接冲到 46.2,涨了三倍多。Roboflow 项目负责人评价说,这是 OpenAI 有史以来最强的视觉模型。
赛博三把手4 天前
gpt
2026最新小龙虾(OpenClaw)接入第三方中转Api,低成本配置GPT/Gemini/Claude海外顶级模型完整图文教程,小白一看就懂说明:本文仅用于技术学习与个人本地开发环境搭建交流,请遵守相关平台服务条款和当地法律法规,妥善保管账号信息与密钥。
yingyuecom6 天前
人工智能·gpt·chatgpt·prompt·aigc
Seedance 2.5正式发布:映悦AI迎来“更长、更可控、更极致”的视频生成时代新一代视频生成模型Seedance 2.5。作为映悦AI的核心视频引擎之一,这一升级意味着平台的视频创作能力迈上了新台阶。
dogstarhuang6 天前
网络·gpt·大模型·api网关·ai推理·模型选型·按量计费
实战:用 API 网关统一接入 GPT-5.6,多模型路由怎么省下 80% 成本摘要: OpenAI GPT-5.6 降价最高 80%,多模型路由能让降价红利自动到账。本文用 API 网关统一接入 GPT-5.6,拆解 Luna / Terra / Sol 的选型逻辑、路由配置与成本看板实现,并给出可复现的代码与切换步骤。
狠活科技6 天前
gpt
DeepSeek Harness 安装配置教程:0.3元/刀,接入 GPT-5.6 Sol、DeepSeek V4 Pro 等模型最近 DeepSeek 的 DeepSeek Harness 开始受到不少关注。简单来说,它不只是一个普通的 AI 对话工具,而是一套面向 Agent 和编程任务的 Harness 环境。
王莹月7 天前
gpt·ai·chatgpt·ai作画·aigc·agi
生图API 出问题怎么定位?给调用加 traceId 和结构化日志(nano-banana-pro)有次运营报"生图很慢",我去查日志,看到的是一堆这样的东西:没有 traceId,没有耗时,没有参数。我连"哪一次慢"都定位不了,只能凭感觉去猜。
Tango21007 天前
gpt·chatgpt·claude
刚换到 Codex 不顺手?用 3 层配置解决 4 个常见问题Codex 开箱就能工作,但默认协作方式未必适合每个人。刚上手时,最常见的不适有四个:审批频繁、回复冗长、复杂任务表现偏弱,以及还没确认方案就开始修改。
自律懒人7 天前
gpt
GLM-5.3 vs Fable 5 vs GPT-5.6 Sol:6 项基准横评,743B 国产编程模型的正面硬刚最好的国产编程模型,保质期只剩下 20 天。7 月底大家还在说 Kimi K3 是开源天花板,8 月 13 日 DeepSeek V4 Pro 正式版带着 DeepSWE 62.7 的成绩登场,结果第二天,智谱就把 GLM-5.3 端了上来。官方口径很简单粗暴:编程能力较 GLM-5.2 提升 50%,编程与智能体能力接近 Claude Fable 5,体感超过其他国产模型。
晨航10 天前
人工智能·gpt·aigc
做一张商品场景图,Nano Banana Pro、Nano Banana 2和GPT Image 2谁更能打?大家好,我是吾鳴。专注于分享提升工作与生活效率的 AI 工具,持续关注AI的前沿动向。最近在做意图AI绘图的时候,我想把一件事情给测试清楚。