OpenAI又放大招!大幅暴降,修复GPT-4变懒!

OpenAI大更新

  • 两种新的嵌入模型
  • 更新的 GPT-4 Turbo 预览模型
  • 更新的 GPT-3.5 Turbo 型号
  • 更新的文本审核模型

新的文本嵌入模型

OpenAI 推出了两种新的文本嵌入模型:"text-embedding-3-small" 和 "text-embedding-3-large"。这些模型与以前的模型相比,提供了更强的性能和显著降低的价格。

例如,"text-embedding-3-small" 模型的成本比之前的 "text-embedding-ada-002" 模型降低了 5 倍,达到每千个标记 0.00002 美元,同时在关键基准测试中的准确性提高了超过 10 个百分点。

而 "text-embedding-3-large" 模型在基准分数上比其前身高出 20 个百分点以上,是 OpenAI 至今最强大的嵌入模型,每千个标记的价格合理地定为 0.00013 美元。

Eval benchmark ada v2 text-embedding-3-small text-embedding-3-large
MIRACL average 31.4 44.0 54.9
MTEB average 61.0 62.3 64.6

GPT-4 模型更新

OpenAI 还发布了一个新的 GPT-4 Turbo 预览模型 "gpt-4-0125-preview",该模型比之前的预览模型执行任务更为彻底,旨在减少模型未能完成任务的情况。公司还计划在未来几个月内推出具有视觉功能的 GPT-4 Turbo。

GPT-3.5 Turbo 更新和降价

GPT-3.5 Turbo 的更新版本 "gpt-3.5-turbo-0125" 将在下周推出 ,并且将显著降低价格,这是过去 24 个月内的第三次降价。输入成本将降低 50% 至每千个标记 0.0005 美元,输出价格将下降 25% 至每千个标记 0.0015 美元。新模型还将具有各种改进,包括在请求格式中响应的更高准确性,以及修复了一个影响非英语语言功能调用的文本编码问题。

API 密钥管理和内容安全

此外,OpenAI 还宣布了其他一些重要更新,涵盖内容安全和 API 管理等关键领域:

  • 一种新的文本审核模型 "text-moderation-007" 可通过 OpenAI 的审核 API 免费使用,是该公司迄今为止最强大的审核模型。
  • 开发者现在可以创建具有不同权限和范围的多个 API 密钥,并在 OpenAI 仪表板上监控其使用情况和计费细节。

问问AI同步更新

问问API中转

现在可以直接在平台上使用"gpt-4-0125-preview","gpt-4-turbo-preview","text-embedding-3-small","text-embedding-3-large"这四款模型了。

1、获取中转key

打开问问API中转地址:web.wenwen-ai.com/ ,生成key。

2、进行API调用

示例页面:

点击「聊天」--->「ChatGPT Next」

设置中转url和key

添加模型"gpt-4-turbo-preview"

进行提问测试

示例python代码:

ini 复制代码
import os
from openai import OpenAI

os.environ['OPENAI_BASE_URL'] = 'https://key.wenwen-ai.com/v1'
os.environ['OPENAI_API_KEY'] = 'sk-6V2exWFBSa2lmuZ7C0D773D1BaEd4fB7A1B6A0A265D550C6'


client = OpenAI()

completion = client.chat.completions.create(
    model="gpt-4-turbo-preview",
    messages=[
        {"role": "system", "content": "You are a helpful assistant."},
        {"role": "user", "content": "Hello! "}
    ],
    n=1,
    max_tokens=2048,
    temperature=0.8,
)

问问Agent

性能更强,价格更便宜的Embedding Model:"text-embedding-3-small","text-embedding-3-large"也上线问问Agent了。

app.wenwen-ai.com/

后续便宜的gpt-3.5上线后也会同步更新!~

相关推荐
天衍四九-30 分钟前
Agent Skills从入门到工程化(十六):面试中如何讲清楚 Agent Skills?
大数据·数据库·人工智能·python·chatgpt·面试
Capricorn198831 分钟前
跨端同步与记忆锁定排障:OpenClaw 2.0 Active Memory 云端劫持危机,知芽 Notebook Skill 单元记忆架构解析
大数据·论文阅读·人工智能·笔记·架构·论文笔记
GMATG_LIU32 分钟前
DSC-TGA同步热分析技术:原理、应用与发展
人工智能
秋天的一阵风38 分钟前
🤔首屏Banner压到40KB,LCP还是4秒?原来一直搞错了最大渲染元素
前端·人工智能·面试
ONEYAC唯样39 分钟前
ROHM新品 | 以1005尺寸实现0.33W!ROHM开发出高抗浪涌贴片电阻器
人工智能
吴佳浩 Alben39 分钟前
多智能体系统的通信风暴与死锁治理:生产级降级与容灾方案
人工智能·docker·ai·容器·架构
Csvn43 分钟前
第 18 章 学习与适应 Learning
人工智能·aigc·agent
等一朵映山红44 分钟前
对抗性攻击与鲁棒性:破解机器学习模型的“视觉盲区”
人工智能·机器学习
液态不合群1 小时前
低代码破局传统数字化困境:工程与供应链实战落地复盘
人工智能·低代码·数字化
ONEYAC唯样1 小时前
AI服务器越来越“吃电”,谁在为AI算力供电?
人工智能