GPT-6.1 Sol 实战:做一个可交互的 3D 汽车展厅
我用 GPT-6.1 Sol 做了一个汽车展示网站。这次不只看截图,而是看看它能不能把模型、材质、镜头和交互组织成一个可操作的成品。想尝试 AI 编程,也可以了解一下灵链云API(llapi.org)。

1. GPT-6.1 Sol 是什么?
官方定位是面向复杂编程、计算机操作和专业工作的模型,强调以较低成本提供接近 Astra 的表现。这是官方描述,不是本文的对比测试结论。
几个参数就够了:模型 ID 为 gpt-6.1-sol,上下文窗口为 1,050,000 tokens,最大输出为 128,000 tokens;支持文本、图片输入,输出文本。资料核对日期:2026 年 10 月 1 日,来源见文末。
准备通过 API 调用模型的,可以先在灵链云API(llapi.org)查看接入文档;具体可用模型以平台页面为准。
2. 先看四组效果
**自由视角:**拖动旋转、滚轮缩放,也能切换前侧、侧面和尾部镜头。车身反射随视角变化,不是固定背景图。

**三种车漆:**红色金属漆、珠光白、石墨色,切换模型自带的材质变体,不只是换一个底色。

**车门和座舱:**车门能开合,镜头可以进入车内观察方向盘和仪表,外观与内饰来自同一个模型。

**结构展开:**滑块控制部件分离和合拢。展开先关门,开门先收拢,避免状态冲突。

另外还有车灯、亮场、细节热点、净览和约 42 个有效播放秒的自动演示。
3. 我更关注的是整合能力
项目采用 Three.js、原生 HTML/CSS/JavaScript 和本地 Node.js 服务,交互、渲染与动画时间线分开组织。
值得看的不只是"车很漂亮",而是按钮、模型状态和镜头能够配合起来。结构展开与开门之间的联动,比单独做几个动画更接近完整产品。
本次重新运行的 19 项单元测试全部通过。GIF 由实际操作页面的连续截图采样制作,保留操作顺序和采样时间,不是静态图伪造动画,也不用于衡量帧率。
无论通过灵链云API(llapi.org)还是其他渠道使用模型,生成代码后都建议实际运行、检查交互。
4. 边界与运行方式
汽车使用现成的 CarConcept 模型,不是 GPT 从零生成的三维资产。这里展示的是网站开发、场景搭建和交互整合能力。
结构展开不是工程仿真,玻璃和反射不是光线追踪。单个项目不能代表模型排名,测试通过也不保证所有设备流畅运行。没有完整生成记录,就不写"一句话生成"、开发耗时或费用。
安装兼容的 Node.js 后运行(首次使用先执行 npm install):
powershell
npm start
打开 http://127.0.0.1:4180/,点击"播放演示",或手动操作。`R` 复位,F 进入净览。
我的结论:这个案例展示了 GPT-6.1 Sol 把多个功能串成成品的能力。漂亮画面之外,真实交互、验证和资源说明同样重要。想继续做类似项目,可以从灵链云API(llapi.org)了解 API 接入。
参考与资源归属
- OpenAI:GPT-6.1 Sol 模型文档。
- CarConcept 模型来源:Eric Chadwick / Darmstadt Graphics Group GmbH,© 2024,CC BY 4.0。截图与 GIF 是本项目运行画面的采样、压缩;模型内标志不代表机构背书。