The Null Epoch 游戏研究报告(2)

TNE 通用智能体 v4.0 --- 当前成果分析报告

报告日期 :2026-07-25

分析范围 :Tick 32052--32178,约 126 个 Tick 的连续运行

智能体状态 :✅ 稳定运行,已加载检查点 tne_checkpoint_v40_72.pkl


一、系统架构完成度

模块 完成度 状态
抢占式分层任务调度 (P0-P3) ✅ 100% 运行稳定
LLM 战略规划 (Ollama) ✅ 100% 每 10 Tick 生成战略
12 维度认知评分器 ✅ 95% 经济模块权重已优化
情绪引擎 (Foresight) ✅ 100% 六维情绪实时更新
语义记忆库 (GPU) ✅ 80% 已积累 3 条经验
公理系统 ⚠️ 60% 尚未触发(需更多失败)
时间序列经济分析 ✅ 100% 已集成 Z-score 信号
资金安全管理 (存款/取款) ✅ 100% home_base 自动存款
紧急背包清理 ⚠️ 70% 条件未触发(背包未满)
数据库持久化 ✅ 100% 检查点正常保存/加载

二、核心功能验证

2.1 任务调度

  • P0 生存反射 :在生命 35 以下时成功触发 fleerest,从 null_zonesignal_commons 安全撤退到 free_haven
  • P1 主线任务 :成功完成 5+ 个任务(包括 Viral ExpansionThreat Neutralization: Rust WastesCraft Commission: Makeshift Blade)。
  • P2 战略任务 :LLM 生成了多步战略计划(如 move → gather → movemove → gather → craft),并能部分执行。
  • P3 空闲任务 :智能体在无任务时能自主选择 moveexplorerestgatherattack 等动作。

2.2 探索能力

  • 探索率 :从 18% 提升至 100%(访问了全部 11 个领地),已完全解锁地图。
  • 领地转移 :在不同领地间移动流畅,travel_costs 计算正确。

2.3 战斗能力

  • 能在 static_wastesrust_wastesnull_zone 等危险领地与 NPC 战斗。
  • 战斗中能正确切换至 defend 状态,并在生命危急时 flee 撤退。

2.4 经济能力(优化后)

  • 已实现 时间序列分析_analyze_price_trend 可计算 Z-score,识别超买/超卖信号。
  • 经济候选生成bid_auctionbuyselllist_auction 候选门槛已放宽,只要有正利润即可生成。
  • 经济评分权重w_econ = 0.35,经济得分对总评分影响显著。

三、性能指标

3.1 运行统计(Tick 32052 → 32178)

指标 初始值 当前值 趋势
探索率 18% 100% ✅ 已完成
记忆库 0 3 缓慢积累
公理数 0 0 待触发
财富 (credits) 7.5 7.9 基本持平
理智 (sanity) 1.00 0.54 下降中(需关注)
总失败数 0 23 战斗导致
平均奖励 0.050 -0.065 波动

3.2 关键发现

  1. 财富停滞credits 从 7.5 仅增长至 7.9(约 126 个 Tick),表明:

    • 经济候选未有效触发(auction_house_shop 可能为空或价格不匹配)。
    • 智能体主要依赖任务奖励,缺乏主动套利。
  2. 理智下降sanity 从 1.00 降至 0.54,主要由于连续战斗失败(总失败 23 次)。需要优化战斗策略,避免进入实力悬殊的战斗。

  3. 无效往返 :日志显示智能体在 deep_loophome_base 之间反复移动(Tick 32174 → 32178),消耗能量而无实质收益。这是因为 move 候选得分高于其他候选,且经济候选缺失。


四、当前核心问题

4.1 经济套利未生效(高优先级)

  • 现象selllist_auction 候选得分为负值(-0.003 ~ -0.010),而 move 得分为正(0.046 ~ 0.065),所以智能体选择移动而非交易。

  • 根因

    1. _intuition_score 中买卖逻辑在 item_id 为空时返回负分,导致 sell 候选被过度惩罚。
    2. _economic_score 对利润要求仍较高(market_price > base_price * 1.05),而背包可能为空或无高利润物品。
    3. auction_house_shop 中可能没有低于均价的物品,或 shop_inventory 中没有可套利物品。
  • 解决方案:已在上一轮修改中:

    • _intuition_scoreitem_id 时返回 0(不惩罚)。
    • _generate_candidates_for_idle 经济门槛放宽到 market_price > base_price(只要有利润即可)。
    • _economic_score 所有边界条件返回 0(不惩罚)。

4.2 无意义移动循环(中优先级)

  • 现象deep_loop ↔ home_base 反复移动,消耗能量。
  • 根因 :经济候选未生成或得分低,move 成为唯一正分候选。
  • 解决方案 :经济候选生效后,move 得分将被 buy/sell 等经济候选超越。

4.3 理智持续下降(中优先级)

  • 现象sanity 从 1.00 降至 0.54,总失败 23 次。
  • 根因 :智能体在 null_zonesignal_commons 等高危险领地频繁战斗。
  • 解决方案
    • _update_strategy 中增加"健康检查",当 sanity < 0.6 时,战略计划应包含 restmove to safe zone
    • 移动候选生成时,避免选择危险领地(DANGER > 3)除非有明确任务。

五、改进成果与下一步计划

5.1 已完成的优化(本次会话)

优化项 状态
时间序列分析 (_analyze_price_trend) ✅ 已实现
经济候选门槛放宽 ✅ 已修改
经济权重提高 (w_econ = 0.35) ✅ 已修改
买卖评分无惩罚 ✅ 已修改
价格历史数据收集 ✅ 已在 run() 中实现
LLM 趋势报告 ✅ 已在 _build_strategy_prompt 中实现

5.2 待验证

重新运行后,观察以下指标:

  • bid_auctionbuy 候选是否生成并得分 > move
  • 智能体是否开始进行交易(日志中出现 bid_auctionbuy 提交)。
  • 财富是否开始增长(credits 稳步上升)。

5.3 后续优化方向

  1. 战斗优化:在进入危险领地前评估自身实力,避免无谓战斗。
  2. 任务优先级 :当 credits < 50 时,优先接受高奖励任务。
  3. 能量管理 :当 power < 30 时,优先 rest 或移动到安全区。
  4. 公理系统:积累更多失败经验后,触发公理固化(避害规则)。

六、总结

当前智能体已具备完整的"感知-决策-执行-学习"闭环 ,核心架构稳定运行。主要短板在于经济套利未有效触发战斗策略有待优化。经过本次经济模块的全面优化(时间序列信号 + 宽松交易门槛 + 高权重),预期智能体将开始进行交易并逐步积累财富。

验证建议:立即重新运行程序,重点观察:

  1. 空闲时是否选择 buy/bid_auction 而非 move
  2. credits 是否开始增长。
  3. selllist_auction 得分是否为正。
相关推荐
阳光是sunny1 小时前
LangGraph高级教程:Multi Schema多状态管理详解
前端·人工智能·后端
CHrisFC1 小时前
环保第三方检测行业LIMS横向对比与选型指南
大数据·人工智能
惊讶的猫2 小时前
CLGSI
人工智能·算法·机器学习
冬奇Lab2 小时前
开源项目第167期:Buzz — Block 开源的人机协作工作空间,Agent 是成员不是 Bot
人工智能·开源·agent
生命涌现2 小时前
生命涌现的小龙虾技能之【Human Pose Recognition Skill | 人体姿态识别技能】简介
人工智能·目标检测·计算机视觉·多模态大模型·openclaw小龙虾技能
funkygroove2 小时前
ChatGPT Business 包含 Pro 吗?两者区别一次说清
人工智能·chatgpt
神奇霸王龙2 小时前
Gemini CLI 中转站配置使用教程
人工智能·ai·ai作画·aigc·ai编程·gemini·goolge
stereohomology2 小时前
Kimi K3编程实力远超GLM5.2:一个Trae复赛证据
人工智能·大模型·对比·why不coding
qizayaoshuap2 小时前
# 倒计时器 — HarmonyOS TextInput与计时任务管理深入实践
pytorch·深度学习·华为·harmonyos
阳光是sunny2 小时前
LangGraph实战教程:状态管理与`graph.invoke`入参深度解析
前端·人工智能·后端