Pendulum

喜欢将平衡比作钟摆的这个形容

links

https://www.loot-drop.io/

https://github.com/ssoccean/PPT_Pilot

reinforcemennt learning需要考虑的核心问题之一

掌握好explore和exploit的接受平衡非常重要

idea-实践 循环

核心就两件事

用工程进度文件而不是上下文压缩长时工作更好

规划、执行、评估分开更好能解决模型自信问题

lc1220

class Solution {

public:

vector<long long> state;

// a e i o u

// 0 1 2 3 4

// 01 10 12 20 21 23 24 32 34 40

long long mod = 1e9 + 7;

vector<long long> run(vector<long long>& s) {

vector<long long> s_(5);

s_0 = (s1 + s2 + s4) % mod;

s_1 = (s0 + s2) % mod;

s_2 = (s1 + s3) % mod;

s_3 = s2 % mod;

s_4 = (s2 + s3) % mod;

return s_;

}

int countVowelPermutation(int n) {

state = vector<long long>(5, 1);

for (int i = 1; i < n; i++) {

++state = run(state);++

}

long long sum = 0;

for (int i = 0; i < 5; i++) {

++sum += statei;++

sum %= mod;

}

return sum;

}

};

lc1269

归来任是第一反应写最朴素的dp 释怀的笑了

const int MO = 1e9 + 7;

class Solution {

public:

int numWays(int steps, int arrLen) {

vector<vector<long long>> f(steps + 1, vector<long long>(steps + 1));

long long maxLen = min(steps - 1, arrLen - 1);

f00 = 1;

for (int i = 1; i <= steps; ++i) {

for (int j = 0; j <= maxLen; ++j) {

fij = fi - 1j;

if (j - 1 >= 0)

fij = (fij + fi - 1j - 1) % MO;

if (j + 1 <= maxLen)

fij = (fij + fi - 1j + 1) % MO;

}

}

return fsteps0 % MO;

}

};

相关推荐
TAN-90°-6 小时前
Deep Learning for Computer Vision——Attention and Transformers
人工智能·深度学习·神经网络·机器学习·计算机视觉·cnn·机器翻译
Profile排查笔记6 小时前
指纹浏览器手机版怎么选?从本地 App 到云端 Android 的实现方式解析
前端·人工智能·后端·自动化
shiter6 小时前
舍筏 · 观异 · 破执:中国人的创新审视三问
人工智能·程序人生
Henry-SAP6 小时前
SAP MRP类型与计划策略配置精髓解析
人工智能·云原生·sap·erp
筑梦geo6 小时前
天津口碑好的天津GEO获客公司哪家好 - 成本透明度
人工智能·天津口碑好的
DeepIntelli6 小时前
GEO 团队选型
人工智能·chatgpt
Nontee6 小时前
腾讯 Hy4 开源:770B 旗舰,和一句“它参与了自己的训练“
人工智能·开源
一切皆是因缘际会6 小时前
智能革新
人工智能·科技
Csvn6 小时前
评测集不是“一堆问题”,是“测试资产”——30 条结构化评测集(E02)
人工智能·agent
OpenBayes6 小时前
Qwen3.8-27B-FP8 降低大模型部署门槛,开启高效多模态智能体验;MiniMax H3-1K 发布千段视频测试数据集,全面评估 AI 视频生成能力
人工智能·深度学习·计算机视觉·自然语言处理·语音识别·多模态大模型