- PPO 解决了强化学习中的一个关键挑战:如何在不破坏训练稳定性的情况下进行有意义的更新。GRPO 是 DeepSeek 开发,用于 DeepSeek-Math 和 DeepSeek-R1 模型的训练,兼具 PPO 的可靠性与更高的效率。 PPO 解决了强化学习中的一个关键挑战:如何在不破坏训练稳定性的情况下进行有意义的更新。GRPO 是 DeepSeek 开发,用于 DeepSeek-Math 和 DeepSeek-R1 模型的训练,兼具 PPO 的可靠性与更高的效率。
- 人体姿态检测数据集分享(适用于YOLO系列深度学习检测任务) 数据集获取链接:https://pan.baidu.com/s/1O65lltYyS4BhFg9a5JTtFQ?pwd=vmfj 提取码:vmfj 复制这段内容后打开百度网盘手机App,操作更方便哦本数据集覆盖五种常见人体姿态:站着、摔倒、坐、深蹲、跑,可以为目标检测任务提供可靠的训练基础。 一、前言随着人工智能和计算机视觉技术... 人体姿态检测数据集分享(适用于YOLO系列深度学习检测任务) 数据集获取链接:https://pan.baidu.com/s/1O65lltYyS4BhFg9a5JTtFQ?pwd=vmfj 提取码:vmfj 复制这段内容后打开百度网盘手机App,操作更方便哦本数据集覆盖五种常见人体姿态:站着、摔倒、坐、深蹲、跑,可以为目标检测任务提供可靠的训练基础。 一、前言随着人工智能和计算机视觉技术...
- 本文针对传统Prompt工程存在的零散不可复用、版本管理混乱、无法自动化集成等核心痛点,系统阐述了将存量Prompt工程成果转化为OpenClaw Skill的完整方法论。文章详细拆解了资产盘点分类、标准化改造、封装配置、测试验证到发布维护的全流程步骤,介绍了多轮对话、工具调用等高级特性的应用方法,同时探讨了标准化工作流建立、版本管理体系及团队知识共享机制的构建。 本文针对传统Prompt工程存在的零散不可复用、版本管理混乱、无法自动化集成等核心痛点,系统阐述了将存量Prompt工程成果转化为OpenClaw Skill的完整方法论。文章详细拆解了资产盘点分类、标准化改造、封装配置、测试验证到发布维护的全流程步骤,介绍了多轮对话、工具调用等高级特性的应用方法,同时探讨了标准化工作流建立、版本管理体系及团队知识共享机制的构建。
- 人群计数行人检测数据集分享(适用于YOLO系列深度学习检测任务) 数据集获取链接:https://pan.baidu.com/s/1yfbf0t7odPujSi04H5YIYA?pwd=eqks 提取码:eqks 复制这段内容后打开百度网盘手机App,操作更方便哦随着智慧城市与视频监控系统的广泛应用,人群检测与计数成为计算机视觉领域的重要研究方向之一。为帮助开发者快速上手人群检测模型的训练... 人群计数行人检测数据集分享(适用于YOLO系列深度学习检测任务) 数据集获取链接:https://pan.baidu.com/s/1yfbf0t7odPujSi04H5YIYA?pwd=eqks 提取码:eqks 复制这段内容后打开百度网盘手机App,操作更方便哦随着智慧城市与视频监控系统的广泛应用,人群检测与计数成为计算机视觉领域的重要研究方向之一。为帮助开发者快速上手人群检测模型的训练...
- MindSpore 时序预测与 LSTM 实战 一、引言时序预测是机器学习和深度学习领域中最具挑战性也最具应用价值的任务之一。从股票价格预测、天气预测、能源消耗预测到疾病传播建模,时序数据无处不在,对时序预测模型的需求也日益增长。长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要变体,专门设计用于解决长期依赖问题,在时序预测任务中展现出卓越的性能。MindSpore是华为自主研发的... MindSpore 时序预测与 LSTM 实战 一、引言时序预测是机器学习和深度学习领域中最具挑战性也最具应用价值的任务之一。从股票价格预测、天气预测、能源消耗预测到疾病传播建模,时序数据无处不在,对时序预测模型的需求也日益增长。长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要变体,专门设计用于解决长期依赖问题,在时序预测任务中展现出卓越的性能。MindSpore是华为自主研发的...
- PPO增加了一个软约束(裁剪机制),可能会做出一些错误的决策,但它在优化速度上取得了良好的平衡。实验结果证明,这种平衡能够以最简单的方式实现最佳性能。 PPO增加了一个软约束(裁剪机制),可能会做出一些错误的决策,但它在优化速度上取得了良好的平衡。实验结果证明,这种平衡能够以最简单的方式实现最佳性能。
- 人脸表情七种表情数据集分享(适用于YOLO系列深度学习分类检测任务) 数据集分享网盘:https://pan.baidu.com/s/1M6L1aCvUy5VRVdHd1OnQ0w?pwd=m396该数据集已按照训练集(train)和测试集(test)划分,共计15,500张人脸图像,覆盖七种典型表情类别,并附带相应的标注文件,可直接用于模型训练与评估。 一、背景随着人工智能和计算机视觉的... 人脸表情七种表情数据集分享(适用于YOLO系列深度学习分类检测任务) 数据集分享网盘:https://pan.baidu.com/s/1M6L1aCvUy5VRVdHd1OnQ0w?pwd=m396该数据集已按照训练集(train)和测试集(test)划分,共计15,500张人脸图像,覆盖七种典型表情类别,并附带相应的标注文件,可直接用于模型训练与评估。 一、背景随着人工智能和计算机视觉的...
- Merged Sentinel-3A and Sentinel-3B OLCI Regional Binned Inland Waters (ILW) Data, version 5.0简介ILW 套件提供美国本土(CONUS)和阿拉斯加内陆湖泊和水库的内陆水体数据提取。ILW 提供瑞利校正后的地表反射率(ρs,无单位)和蓝藻指数(CI_cyano,无单位)。MERIS 和 OLCI 的数... Merged Sentinel-3A and Sentinel-3B OLCI Regional Binned Inland Waters (ILW) Data, version 5.0简介ILW 套件提供美国本土(CONUS)和阿拉斯加内陆湖泊和水库的内陆水体数据提取。ILW 提供瑞利校正后的地表反射率(ρs,无单位)和蓝藻指数(CI_cyano,无单位)。MERIS 和 OLCI 的数...
- 南瓜叶片病害图像分类数据集分享(适用于YOLO系列深度学习分类检测任务) 源码下载链接:https://pan.baidu.com/s/1Bfs0wgwggHTQhdsNmLbIZw?pwd=8jva提取码:8jva 复制这段内容后打开百度网盘手机App,操作更方便哦 前言南瓜是重要的经济作物之一,在世界范围内广泛种植。然而,在南瓜种植过程中,各类病害经常会对产量和品质造成严重影响。及时发... 南瓜叶片病害图像分类数据集分享(适用于YOLO系列深度学习分类检测任务) 源码下载链接:https://pan.baidu.com/s/1Bfs0wgwggHTQhdsNmLbIZw?pwd=8jva提取码:8jva 复制这段内容后打开百度网盘手机App,操作更方便哦 前言南瓜是重要的经济作物之一,在世界范围内广泛种植。然而,在南瓜种植过程中,各类病害经常会对产量和品质造成严重影响。及时发...
- 在REINFORCE算法中,使用基于神经网络建模的价值函数作为基线,这个算法叫做Actor-Critic。这个算法可以通过价值函数控制基线,给予动作正向或者负向的梯度调整。 在REINFORCE算法中,使用基于神经网络建模的价值函数作为基线,这个算法叫做Actor-Critic。这个算法可以通过价值函数控制基线,给予动作正向或者负向的梯度调整。
- 身边越来越多测试工程师开始焦虑。不是业务能力不行,而是每次技术评审会,产品经理随口抛出一句“这个需求我们接入大模型解决”,全场没人敢追问技术细节。面试的时候更直接。以前问“怎么设计测试用例”,现在问“你之前测过模型吗?怎么评估模型效果?”很多人开始感觉到:AI不再是一个可选项,而是一道必答题。但问题来了。零基础学AI,该从哪儿下手?看了一堆公式推导,买了一堆书,发现连“损失函数”是干什么的都... 身边越来越多测试工程师开始焦虑。不是业务能力不行,而是每次技术评审会,产品经理随口抛出一句“这个需求我们接入大模型解决”,全场没人敢追问技术细节。面试的时候更直接。以前问“怎么设计测试用例”,现在问“你之前测过模型吗?怎么评估模型效果?”很多人开始感觉到:AI不再是一个可选项,而是一道必答题。但问题来了。零基础学AI,该从哪儿下手?看了一堆公式推导,买了一堆书,发现连“损失函数”是干什么的都...
- Sentinel-3B OLCI Earth-observation Reduced Resolution (ERR) Data, version 1简介海洋和陆地颜色成像仪 (OLCI) 是 ENVISAT 中分辨率成像光谱仪 (MERIS) 的升级版,拥有更多光谱通道、不同的相机排列方式以及更简化的机载处理流程。OLCI 采用推扫式结构,五个相机模块共享同一视场。这五个相机的视场在垂... Sentinel-3B OLCI Earth-observation Reduced Resolution (ERR) Data, version 1简介海洋和陆地颜色成像仪 (OLCI) 是 ENVISAT 中分辨率成像光谱仪 (MERIS) 的升级版,拥有更多光谱通道、不同的相机排列方式以及更简化的机载处理流程。OLCI 采用推扫式结构,五个相机模块共享同一视场。这五个相机的视场在垂...
- 上个月公司校招,我坐在面试间里,对面是一个985硕士。简历漂亮:GPA前10%,两段大厂实习,技能栏写满了Spring Cloud、Kafka、Redis。我问了第一个问题:“你简历上写做过秒杀系统,那我想知道,这个系统上线以后,你遇到过什么真实的问题?怎么解决的?”他沉默了几秒,说:“呃,其实那个项目是跟网课做的,没有真的上线。”我点点头,又问:“那你实习的时候,写过最复杂的一个功能是什么... 上个月公司校招,我坐在面试间里,对面是一个985硕士。简历漂亮:GPA前10%,两段大厂实习,技能栏写满了Spring Cloud、Kafka、Redis。我问了第一个问题:“你简历上写做过秒杀系统,那我想知道,这个系统上线以后,你遇到过什么真实的问题?怎么解决的?”他沉默了几秒,说:“呃,其实那个项目是跟网课做的,没有真的上线。”我点点头,又问:“那你实习的时候,写过最复杂的一个功能是什么...
- 身边越来越多测试工程师开始焦虑。不是业务能力不行,而是每次技术评审会,产品经理随口抛出一句“这个需求我们接入大模型解决”,全场没人敢追问技术细节。面试的时候更直接。以前问“怎么设计测试用例”,现在问“你之前测过模型吗?怎么评估模型效果?”很多人开始感觉到:AI不再是一个可选项,而是一道必答题。但问题来了。零基础学AI,该从哪儿下手?看了一堆公式推导,买了一堆书,发现连“损失函数”是干什么的都... 身边越来越多测试工程师开始焦虑。不是业务能力不行,而是每次技术评审会,产品经理随口抛出一句“这个需求我们接入大模型解决”,全场没人敢追问技术细节。面试的时候更直接。以前问“怎么设计测试用例”,现在问“你之前测过模型吗?怎么评估模型效果?”很多人开始感觉到:AI不再是一个可选项,而是一道必答题。但问题来了。零基础学AI,该从哪儿下手?看了一堆公式推导,买了一堆书,发现连“损失函数”是干什么的都...
- 在策略函数参数更新的时候,好的动作的正梯度比较大,坏的动作正梯度比较小,基于动作概率的总和是1,所以好的动作对策略函数参数的影响超过了坏的动作。 在策略函数参数更新的时候,好的动作的正梯度比较大,坏的动作正梯度比较小,基于动作概率的总和是1,所以好的动作对策略函数参数的影响超过了坏的动作。
上滑加载中
推荐直播
-
华为云码道Skill实战与极速交付,智能开发全链路实战2026/07/22 周三 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;姜浩-华为云HCDG核心组成员
直播深度解读华为云码道6月产品新特性,从Skill市场安装专家技能,带你零距离体验从需求,开发,审查,重构全链路闭环的开发过程。从零构建并交付一个完整项目,让您体验从代码提交到服务上线的“极速”之旅。
即将直播 -
聚开发者之力,创具身新未来2026/07/23 周四 15:00-17:00
张豪杰/程文/王军/刘新春/黄钦开 /张晓天
本次华为云具身智能开发平台CloudRobo培训面向具身智能开发者,带您全流程体验机器人本体R2C小时级接入、环境重建与轨迹生成仿真数据生产、PB级数据管理、数据评测、模型训推、强化学习和Benchmark一键评测等功能,并体验业界主流具身模型应用。
即将直播
热门标签