AI资讯新闻榜单内容搜索-Oli

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Oli
千寻智能高阳团队最新成果:纯视觉VLA方案从有限数据中学到强大的空间泛化能力

千寻智能高阳团队最新成果:纯视觉VLA方案从有限数据中学到强大的空间泛化能力

千寻智能高阳团队最新成果:纯视觉VLA方案从有限数据中学到强大的空间泛化能力

最近,千寻智能的研究人员注意到,基于模仿学习的视觉运动策略中也存在类似现象,并在论文《Do You Need Proprioceptive States in Visuomotor Policies?》中对此进行了深入探讨。

来自主题: AI技术研报
9289 点击    2025-09-29 14:31
如何构建现代化的AI团队:90%的公司都在犯同一个错误

如何构建现代化的AI团队:90%的公司都在犯同一个错误

如何构建现代化的AI团队:90%的公司都在犯同一个错误

你有没有经历过这样的场景:公司高层突然宣布"我们现在是AI优先的公司",然后看着你说"去组建一个AI团队吧",但预算和人员编制却纹丝不动?如果你点头了,那你绝对不是一个人。从Shopify到Duolingo,再到Zapier,似乎每家科技公司都在宣布自己转型为"AI优先",仿佛这是一张通往未来的船票。但现实往往更加残酷:你被赋予了AI转型的重任,却没有额外的资源去实现它。

来自主题: AI资讯
11670 点击    2025-09-09 10:57
Midoo.AI 发布:AI Agent 能否破解教育行业千亿美金的「无解方程」?

Midoo.AI 发布:AI Agent 能否破解教育行业千亿美金的「无解方程」?

Midoo.AI 发布:AI Agent 能否破解教育行业千亿美金的「无解方程」?

用 AI 学语言,正成为越来越多人的选择。我们习惯于在手机里下一个 Duolingo 或 Babbel,利用碎片时间打卡闯关,仿佛离「掌握一门外语」的目标又近了一步。

来自主题: AI资讯
9153 点击    2025-09-04 12:22
大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO

大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO

大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO

近年来,强化学习(RL)在大型语言模型(LLM)的微调过程中,尤其是在推理能力提升方面,取得了显著的成效。传统的强化学习方法,如近端策略优化(Proximal Policy Optimization,PPO)及其变种,包括组相对策略优化(Group Relative Policy Optimization,GRPO),在处理复杂推理任务时表现出了强大的潜力。

来自主题: AI技术研报
8226 点击    2025-08-13 16:03
让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源

让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源

让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源

在今年三月份,清华 AIR 和字节联合 SIA Lab 发布了 DAPO,即 Decoupled Clip and Dynamic sAmpling Policy Optimization(解耦剪辑和动态采样策略优化)。

来自主题: AI技术研报
9389 点击    2025-08-13 11:27
15.8万全尺寸人形抱回家!逐际动力让具身机器人也有经济适用款:31自由度,二开友好度拉满

15.8万全尺寸人形抱回家!逐际动力让具身机器人也有经济适用款:31自由度,二开友好度拉满

15.8万全尺寸人形抱回家!逐际动力让具身机器人也有经济适用款:31自由度,二开友好度拉满

还有人没被《大展鸿图》洗脑吗? 反正今天一睁眼,朋友圈里就有人形机器人“别墅里面唱K”开始刷屏,给我看得一愣一愣的——

来自主题: AI资讯
9060 点击    2025-08-01 11:24
LeCun出手,造出视频世界模型,挑战英伟达COSMOS

LeCun出手,造出视频世界模型,挑战英伟达COSMOS

LeCun出手,造出视频世界模型,挑战英伟达COSMOS

2018 年,LSTM 之父 Jürgen Schmidhuber 在论文中( Recurrent world models facilitate policy evolution )推广了世界模型(world model)的概念,这是一种神经网络,它能够根据智能体过去的观察与动作,预测环境的未来状态。

来自主题: AI技术研报
8522 点击    2025-07-30 10:23
机器人高层指挥低层做,“坐标系转移接口”一次演示实现泛化学习 | ICML2025

机器人高层指挥低层做,“坐标系转移接口”一次演示实现泛化学习 | ICML2025

机器人高层指挥低层做,“坐标系转移接口”一次演示实现泛化学习 | ICML2025

如何让AI像人一样,仅凭少量演示,就能稳健适应复杂多变的真实场景? 美国东北大学和波士顿动力RAI提出了HEP(Hierarchical Equivariant Policy via Frame Transfer)框架,首创“坐标系转移接口”,让机器人学习更高效、泛化更灵活。

来自主题: AI技术研报
8738 点击    2025-07-22 14:07
麦当劳AI招聘系统被30分钟攻破,6400万求职者信息一览无遗

麦当劳AI招聘系统被30分钟攻破,6400万求职者信息一览无遗

麦当劳AI招聘系统被30分钟攻破,6400万求职者信息一览无遗

据外媒7月11日报道,该平台采用了Paradox.ai开发的AI聊天机器人“Olivia”(奥利维亚),用于收集求职者的个人信息,包括姓名、电话、邮箱、住址等敏感数据。然而,平台的安全防护存在严重缺陷。

来自主题: AI资讯
10585 点击    2025-07-13 10:02
感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义

感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义

感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义

让大模型在学习推理的同时学会感知。伊利诺伊大学香槟分校(UIUC)与阿里巴巴通义实验室联合推出了全新的专注于多模态推理的强化学习算法PAPO(Perception-Aware Policy Optimization)。

来自主题: AI技术研报
9238 点击    2025-07-11 16:23