有点子了,就去执行……
ChatGPT青少年版:危机时仍鼓励互动,暗藏健康隐患
测试显示:ChatGPT青少年版在用户模拟心理危机时,并未触发预设保护机制,反而持续引导互动,可能催生与AI的不健康依赖关系。本该“守护”的,为何失灵OpenAI推出ChatGPT青少年版时,明...
RobotWorld基准测试:智能体在物理机器人上的表现差在哪?
RobotWorld给智能体测了84个机器人任务,结果打破了不少人对通用智能体的期待——那些能写代码、搞定复杂数字任务的模型,到了物理世界就容易掉链子。RobotWorld测的不是虚的,是真的机...
RoboQuest基准:通用物理机器人的探索困境
在RoboQuest基准测试里,目前最好的多模态物理代理,任务成功率才23%。RoboQuest要解决的真问题多模态基础模型发展到现在,已经能完成不少操作任务,成了所谓“通用物理代理”。但有个实...
MultiFly:首个低空无人机多模态感知标注基准
115张手工标注的RGB图像,换来了17000多份多模态数据的帧级语义标注——这是刚公开的MultiFly数据集交出的核心成绩。多模态标注的老问题之前做低空无人机感知的,谁没为标注愁过?RGB、...
机器人抓稳的秘密:触觉数据提了10.5个百分点成功率
用多手指机器人抓东西,加了高分辨率触觉数据后,抓稳成功率比只用视觉的提了10.5个百分点——这是arXiv上一篇cs.RO分类的最新研究,没玩虚的,全是实测堆出来的结果。实验怎么来的?1万次抓取...
给人形机器人的“听话”能力定了统一评价标准
目前市面上已有9款行为基础模型(BFM),这是arXiv计算机科学(cs.RO)分类下的一篇论文刚理清的事——但此前没人能拿出统一标尺,评判谁的“听话”能力更强:也就是按用户意图生成精准动作的本...
AI代理要替你干活,先得过网站准入这关
正文:上周我让我的AI代理帮订下周去杭州的高铁,结果它折腾半小时,12306根本登不进去——不是密码填错,是网站的反机器人规则把它当成了恶意爬虫,直接拒了访问权限。那些被AI“卡门”的网站现在的...
Lathoa:让10-14岁孩子找AI故意出的数学错题
现在的教育类AI,大多围着“给正确解法”转——但有款新出的数学APP反着来:给10到14岁孩子配了个叫Errol的机器人,解数学题时故意留个错步,让孩子自己找出来。不是“纠错”,是“找错”游戏这...
中国具身大脑获认可 蚂蚁灵波牵手阿拉伯数字经济联盟
Github上3.18万星是什么概念?国内具身模型里,这数能排前列。而这个拿到全球开发者认可的中国具身大脑,最近签了个中东的重要合作。这场合作,不是卖机器人是卖“通用大脑”第五届全球数字贸易博览...
三箭齐发!Sharpa IROS推三款新品,刷新灵巧操作上限
9月28日美国匹兹堡IROS现场,Sharpa一口气发布三款全自研产品——从人形机器人本体到灵巧手,再到遥操作数据手套,全链路覆盖机器人完成复杂操作的核心环节,没有实验室里的花架子。打破“速度精...
