星光澄海 | BLOG
有点子了,就去执行……
残差建模:缩小机器人回归与生成策略的差距
做机器人学习的人都知道,从演示数据训策略,扩散、流匹配这类生成策略,比用MSE的直接回归策略效果好。之前大家都把这差距归因为演示数据的多模态——同一个状态下,合理动作可能有好几个选择。但这篇ar...
2026-10-08 1 0 人工智能/应用
Natura的99美元智能戒指:按手指召唤AI还测健康
99美元的智能戒指,现在能按一下手指召唤AI代理,还能测健康?Natura刚推的这款Interface smart ring,就把这两样凑成了。Natura的这款智能戒指,能干嘛?这款产品的核心...
2026-10-08 1 0 人工智能/应用
Goodfire推出“向内看”AI监控:抓失控AI成本仅需此前一部分
Goodfire刚公布了一款AI监控工具,主打抓失控AI agents,成本只要之前的一部分——核心逻辑不是让另一个AI当“监工”全程审,而是直接盯着AI模型内部的运作。不用“第二AI复读机”,...
2026-10-08 2 0 人工智能/应用
Oracle靠ChatGPT和Codex 把数天工作压缩至几分钟
Oracle在招聘、工程、运营三大核心业务领域,已经把原本需要数天完成的专业工作,靠两款AI工具压缩到了几分钟。三大板块全落地,覆盖多类专业工作不是某一个团队的试点,是全公司级的应用。招聘里的岗...
2026-10-08 1 0 人工智能/应用
量子代码自动迁移:13个基准的实测与启示
把13个量子编程基准从Qiskit换到CUDA-Q,三个大模型各有优劣:有的能省96%的算力消耗,有的得反复催才不踩坑——这是arXiv上一篇quant-ph分类的案例研究,讲的是量子代码自动迁...
2026-10-07 1 0 人工智能/应用
Agentic BBO新基准出炉:LLM优化能力大比拼
为什么要做这个统一基准?之前研究Agentic BBO的各家,选的任务领域不一样,系统配置也不统一,导致结果没法横向比,连哪个设计选择真正起作用都分不清——说白了就是各说各的好,没个准谱。黑盒优...
2026-10-07 1 0 人工智能/应用
Claude Haiku 5.5:降本七成后,操作暴涨编程仍有差
Anthropic刚推的Claude Haiku 5.5,两个核心数字先记牢:OSWorld 2.1评测成绩从上代的15.7%跳至72.4%,平均运行成本直接砍了75%。但有个容易忽略的点:复杂...
2026-10-07 1 0 人工智能/应用
BATok:适配预算的电磁频谱信号分词新方案
现在做电磁频谱监测的,没人再满足于只做特定信号的识别或检测了——要灵活分析不同场景的信号。但卡在一个核心问题:怎么把原始I/Q信号转成大模型能懂的token,同时不超“预算”。原来的信号分词有两...
2026-10-07 1 0 人工智能/应用
Google新AI笔记工具:会议转录全靠离线跑
Google刚推了个实验性AI笔记工具——Google AI Edge Foresight,能完全离线转录会议和音频文件,目前只在macOS上用,免费。它能解决什么具体问题?和Granola、W...
2026-10-07 1 0 人工智能/应用
谷歌上线一站式Gemini工作代理,打通全场景办公应用
周四谷歌在Gemini at Work活动上,宣布上线一款通用Gemini AI代理。这不是那种只能在单应用里帮你改文档的小工具,是能在后台跨应用、跨设备干活的。一个界面,搞定跨场景任务它会整合...
2026-10-07 1 0 人工智能/应用