星光澄海 | BLOG
有点子了,就去执行……
给多智能体加个“读心术”:新框架补了协作短板
你可能没注意——现在靠大模型驱动的智能体组队干活,大多是“盲打”状态。普通多智能体的协作硬伤之前的多智能体系统,靠提示词设计、短期记忆或者端到端行为优化推进任务。但核心问题很致命:不会显式建模队...
2026-10-08 1 0 人工智能/应用
「Bi-FORK:让AI突破高维分叉系统生成建模限制」
当深度学习模型处理的物理系统被离散成26万个点时,之前能应对分叉的模型基本要瘫掉——直到arXiv上的一篇论文带来了Bi-FORK。分叉系统,AI没摸透的物理难题。分叉在物理里太常见了:结构受压...
2026-10-08 1 0 人工智能/应用
今日美国起诉OpenAI侵权 索赔超2.5亿美元
本周四,《今日美国》及其旗下多家地方报向法院提交诉状,状告OpenAI未经授权使用其“数十万篇”文章训练AI模型,索赔金额超过2.5亿美元。诉状里称,OpenAI的侵权行为已对这些报纸造成“真实...
2026-10-08 2 0 人工智能/应用
扩散模型的控制级不确定性:SCOPE解决采样成本痛点
机器人做实时路径规划时,用扩散模型生成轨迹,之前算不确定性要靠蒙特卡洛采样,这一步慢到跟不上毫秒级的控制需求。原来的问题:扩散模型的不确定性太“贵”扩散模型能表示复杂多变的多模态轨迹分布,但要从...
2026-10-08 1 0 人工智能/应用
SpaceXAI给有争议的Omarchy Linux发版投150万美元算力
150万美元的Grok代币,是SpaceXAI砸给争议Linux发行版Omarchy的第一笔公开大额赞助。官宣的核心信息今天的消息说穿了是两个实打实的动作。第一,SpaceXAI正式加入Omac...
2026-10-08 2 0 人工智能/应用
【10月】github火热项目一览
根据近一个月(2026年9月至10月初)的GitHub趋势数据,AI智能体(Agent)工具链是绝对的主流,热门项目高度集中在为AI智能体提供记忆、技能、安全、协作和效率优化的基础设施上。🧠 A...
2026-10-08 5 0 人工智能/应用
FastBench测流式VLMs:高速现实流感知卡壳了?
目前最强的Gemini-3.5-Flash,在FastBench测试里只拿了50.7分——这是当前流式视频大模型(VLM)应对高速现实流感知的上限,连及格线都没摸到。原有基准的盲区:1-2FPS...
2026-10-08 1 0 人工智能/应用
统一多模态深度研究Agent OneSearch-VL 做对了什么
OneSearch-VL-8B比带工具调用的Qwen3-VL-8B,在两个新的多模态视觉基准上,分别高出20.2和17.6个百分点。同参数级别的模型,差十几个点已经是很明显的能力差距——这不是小...
2026-10-08 1 0 人工智能/应用
WOVEN:补上多模态大模型的视觉推理短板
38个顶尖多模态大模型里,没一个能达到人类的视觉推理水平。多模态大模型的集体硬伤多模态大模型(MLLMs)在空间、具象化、物理、时间推理上表现极差。研究人员发现这些失效其实指向同一个核心问题:视...
2026-10-08 1 0 人工智能/应用
HRIL用高阶张量抓多模态协同:比现有方法强在哪?
多模态自监督学习已经在好多场景出成果了,但有个死穴:有些任务需要的信号,单看某一个模态根本找不到。比如一张图配一句“猫在追老鼠”,“追”这个动作的核心信号,得同时看猫的身体姿态和老鼠的位置,单拿...
2026-10-08 1 0 人工智能/应用