星光澄海 | BLOG
有点子了,就去执行……
RSI火了背后:AI自我进化,卡在了哪几步?
9月17日智谱唐杰披露GLM-6.0核心是RSI,9月22日小米发MiMo-V2.6称是RSI关键一步,同期Anthropic、OpenAI预警RSI失控风险,吴泳铭在云栖大会说RSI是通往超级...
2026-10-08 1 0 人工智能/应用
陶哲轩牵头,数学家联合抵制OpenAI
陶哲轩的社交账号里,最近挂着一份联名抵制名单,全是各国顶尖数学家。这条动态没提更多细节,但两边的状态,已经是彻底撕破脸了。谁先挑的头?就是陶哲轩,拿过菲尔兹奖的那个人。他没单独行动,把抵制的号召...
2026-10-08 2 0 人工智能/应用
专访Samuel King:用AI设计病毒的初步探索
2025年斯坦福大学博士Samuel King用生成式AI生成的病毒基因蓝图,已经能在体外杀死特定细菌。这不是AI创造的生命,却是离AI设计新生命最近的一步——这次他以相关工作入选2026年MI...
2026-10-08 1 0 人工智能/应用
三名被解雇的OpenAI安全研究者否认指控 警告寒蝉效应
三名被解雇的OpenAI安全研究者:明确否认,担忧寒蝉效应三个此前在OpenAI从事安全研究的人员,近期被公司解雇后,发布了一封公开信。信里的内容非常直接:第一,他们明确否认公司给出的“不当处理...
2026-10-08 2 0 人工智能/应用
OpenAI年度收入或低于预期,缺口约200亿美元
OpenAI此前被报道年度化收入约700亿美元,最新消息显示,这个数字比之前的预期少了整整200亿美元。这个量级的调整没有给出具体原因,但足够让行业警觉。【差在哪?】之前的700亿,是市场基于C...
2026-10-08 1 0 人工智能/应用
OpenAI的数学证明为何没达到行业标准
最近OpenAI推的一批数学证明工具,刚露面就被他们自己咨询过的数学研究小组盯上了——这些工具生成的大量证明,全偏离了当初顾问们定的行业指南。不是翻车,是没守约定的规则OpenAI为了做数学证明...
2026-10-08 1 0 人工智能/应用
OmniCapBench:解决多模态模型评测痛点的新框架
你知道现在评测多模态大模型(MLLM)有多挠头吗?要么评分全但找不到具体问题在哪,要么能定位但覆盖不全,用大模型当裁判又容易乱打分。直到OmniCapBench出来——它靠786个精标视频,把评...
2026-10-08 1 0 人工智能/应用
扩散模型的控制级不确定性:SCOPE解决采样成本痛点
机器人做实时路径规划时,用扩散模型生成轨迹,之前算不确定性要靠蒙特卡洛采样,这一步慢到跟不上毫秒级的控制需求。原来的问题:扩散模型的不确定性太“贵”扩散模型能表示复杂多变的多模态轨迹分布,但要从...
2026-10-08 1 0 人工智能/应用
FastBench测流式VLMs:高速现实流感知卡壳了?
目前最强的Gemini-3.5-Flash,在FastBench测试里只拿了50.7分——这是当前流式视频大模型(VLM)应对高速现实流感知的上限,连及格线都没摸到。原有基准的盲区:1-2FPS...
2026-10-08 1 0 人工智能/应用
统一多模态深度研究Agent OneSearch-VL 做对了什么
OneSearch-VL-8B比带工具调用的Qwen3-VL-8B,在两个新的多模态视觉基准上,分别高出20.2和17.6个百分点。同参数级别的模型,差十几个点已经是很明显的能力差距——这不是小...
2026-10-08 1 0 人工智能/应用