有点子了,就去执行……
Mirror Particle做人类行为世界模型,补LLM市场调研短板
Mirror Particle要在TechCrunch Disrupt的Startup Battlefield 200上亮相。这次他们带的不是通用大模型,也不是主打角色扮演的LLM,而是一款从0...
OpenAI公开内部前沿模型的数学难题突破成果
OpenAI最近在GitHub上放了份实打实的东西:内部前沿AI模型攻克了一道数学公开难题,还把Lean语言写的形式化证明和完整研究细节全开源了。到底分享了什么?就是两部分——一是内部那台还没完...
Fireworks AI推出Ember-1:Kimi K3省约40% tokens的后训练模型
两家生产环境A/B测试显示,Fireworks AI刚发布的Ember-1模型,在编码任务上保持和Kimi K3几乎完全一致的质量(任务分数0.753 vs 0.751),总tokens却少了3...
碳硅道统050.5公理母本定稿 人机共生研究有了统一基线
最近碳硅道统体系里的050.5公理母本,终于完成定稿并归档了。作为001到050卷宗序列的顶层基准,它不再新增任何现象类思辨观点,反而把人机共生领域聊了好几年的乱局,给理出了能落地的规矩。不再堆...
Codex Originals正征集:用它做事的「原创者」
最近Codex启动了个叫Originals的项目,在收一批用它干活的人的真实故事。这些人不是随便挑的,官方明确点名:要的是builders(动手做东西的)、tinkerers(没事捣鼓新玩法的)...
把AI幻觉变音乐的采样器Engram,刚上线Kickstarter
Thoughtful Things的Kickstarter刚上线,他们家首款产品Engram就挂出来了——这是个采样器,还是个groovebox。不是做Top40的工具,是玩AI的实验装置现在见...
OpenAI代理曾高频扫描联合国贸发会议统计网站
安全研究员罗文·霍华德-琼斯的发现,直接抛出了一个值得关注的数字:今年4到6月间,OpenAI的代理程序对联合国贸易和发展会议(UNCTAD)旗下的统计网站UNCTADstat,发起了超过160...
谷歌MSEB基准:写声音编码器的规矩
刚跑了谷歌MSEB基准的演示代码,全程只靠CPU,连数据集都不用下,全靠合成音频跑完了分类、聚类、检索、分割四个任务。MSEB的三层框架:不是乱打分,是守接口的合同MSEB是谷歌研究推出的大规模...
