星光澄海 | BLOG

GPT-6上线+Claude小模型大降价,AI圈假期没停

节后第一个工作日,OpenAI和Anthropic的两条消息,比刚补完班的人状态还猛:一个把GPT-6铺到了全球ChatGPT用户的对话入口,另一个把小模型的综合运行成本砍了近75%。

GPT-6改的不是参数,是“说话方式”

之前只在开发者日上亮相的GPT-6,这次把能力铺到了普通用户面前。最大的改动不是参数量——以往推理模型都是“想完再答”,GPT-6变成了“边想边答”:在需要联网搜索的问题上,GPT-6 Instant比上一代平均提前44%开始输出答案,取材准确度也提了一档。另一个变化是智能界面:回答里能嵌图表、表单、可点击按钮,排行程、算账目、画自行车结构图,不再只是一堆文字。付费档位也分层:Plus等用户用GPT-6 Sol,Free和Go用更轻的Luna,Work和Codex的底层模型没动。

小模型降价,是AI厂商的“成本战”

Anthropic这次把小模型的价格压到了极致。新出的Claude Haiku 5.5,10万token以内请求,输入每百万token0.10美元、输出0.50美元,综合成本比上一代低约75%。同步降的还有Sonnet 5.5的缓存读取价,从0.20美元降到0.10美元,多数智能体任务成本降约20%。基准测试的涨势很猛:操作电脑的OSWorld从15.7%升到72.4%,命令行编程的Terminal-Bench 4.0从0分涨到39.2%,知识工作GDPval-AA拿了1620分。这系列还支持可调性能档位,用户能在成本和智能之间选,默认中等档。不过有个技术细节:Haiku换了新分词器,同一个任务会多耗些token,部分抵消了降价的力度,官方没说实际能省多少。Anthropic还把它定位成子智能体——Opus和Sonnet负责规划,它跑具体子任务。

国产AI的路径,在差异化和自主算力

假期国内也没停。月之暗面的Kimi K3.1开了API调用,100万token上下文,三档推理强度,预计10月发布;阶跃星辰Step 5 Preview是稀疏MoE,总参数600B、激活27B,100万token上下文,单任务成本约为Claude Opus 5的1/8,10月15日开源;快手可灵Kling 4.0开启内测,最长30秒原生生成,支持10张关键帧,4K HDR输出,Flash版已开放体验。三家分别抓长文本、推理效率、视频生成,避开同赛道硬碰。DeepSeek开源了适配华为昇腾的全套工具链,和之前英伟达平台的组件对应,减少对单一芯片的依赖。资本也在凑过来:Anthropic要IPO,估值1.8-2万亿美元,2025年收入46亿,未来十年算力支出至少5180亿;DeepSeek接近完成120亿美元融资,估值750亿,腾讯、宁德时代是投资方。

这一轮AI的动静,从拼参数、拼基准,转到了拼成本、拼落地。当小模型的成本越来越低,智能体的能力越来越实,下阶段的核心是能不能把这些能力塞进用户的具体需求里。只是,当轻量AI的成本低到几乎可以忽略,会不会有更多人愿意把日常的琐事,交给这些“便宜又快”的AI来处理?


素材来源:钛媒体 · AI情报、融资并购、大模型、AI芯片与算力
查看报道原文

发表第一条评论吧

支持 Markdown