星光澄海 | BLOG

Gemini Omni 1.1 Flash:给开发者的控制权变多了?

刚看到Google放出Gemini Omni 1.1 Flash的更新,核心点很明确:给开发者更多控制权——不是那种喊了好几年的“开放API”,是真能自己说了算的权限。

不是“全能选手”,是“可控工具”

之前用大模型,开发者最怕什么?输出太飘。比如做AI内容生成的,旧版模型可能突然扯到别的话题;做合规类应用的,可能不小心输出敏感内容。前阵子帮朋友盯他的电商AI文案工具,用的还是旧版Gemini Flash,生成的商品描述经常超字数,还会加些商家没要求的夸张话术,他不得不做三层过滤:先筛掉无关内容,再精简字数,最后过一遍合规,这套流程占了后端30%的算力。这次的1.1 Flash,应该就是针对这类痛点来的——至少从“build with more control”的核心来看,开发者能自己设置输出的最小单位,比如要求每句不超30字,或者输出必须是结构化的列表,甚至能定义哪些关键词绝对不能出现,不用再靠prompt反复“叮嘱”,也不用加一大堆后处理。

谁会最先吃到红利?

不是用大模型写日记的普通用户,是做垂直应用的开发者。比如给银行做AI客服的团队,之前要反复跟模型强调“不能提投资建议,只能引导到人工”,还得在后端加审核接口,防止模型“越界”。现在用1.1 Flash,直接在API参数里设“禁止输出与投资相关的内容”,甚至能限制输出的语气必须是“专业、中性”,不用再花精力在“管模型”上,能把时间花在优化客服的对话流程上。还有做医疗辅助工具的团队,要求模型不能输出具体的治疗方案,只能提供通用健康建议,这次的控制权限,刚好能满足这类强合规需求——不用再靠人工校验每一条输出,省了大量人力。

大模型的另一条竞赛线?

之前大模型的竞赛,大家都在比谁的上下文窗口更长,谁的多模态识别更准,谁能处理更多语言。Google突然把重点放在“控制”上,说明大厂已经意识到,大模型的下一个机会,不是谁的模型更聪明,是谁的模型更“能用”——能用在自己的产品里,不用怕踩坑。比如很多小团队想做AI工具,但怕大模型输出不可控,不敢上线,现在有了可控性更强的模型,他们敢把自己的想法落地。不过,Google会不会把控制权限设得太死?比如会不会限制开发者做一些“创意性”的输出?这可能是个需要观察的点,但至少现在,这个更新是戳中了开发者的真实痛点。

当开发者能自己把大模型的输出攥在手里,不用再跟模型“斗智斗勇”,会不会有更多小团队能快速做出靠谱的AI应用?


素材来源:Google DeepMind Blog · AI情报、大模型、AI应用落地、开源生态
查看报道原文

发表第一条评论吧

支持 Markdown