如意小报
版块首页原文 ↗
AI · 新闻详情

Show HN:仙人掌混合体:我们教 Gemma 4 知道什么时候是错的

大模型 · 社区 · Hacker News · 2026-07-23 · 重磅值 81.45
真正值得关注的不是这条新闻本身,而是它可能把「大模型」的竞争焦点推向能力、成本与开放生态的再平衡。
发生了什么:嘿,HN,Henry 和 Roman,来自 Cactus。
为什么重要:模型能力的变化,可能重塑下一批产品的技术底座。
观察窗口:后续要看开放范围、价格策略、真实评测以及开发者是否愿意迁移。
正文来源:非原文:源网页正文只有单句或图片说明,以下为已有摘要与自动整理内容
原文链接:https://github.com/cactus-compute/cactus-hybrid

嘿,HN,Henry 和 Roman,来自 Cactus。

小型设备上模型快速且私密,但有时会出错,但前沿模型很快就会变得昂贵。

因此,我们对 Gemma 4 E2B 进行了后期训练,以了解何时出错。

每个响应都带有 0 到 1 之间的置信度得分。

开发人员可以在置信度较高时接受设备上的模型,在置信度较低时将其移交给更大的云模型。

通过仅将 15-35% 的查询路由到 Gemini 3.1 Flash-Lite,Gemma-4-E2B 在 mo 上与 Gemini 3.1 Flash-Lite 相匹配 作为大模型方向的最新进展,社区的这一动作可能改变现有模型的能力边界与竞争格局,值得开发者与产品团队重点关注其后续的开放程度与定价策略。

模型能力的变化,可能重塑下一批产品的技术底座。

机器翻译/自动整理可能存在误差,请以原文为准。

继续阅读

正在加载推荐…