AIFUC Logo智驱战略推演引擎
STRICTLY CONFIDENTIAL
商业拆解
北美
NO.234881VIP会员

把智能体的“汽油费”打掉99%,两个小厂商如何用一本公开账动摇巨头的根基

陈锋 2026.08.08

在AI智能体的成本黑洞里,谁能用极致的专用小模型把推理开销打到忽略不计,谁就拿到了开启规模化商业落地的物理钥匙。

聚焦Neon与Castform如何通过开源小模型在智能体检索场景实现成本仅1/100的商业攻击,拆解其围绕数据库物理入口绑定客户、稀释巨头推理收入份额的底层算账逻辑。

咱们今天聊的这个事儿,初看像是一篇普通的开源模型宣传稿,但如果把它的账本翻开,你会发现这是一次极其冷静的商业穿插。

根据IT之家8月7日的报道和Neon官方博客的披露,数据库服务商Neon联合AI平台Castform,后训练了一个只有40亿参数的开源模型。这个模型专门干一件事:在AI智能体的文档搜索任务里,负责判断“该搜什么、怎么搜”。

这就引出了第一个认知冲突:我们往往以为,AI越聪明,背后调用的模型就得越庞大、越贵。但Neon和Castform用极低的成本证明,在特定检索任务中,超大模型的“大力出奇迹”不仅费钱,而且可能还不如一个专精的小家伙干得漂亮。

根据Neon公布的验证数据,这个4B小模型在文档检索评估中跑出了1.447的平均分,压过了OpenAI旗舰模型GPT-5.6 Sol的1.369分。更有冲击力的是成本账:小模型单次推理成本是0.000929美元,而GPT-5.6 Sol要花0.087338美元。粗略一算,成本差距接近94倍,刚好呼应了官方说的“1/100”。

以商业案例,训练复杂环境下的判断与决策能力,可以进入商业判断力训练系统