咱们今天聊的这个事儿,初看像是一篇普通的开源模型宣传稿,但如果把它的账本翻开,你会发现这是一次极其冷静的商业穿插。
根据IT之家8月7日的报道和Neon官方博客的披露,数据库服务商Neon联合AI平台Castform,后训练了一个只有40亿参数的开源模型。这个模型专门干一件事:在AI智能体的文档搜索任务里,负责判断“该搜什么、怎么搜”。
这就引出了第一个认知冲突:我们往往以为,AI越聪明,背后调用的模型就得越庞大、越贵。但Neon和Castform用极低的成本证明,在特定检索任务中,超大模型的“大力出奇迹”不仅费钱,而且可能还不如一个专精的小家伙干得漂亮。
根据Neon公布的验证数据,这个4B小模型在文档检索评估中跑出了1.447的平均分,压过了OpenAI旗舰模型GPT-5.6 Sol的1.369分。更有冲击力的是成本账:小模型单次推理成本是0.000929美元,而GPT-5.6 Sol要花0.087338美元。粗略一算,成本差距接近94倍,刚好呼应了官方说的“1/100”。
