企业让 AI 查内部资料,常像请人反复翻档案:问题越复杂,搜索轮次越多,时间和费用越高。RAG(检索增强生成)会先找相关资料,再交给模型回答;到了 Agentic search,Agent还会自行改写问题、连续搜索。Castform称,一次典型的 GPT-5.6 Sol 多轮检索超过10秒,端到端约花0.03美元。
它的做法是把企业已有的文档和数据库内容转成训练任务,再用 RL(强化学习,即让模型反复尝试,并根据答案得分调整策略)训练开放权重小模型。模型训练和实际运行时,都通过 Neon 的 Postgres 搜索扩展访问同一批资料。Castform自述,这类专门训练的小模型能在检索任务上追平甚至超过前沿闭源模型,单次成本低约100倍。若结果可复核,它会改变 RAG 的选型逻辑:昂贵大模型未必需要承担每一轮搜索。不过原文未披露具体模型、评测集、准确率和完整对照数据,目前仍应把“胜过 GPT-5.6 Sol”视为厂商主张。