频繁用 AI,哪怕单次调用不贵,累计费用也会越来越高。据快科技9月24日报道,DeepSeek内部正在测试一款轻量级大模型,目标是在普通游戏显卡上运行,并处理绝大多数日常任务。轻量模型会用部分规模和能力换取更低的显存需求与运行成本;如果消息属实,用户便有机会把模型下载到个人电脑,而不是每次都把请求发给云端 API。
这件事值得关注,因为费用主要发生在“推理”阶段——也就是模型训练完成后,实际生成答案的过程。云端服务通常按 Token 计费;Token 是模型读写文字的基本计量单位,可能是一个字、一个词或词的一部分。本地部署则受显卡算力和显存限制,因此“普通显卡能跑”是关键门槛。
不过,目前信息来自所谓的投资人会议泄露。报道没有披露发布时间、参数规模、具体显卡要求、运行速度或能力测试,“接近完成”和“可处理绝大多数日常任务”也尚无公开结果支撑。它究竟能否覆盖真正大众化的硬件,仍要等 DeepSeek正式发布。