深度专题 FEATURES — 2
Prime Agent:编码框架也会自我改进
Prime Agent 把“自我改进”放进编码执行框架,焦点从换模型转向优化做事方式。
LeanCTX:Agent该看什么,由本地决定
LeanCTX 在本地替 Agent 筛选、压缩和记忆上下文,把成本、隐私与权限放进同一层管理。
速览 BRIEFS — 7
NEWS
Agent记忆未必需要模型把关
取消记忆写入前的模型筛选,让遗漏更好追查,也省下一次推理调用。
NEWS
音效生成塞进8GB显存
Scenema Audio接入ComfyUI并量化至8GB显存,让表演式配音更容易在消费级显卡上本地运行。
REPO
SkyRL补齐LLM强化学习全栈
SkyRL 把大模型强化学习的训练、推理和 Agent 工具链装进同一套模块化框架。
REPO
τ-Bench测试工具、用户与Agent三方互动
把用户沟通也放进工具 Agent 考场,更贴近真实客服流程。
REPO
Weft想用一门语言编排AI
Weft把模型、工具和人工审批写进一门语言,想让AI流程更安全、可续跑也更好调试。
NEWS
Shieldstral用3B模型识别图像风险
Mistral 用 3B 多模态模型,把文字和图片审核变成可自定义的 yes/no 问答。
NEWS
Claude Code新增市场源通配管控
Claude Code 支持按 GitHub 组织批量管控插件源,把企业治理推进到扩展供应链入口。