深度专题 FEATURES — 1
MiniMax M3接入llama.cpp
MiniMax M3进入 llama.cpp:视觉能力已接通,本地多模态实验有了入口,MSA状态仍待确认。
速览 BRIEFS — 9
NEWS
35B模型宣称纯CPU跑到59 tok/s
POCKET-35B宣称纯CPU可达59 tok/s,硬件门槛很低,测试条件仍待补齐。
REPO
本地语音Agent有了开源整套方案
Hugging Face把听、想、说串成可替换流水线,语音 Agent 可整套留在本地运行。
REPO
会议助手把转写和总结全部留在本机
Meetily把会议录音、实时转写和摘要留在本机,敏感谈话不必先交给云端。
REPO
MCP按符号取代码,号称省掉95% Token
按函数、类精准取代码,减少编码 Agent 阅读大仓库时的上下文浪费。
REPO
Agent原生应用框架开始冒头
Builder.io把 Agent 做进应用核心,一套业务动作可同时服务界面、协议和命令行。
REPO
一个接口拼接28家模型免费额度
把28家模型的免费额度接成一个接口,省去手动切换,但稳定性与条款风险仍需留意。
NEWS
音频大模型只激活18亿参数
10B规模只激活1.8B参数,让原生语音交互有了更省算力的新选择。
NEWS
同一模型换三种编码壳,成本差很多
同一底模换上三种编码壳,改出的代码相近,耗时和 Token 开销却相差明显。
REPO
LitGPT继续包办训练到部署
LitGPT把大模型预训练、微调和部署收进同一套工具链,已覆盖20余种模型。