做跨语言内容,麻烦往往不在“翻出一句话”,而在整套流程:产品名不能前后变样,文档格式不能被打乱,字幕要卡时间,配音台词还得控制长短。BiliBili Index LLM 团队发布的 Index-Translate,试图用同一开源模型家族接住这些任务。据团队在 Reddit 的介绍,文本模型覆盖 150 种语言,提供 2B、9B 和 35B-A3B 预览版,并允许指定术语、文风与输出格式,例如保留 JSON 结构和占位符。
更值得注意的是,它没有把“本地化”只当成逐句翻译。Index-NativeLong 面向整份文档,会参考较大范围的前后文,以保持人名和术语一致;Index-Homura 可限定译文音节数,方便台词适配配音时长;Index-Echo 则生成多语言字幕,或参考原说话人的声音完成语音到语音翻译。代码和已发布权重采用 Apache-2.0 许可。边界也很明确:150 种语言只适用于文本模型,Echo 支持的语言组合更少;目前材料未提供独立评测或具体准确率。