Seed-X-PPO-7B

一、引言

Seed-X 是一系列开源的多语言翻译语言模型,包括指令模型、强化学习模型和奖励模型。该模型在 70 亿参数内实现了卓越的翻译能力,旨在作为易用的工具,推动翻译研究和应用的发展。Seed-X 在翻译能力上与 Gemini-2.5、Claude-3.5 和 GPT-4 等超大型模型相当甚至更优,同时具备轻量级和高效的特点,适合部署和推理。它在涵盖互联网、科技、办公对话、电子商务、生物医学、金融、法律、文学和娱乐等领域的高难度翻译测试集中表现出色。

二、模型特性

Seed-X-PPO 模型是 Seed-X 系列中的一员,具有以下特点:

  • 类型:因果语言模型。

  • 训练阶段:预训练和后训练。

  • 支持:支持 28 种语言之间的多语言翻译。 支持的语言及其缩写如下表所示:

语言缩写语言缩写语言缩写语言缩写
阿拉伯语ar法语fr马来语ms俄语ru
捷克语cs克罗地亚语hr挪威博克马尔语nb瑞典语sv
丹麦语da匈牙利语hu荷兰语nl泰语th
德语de印尼语id挪威语no土耳其语tr
英语en意大利语it波兰语pl乌克兰语uk
西班牙语es日语ja葡萄牙语pt越南语vi
芬兰语fi韩语ko罗马尼亚语ro中文zh

三、模型下载

Seed-X 提供了三种模型供下载:

  • Seed-X-Instruct:针对用户意图进行指令调整。

  • Seed-X-PPO:通过强化学习提升翻译能力。

  • Seed-X-RM:用于评估翻译质量的奖励模型。

四、快速启动

以下是一个简单的示例,展示如何使用 vllm 加载模型并进行翻译:

from vllm import LLM, SamplingParams
model_path = "./ByteDance-Seed/Seed-X-PPO-7B"
model = LLM(model=model_path, max_num_seqs=512, tensor_parallel_size=8, enable_prefix_caching=True, gpu_memory_utilization=0.95)

messages = [
    "Translate the following English sentence into Chinese:\nMay the force be with you",
    "Translate the following English sentence into Chinese and explain it in detail:\nMay"
]

decoding_params = SamplingParams(temperature=0, max_tokens=512, skip_special_tokens=True)
results = model.generate(messages, decoding_params)
responses = [res.outputs[0].text.strip() for res in results]
print(responses)

五、评估

Seed-X 在多个翻译基准测试中进行了评估,包括 FLORES-200、WMT-25 和公开发布的挑战集,并结合了人类评估。评估结果显示,Seed-X 在多语言翻译性能上优于其他开源模型。具体评估结果如下图所示:

  • 模型规模与多语言翻译性能:Seed-X-7B 在不同规模开源模型中表现优异,其平均多语言翻译性能高于其他模型。

  • 人类评估:在 Seed-X 挑战中,Seed-X-7B 在中文/英文到 7 种语言的翻译任务中获得了高分。

六、许可

该项目采用 OpenMDW 许可证,具体详情请参考 LICENSE 文件。

七、引用

Seed-X 的技术报告即将在 Arxiv 上发布。

核心技术汇总

在这里插入图片描述

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐