bilibili、150言語対応の翻訳MoEをApache-2.0で公開
オープンモデル翻訳MoEHugging Facebilibili
中国bilibiliのIndexチームが、翻訳特化のMixture-of-Expertsモデル「Index-Translate-35B-A3B-preview」をHugging Faceで公開した。総パラメータ35B・アクティブ3Bで、Qwen3.5をベースに150言語の翻訳に対応する。ライセンスはApache-2.0で商用利用可、FP8/FP4の量子化版も同時に提供されている。
何が発表されたか
- モデル名はIndex-Translate-35B-A3B-preview。Hugging Faceのモデルカードは2026年10月2日に作成された。
- 構成は総パラメータ35B・アクティブ3BのMoE。Qwen3.5をベースに、翻訳タスク別の専門モジュールをパラメータ補間で統合している。
- 対応言語は150。低リソース言語ペアでの性能を強みとして挙げ、低リソースFLORESでCOMET-22 0.8168、off-target出力2.4%と報告。
- 主要ベンチマークはFLORES COMET-22が0.8794、instTrans IFscore 0.8336、WMT26 Judge 76.76/100、MEME 0.7405。
- 用語集の強制適用(ハード制約)と文体調整(ソフト制約)に対応し、書式やドメイン用語の指示追従もうたう。
- ライセンスはApache-2.0。FP8版・FP4版も別リポジトリで提供されている。
開発者への影響
- アクティブ3BのMoEなので、総パラメータ35Bに対して推論コストは小型モデル並みに収まる。FP8/FP4版を使えば単一GPUでの自前ホスティングが現実的で、多言語サイトの翻訳をAPI従量課金から切り替える選択肢になる。
- 用語集のハード制約は実務で効く機能。商品名やブランド表記を固定したまま多言語展開したいEC案件で、従来は後処理で置換していた作業を削れる。
- Apache-2.0なのでクライアント納品物への組み込みに制約が少ない。ただしpreview版であり、ベンチマークは提供元の自己申告。本番投入前に自社コーパスでCOMETなどを計測したい。
利用条件
Apache-2.0ライセンス。重みは公開されており無償。ベースモデルはQwen3.5。
