首页 > 阅读笔记 > 阅读笔记 > 国际最新研究称,一人工智能模型能翻译200种不同语言

国际最新研究称,一人工智能模型能翻译200种不同语言

发布时间:2024-06-09 15:50:05来源: 15210273549

京6月8日电 (记者 孙自法)国际著名学术期刊《自然》最新一篇人工智能(AI)研究论文称,研究人员开发出一个Meta人工智能模型的底层技术,该模型能翻译200种不同语言,增加了能用机器翻译的语言数量。

该论文介绍,神经机器翻译模型利用人工神经网络翻译各种语言,这些模型通常需要大量可在线获取的数据加以训练,但并非所有语言数据都公开、低成本或是普遍可及,此类语言被称为“低资源语言”。而增加模型在翻译语言数量上的语言输出可能会影响模型的翻译质量。

为此,本篇论文作者、“不落下任何语言”(No Language Left Behind,NLLB)团队开发出一种跨语言技术,能让神经机器翻译模型学习如何利用翻译高资源语言的预存能力来翻译低资源语言。作为成果,NLLB团队开发了一个在线多语言翻译工具,名为NLLB-200,该工具能容纳200种语言,其低资源语言数量是高资源语言的三倍,翻译表现比已有系统高了44%。

由于NLLB团队在许多低资源语言上只能获取1000-2000例样本,为扩大NLLB-200的训练数据量,他们用一个语言识别系统发现了这些特定语言的更多实例。该团队还从互联网存档中挖掘双语文本数据,帮助提升了NLLB-200的翻译质量。

《自然》同期发表同行专家“新闻与观点”文章指出,NLLB团队研发的这个工具,可以帮助很少被翻译的那些语言的使用者,让他们能使用互联网和其他技术。

此外,NLLB团队还强调教育是一个非常重要的应用,因为这个模型可以帮助低资源语言使用者获取更多图书和研究文章。不过,该团队也提醒说,误译的情况仍有可能出现。(完)

阅读笔记更多>>

宝马一把手换人!33年从管培生逆袭成CEO,扛起转型大旗 大型SUV市场“神仙打架”4月销量榜 1款销量过万 极氪9X第二 全主动悬架技术路线分化:800V分体式与48V集成式竞逐 上汽集团斩获两项世界品牌大会荣誉,在新能源和智能化发展趋势中,展现出全面的科技布局能力和转型韧性 Robotaxi用户翻番 文远知行营收增长58% 毛利率达35% 当大众亮起小蓝灯,ID. ERA 5S要抢谁的市场? 奕境X9破局逻辑:央企华为深度绑定,重塑华系汽车技术标杆 BBA最大号的SUV来了,迟到的奥迪Q9内饰长啥样 闪充版豹8越野更硬核 3个轮子也能轻松开? 奕派M8公告深读:华为乾崑+央企底座,30万级大六座SUV市场变天? 重新审视15万级市场:从“够用就好”到“一步到位”有多远? 最便宜的大六座:15万不到,华为全家桶!宝骏这次拼了? 阿维塔07L正式申报,看了配置后,预测起售价21.69万 兰博基尼迎来63周年,全新Fenomeno敞篷版即将推出 4月零跑断档式领跑,“蔚小理米”月销3万竞争激烈 高温到底会不会“伤”电池?闪充对比三元锂 零跑从“领跑”走向“加速跑”是因为产品体系的复利、全球化的扎根、战略主动权的转移 埃安i60:A级大单品爆款背后的体系制胜 卡文乐途轻卡入列 福田卡文汽车助力冷链行业标杆企业成功转型 奥迪E7X获全球首个整体座舱OEKO-TEX母婴级双认证 Model X正式停产!最后一辆车签满员工名字 深度试驾宝马X5 M雷霆版!比X5更狠、比M5更野 广汽全新方盒子要来了!设计原创,取名越7能抢方程豹钛7市场? 5月新车这7款不容错过,轿车、SUV、MPV都有,款款火爆? 纯电大六座的凯威德值不值?关键看契合的气场与用车需求 4月,32万销量!那个站在世界之巅的比亚迪,又回来了 坚守守信造车底色 魏建军与长城汽车的三十六年履约之路 艾瑞泽S准备平替奥迪A4L,设计心有灵犀 泰国RRS魔改第九代丰田海拉克斯,变身重载自卸皮卡 Model 3在这个国家突然大降价!比国产还低