AI大模型的语言不平等:英语最便宜,其它语言要贵得多

2023-07-31 10:31:40 来源:金融界


(相关资料图)

用户所使用的语言对于大型语言模型(LLM)的费用有很大的影响,可能造成英语使用者和其它语言使用者之间的人工智能鸿沟。最近的一项研究显示,由于 OpenAI 等服务所采用的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的 1.5 倍,而缅甸的掸语则是英语的 15 倍。

IT之家注意到,推特用户 Dylan Patel(@dlan522p)分享了一张照片,展示了牛津大学进行的一项研究,该研究发现,让一个 LLM 处理一句缅甸语句子需要 198 个词元(tokens),而同样的句子用英语写只需要 17 个词元。词元代表了通过 API(如 OpenAI 的 ChatGPT 或 Anthropic 的 Claude 2)访问 LLM 所需的计算力成本,这意味着缅甸语句子使用这种服务的成本比英语句子高出 11 倍。

词元化模型(即人工智能公司将用户输入转换为计算成本的方式)意味着,除了英语之外的其他语言使用和训练模型要贵得多。这是因为像中文这样的语言有着不同、更复杂的结构(无论是从语法还是字符数量上),导致它们需要更高的词元化率。例如,根据 OpenAI 的 GPT3 分词器 ,“你的爱意(your affection)”的词元,在英语中只需要两个词元,但在简体中文中需要八个词元。尽管简体中文文本只有 4 个字符(你的爱意),而英文有 14 个字符。

本文源自:IT之家

标签:

AI大模型的语言不平等:英语最便宜,其它语言要贵得多

2023-07-31

10个重点招商项目签约入驻,三林镇奋力推动镇域经济高质量发展

2023-07-31

港股开盘 | 恒指高开1.61% 汽车、科技股延续涨势 机构:港股政策底已形成

2023-07-31

沪深股通|润和软件7月28日获外资买入1.32万股

2023-07-31

经济日报携手京东发布数据——冰淇淋呈多样化发展趋势

2023-07-31

居家养老如何更好?完善服务、智能养老让老人生活更安心

2023-07-31

成语机不可失出自张九龄之笔它的下句是时不再来(机不可失下句)

2023-07-31

苏州烟草网上订货平台网址是什么 苏州烟草网上订货

2023-07-31

97分钟绝杀,2-1!女足世界杯冷门诞生,还“救”了韩国队

2023-07-31

微山县张楼镇三个“主动”积极探索 武装工作与退役军人融合发展新机制

2023-07-30

筑牢老年人健康安全防护网!带状疱疹更容易攻击女性?得过一次还会再得?

2023-07-30

别眨眼!20幅动图带你盘点第二届工匠大会震撼瞬间!

2023-07-30

解锁“村超”丨一颗足球引发的“超”字号产业潜力释放

2023-07-30

“蓉宝”,颁奖!

2023-07-30

烤瓷牙价格表2023_烤瓷牙价格表2019

2023-07-30

串口硬盘和并口硬盘有什么区别 硬盘串口与并口有何区别

2023-07-30

又是因为它!浙江女子命悬一线!当时发现不对,但她还是吃了...

2023-07-30

存贷比是什么意思(什么是存贷比)

2023-07-30

东欧帮到德国帮!国米2500万报价21岁多面手,明年免签潜力门将

2023-07-30

收割、脱粒、粉碎稻秆一气呵成 多地早稻收割接近尾声

2023-07-30

作家保冬妮与小读者见面:感受鸟儿百态,获得成长力量

2023-07-30

河北省成安县发布暴雨橙色预警

2023-07-30

霸气侧漏的意思(霸气侧漏的解释)

2023-07-30

西伯利亚冻土中沉睡4.6万年的生物,被科学家复苏了

2023-07-30

时隔近12年暴雨红色预警!北方多省市迎战极端强降雨!

2023-07-30

大兴一职招生简章2022 大兴一职

2023-07-30

节奏汽车竞速什么时候出 公测上线时间预告

2023-07-30

故宫博物院于7月30日、31日临时闭馆

2023-07-29

越南皮又痒了?中国雷霆出击,900万吨越南大米从哪来回哪去?

2023-07-29

请注意绕行!北京经开区4处主要防汛风险点位公布

2023-07-29

Copyright ©  2015-2022 中公频道网版权所有  备案号:沪ICP备2022005074号-18   联系邮箱:5855973@qq.com