AI大模型的语言不平等:英语最便宜,其它语言要贵得多

业界
2023
07/31
11:33
IT之家
分享
评论

7 月 31 日消息,用户所使用的语言对于大型语言模型(LLM)的费用有很大的影响,可能造成英语使用者和其它语言使用者之间的人工智能鸿沟。最近的一项研究显示,由于 OpenAI 等服务所采用的的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的 1.5 倍,而缅甸的掸语则是英语的 15 倍。

IT之家注意到,推特用户 Dylan Patel(@dlan522p)分享了一张照片,展示了牛津大学进行的一项研究,该研究发现,让一个 LLM 处理一句缅甸语句子需要 198 个词元(tokens),而同样的句子用英语写只需要 17 个词元。词元代表了通过 API(如 OpenAI 的 ChatGPT 或 Anthropic 的 Claude 2)访问 LLM 所需的计算力成本,这意味着缅甸语句子使用这种服务的成本比英语句子高出 11 倍。

词元化模型(即人工智能公司将用户输入转换为计算成本的方式)意味着,除了英语之外的其他语言使用和训练模型要贵得多。这是因为像中文这样的语言有着不同、更复杂的结构(无论是从语法还是字符数量上),导致它们需要更高的词元化率。例如,根据 OpenAI 的 GPT3 分词器 ,“你的爱意(your affection)”的词元,在英语中只需要两个词元,但在简体中文中需要八个词元。尽管简体中文文本只有 4 个字符(你的爱意),而英文有 14 个字符。

【来源:IT之家】

THE END
广告、内容合作请点击这里 寻求合作
AI
免责声明:本文系转载,版权归原作者所有;旨在传递信息,不代表砍柴网的观点和立场。

相关热点

微软交出了一份远观尚可,但近看承压的“答卷”。
业界
7月28日消息,昨日,喜马拉雅副总裁王冬梅表示,喜马拉雅推出AI智能创作工具“云剪辑”,集合智能音量、智能配乐、音转文剪辑、AI分段、智能检测、一键成片等功能,目的是降低音频播客内容创作的门槛,提...
业界
7 月 28 日消息,金融投资机构瑞银集团日前发布了一则分析报告,报告中,瑞银集团上调了对人工智能终端需求的长期预测值,从 2020 年至 2025 年 20% 的复合年增长率(CAGR)上调至 2022 年至 2027 年的 61...
业界
7月28日 消息:据mobileworldlive消息,德国电信、e&、SK电信(SKT)和新加坡电信签署了一项协议,成立一个全球电信人工智能联盟,旨在利用这项技术开拓新的商业机会,加速行业增长。
业界
7月27日 消息:根据一项最新研究,人工智能(AI)的发展可能会让女性面临更大的失业风险。
业界

相关推荐

1
3