据 IT 之家 7 月 31 日消息,用户所使用的语言对于大型语言模型(LLM)的费用有很大的影响,可能造成英语使用者和其它语言使用者之间的人工智能鸿沟。最近的一项研究显示,由于 OpenAI 等服务所采用的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的 1.5 倍,而缅甸的掸语则是英语的 15 倍。 推特用户 Dylan Patel(@dlan522p)分享了一张照片,展示了牛津大学进行的一项研究,该研究发现,让一个 LLM 处理一句缅甸语句子需要 198 个词元(tokens),而同样的句子用英语写只需要 17 个词元。词元代表了通过 API(如 OpenAI 的 ChatGPT 或 Anthropic 的 Claude 2)访问 LLM 所需的计算力成本,这意味着缅甸语句子使用这种服务的成本比英语句子高出 11 倍。 词元化模型(即人工智能公司将用户输入转换为计算成本的方式)意味着,除了英语之外的其他语言使用和训练模型要贵得多。这是因为像中文这样的语言有着不同、更复杂的结构(无论是从语法还是字符数量上),导致它们需要更高的词元化率。 原文链接 —- 编译者/作者:东寻 玩币族申明:玩币族作为开放的资讯翻译/分享平台,所提供的所有资讯仅代表作者个人观点,与玩币族平台立场无关,且不构成任何投资理财建议。文章版权归原作者所有。 |
AI 大模型的语言不平等:英语最便宜,其它语言要贵得多
2023-07-31 东寻 来源:区块链网络
LOADING...
相关阅读:
- 三天出大片AIGC解锁文旅营销新手段2023-07-30
- 圆通速递:高度重视信息技术研发,AI 技术已与部分业务场景深度融合2023-07-30
- 英伟达 H100 GPU 已对亚马逊 AWS 云服务用户开放,将推进云计算以及生成2023-07-30
- 固生堂携手百度打造中医 AI 大模型应用平台2023-07-29
- 完美世界 CEO 萧泓:电竞、游戏已成为元宇宙、AIGC 等技术最佳试验场2023-07-29