AI大模型的语言不平等:英语最便宜,其它语言要贵得多
发布日期: 2023-07-31 09:11:25 来源: 凤凰网
【资料图】
IT之家 7 月 31 日消息,用户所使用的语言对于大型语言模型(LLM)的费用有很大的影响,可能造成英语使用者和其它语言使用者之间的人工智能鸿沟。最近的一项研究显示,由于 OpenAI 等服务所采用的的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的 1.5 倍,而缅甸的掸语则是英语的 15 倍。
IT之家注意到,推特用户 Dylan Patel(@dlan522p)分享了一张照片,展示了牛津大学进行的一项研究,该研究发现,让一个 LLM 处理一句缅甸语句子需要 198 个词元(tokens),而同样的句子用英语写只需要 17 个词元。词元代表了通过 API(如 OpenAI 的 ChatGPT 或 Anthropic 的 Claude 2)访问 LLM 所需的计算力成本,这意味着缅甸语句子使用这种服务的成本比英语句子高出 11 倍。
词元化模型(即人工智能公司将用户输入转换为计算成本的方式)意味着,除了英语之外的其他语言使用和训练模型要贵得多。这是因为像中文这样的语言有着不同、更复杂的结构(无论是从语法还是字符数量上),导致它们需要更高的词元化率。例如,根据 OpenAI 的 GPT3 分词器 ,“你的爱意(your affection)”的词元,在英语中只需要两个词元,但在简体中文中需要八个词元。尽管简体中文文本只有 4 个字符(你的爱意),而英文有 14 个字符。
关键词:
推荐内容
- AI大模型的语言不平等:英语最便宜,其它语言要贵得多 a>
- 全球微速讯:百万网友在线围观 内乡法院开展集中执行活动 a>
- 环球讯息:西峡农商银行:强化评级授信 防范贷款风险 a>
- 南阳市第六人民医院:兄弟医院齐合作 护理到“家”零距离_全球时快讯 a>
- 算力时代来了!AI算力行情是否具有可持续性?七家基金公司专业人士发声 a>
- 新野县财政局凝聚红色力量助推“五星”支部建设 焦点消息 a>
- 焦点信息:【竞彩】周三竞彩足球强档:日本女足争取出线 加拿大背水一战 a>
- 【竞彩】周二竞彩足球强档:新西兰女足求连胜 挪威女足迎生死战 a>
- 南阳市六院:冬病夏治三伏贴 “护理到家”送健康 a>
- “2022体彩追梦人”肖寒松捐献造血干细胞 搭建公益桥梁 a>
- 新野人民医院:与省医连线 在家门口解“难题” a>
- 跨境电商开拓外贸新增长点 a>
- 如何理解“一揽子化债方案”?华泰宏观:中央政府温和“加杠杆”化债对提振市场信心可能效果最显著 a>
- 中信证券:下半年消费总体配置机会明确,建议积极加配 a>
- 两市融资余额减少31.19亿元 a>
- 爱博诺德:以增资及股权转让方式收购福建优你康光学有限公司51%股权 a>
- 民航业进入增量提质关键期 a>
- 创新驱动促发展提质 a>
- 金观平:从战略高度抓好稳就业 a>
- 京津冀豫等地全力应对强降雨 a>