2025-05-21 11:02:21 | 来源: AICG工具箱
2023年7月31日报道丨用户所使用的语言对于大型语言模型(LLM)的费用有很大的影响,可能造成英语使用者和其它语言使用者之间的人工智能鸿沟。最近的一项研究显示,由于 OpenAI 等服务所采用的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的 1.5 倍,而缅甸的掸语则是英语的 15 倍。
推特用户 Dylan Patel(@dlan522p)分享了一张照片,展示了牛津大学进行的一项研究,该研究发现,让一个 LLM 处理一句缅甸语句子需要 198 个词元(tokens),而同样的句子用英语写只需要 17 个词元。词元代表了通过 API(如 OpenAI 的 ChatGPT 或 Anthropic 的 Claude 2)访问 LLM 所需的计算力成本,这意味着缅甸语句子使用这种服务的成本比英语句子高出 11 倍。
词元化模型(即人工智能公司将用户输入转换为计算成本的方式)意味着,除了英语之外的其他语言使用和训练模型要贵得多。这是因为像中文这样的语言有着不同、更复杂的结构(无论是从语法还是字符数量上),导致它们需要更高的词元化率。例如,根据 OpenAI 的 GPT3 分词器 ,“你的爱意(your affection)”的词元,在英语中只需要两个词元,但在简体中文中需要八个词元。尽管简体中文文本只有 4 个字符(你的爱意),而英文有 14 个字符。
热门榜单
快影
常用AIHi Echo — 网易有道
常用AI网易AI创意工坊
常用AIgetaiway-ai制定旅游计划
常用AICivitai
常用AI猫目社区
常用AI天工巧绘SkyPaint
常用AI即梦AI
常用AI秘塔AI搜索
常用AI热门资讯
controlnet怎么安装_controlnet怎么使用?
01-16DeepL推出新一代翻译编辑大模型:翻译质量超越竞争对手谷歌微软ChatGPT
02-13国产最强文生视频模型「可灵」首发:直出2分钟超长视频,生成质量完胜OpenAI Sora丨免费体验
02-25欧盟批准生效全球首部人工智能法案:AI科技企业需要在36个月内完成合规认证
03-27落地发绿卡?微软加速AI团队撤出中国,加码布局投资东南亚市场
03-275月爆款丨AI图像编辑软件Remini的前世今生:幕后公司是“炒冷饭”高手,长期霸榜下载之王,年入上亿美元
04-12阿里“通义听悟”升级:支持6小时超长视频内容解析提问,还可一键生成巨幅思维导图
04-20Sora视频大模型训练数据被质疑非法采集,OpenAI CTO接受外媒专访面对敏感提问表现大翻车
04-20别等OpenAI了,全球首个类Sora抢先开源!所有训练细节/模型权重全公开,成本仅1万美元
04-21“洋AI助理”微软Copilot企业版抢滩登陆中国ToB市场,微软:近200个企业客户开始部署使用
04-21