news 2026/4/16 10:56:42

对话优化标记器的潜力:一种将 LLM 推理效率提高 10% 的方法

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
对话优化标记器的潜力:一种将 LLM 推理效率提高 10% 的方法

概述

LLM 的计算资源和能耗与模型中的标记数成正比增长。为了减少标记符的数量,设计高效的标记符生成器非常重要。目前许多标记化器都是针对静态、结构化语料库(如书籍和网络文本)进行优化的。然而,聊天机器人是 LLM 在实践中的主要应用,主要是具有不同输入和输出格式的对话文本。

针对这一空白,本研究重新设计了 “对话优化标记符号化器”。具体地说,我们使用真实世界的聊天数据 LMSYS Chat 1M 重新训练了几种 LLM 的标记化器。

结果表明,标记符号的减少量最高可达 10%,甚至更多,这表明了提高能效的潜力。另一方面,对训练语料的影响有限,预计对模型性能的负面影响也很小。

建议采用的方法

本研究探讨了能否针对会话数据优化现有的标记符号生成器,以减少标记符号数量和推理过程中的能耗成本。

作为该方法的第一步,LMSYS Chat 1M 语料库的 80% 用于训练,20% 用于评估。然后建立三种类型的标记化器,仅使用用户输入、仅使用模型响应或同时使用用户输入和模型响应进行重新标记化。为确保公平比较,重新训练使用的算法和设置与每个模型的原始标记化器相同。

生育率"(每个词的标记数)和 "标记减少率 "用于评估。作为文本压缩效率的一项指标,"生字率 "尤其有用。与原始标记器相比,重新标记的模型在减少标记总数方面表现出一致的趋势。在回复方面的优化尤其有效,这也与聊天回复占大部分文本的情况相符。

结论是,这些设计可以在不影响模型通用性的情况下对标记符进行实际改进。

实验

本研究通过三项实验测试了对话优化标记符的有效性。

在第一个实验中,对八个 LLM 模型(GPT-4、GPT-4o、DeepSeek-R1、LLaMA-3.1、Gemma-2、Mistral-7B、BLOOM 和 Phi-4)中现有标记符的性能进行了评估。结果表明,所有模型在对话数据上的标记效率(生育率)都有所下降,这表明有必要进行优化。

接下来的实验证实,重新训练的标记符号生成器可以比原始标记符号生成器减少 5-10% 或更多的标记符号。其中,Gemma-2、Mistral-7B 和 BLOOM 的改进幅度超过了 10%,而针对具体语言的分析也表明,在英语和西班牙语等数据量大的语言中,减少幅度更为明显。

最后一项实验研究了重新训练的标记符对传统训练数据(C4 语料库)的影响。在大多数模型中,标记数只增加了 1-2%,而在某些模型中,标记数在某些情况下反而减少了。这表明,引入会话优化并不会明显降低模型的通用性。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/4/16 4:09:48

利用LobeChat生成技术文档:提升开发效率的新思路

利用LobeChat生成技术文档:提升开发效率的新思路 在软件研发过程中,最让人头疼的往往不是写代码,而是写文档。尤其是面对快速迭代的技术产品,维护一份准确、清晰且结构完整的技术文档常常成为团队的“遗留任务”。传统方式下&…

作者头像 李华
网站建设 2026/4/16 4:08:31

13、OpenStack网络构建与实例连接全解析

OpenStack网络构建与实例连接全解析 1. 网络与子网管理 在云环境中,网络和子网的管理是基础且关键的操作。管理员可以通过特定的操作来添加子网、创建子网池以及管理网络端口等。 1.1 创建子网 云管理员若要在仪表盘创建子网,可按如下步骤操作: 1. 以管理员用户登录,导…

作者头像 李华
网站建设 2026/4/16 4:09:34

2、OpenStack网络入门指南

OpenStack网络入门指南 1. 背景与需求 在当今的数据中心中,网络所包含的设备数量比以往任何时候都要多。曾经占据大量数据中心空间的服务器、交换机、路由器、存储系统和安全设备,如今都以虚拟机和虚拟网络设备的形式存在。这些设备给传统网络管理系统带来了巨大压力,因为…

作者头像 李华
网站建设 2026/4/16 5:38:11

StyleGAN2数据集制作5步终极指南:从零开始构建高质量训练数据

StyleGAN2数据集制作5步终极指南:从零开始构建高质量训练数据 【免费下载链接】stylegan2 StyleGAN2 - Official TensorFlow Implementation 项目地址: https://gitcode.com/gh_mirrors/st/stylegan2 你是否在为AI图像生成项目准备数据集时感到困惑&#xff…

作者头像 李华
网站建设 2026/4/16 5:45:48

实战突破:ollama-deep-researcher提示词定制指南

实战突破:ollama-deep-researcher提示词定制指南 【免费下载链接】ollama-deep-researcher Fully local web research and report writing assistant 项目地址: https://gitcode.com/GitHub_Trending/ol/ollama-deep-researcher 你是否曾经遇到过这样的困境&…

作者头像 李华