小红正在学习大模型分词算法。BPE 会先把字符串拆成单个字符 Token,然后不断合并当前出现频率最高的相邻 Token 对。 给定只包含小写英文字母的字符串 S 和最大合并次数 K,请模拟 K 轮 BPE 合并。 每一轮中,统计当前 Token 序列里所有相邻 Token 对的出现次数,选择出现次数最多的一对进行合并;如果存在多个最高频相邻对,选择在当前序列中第一次出现位置最靠前的一对。 选定相邻对后,从左到右扫描序列,所有不重叠的该相邻对都要被合并为一个新 Token。请输出最终 Token 序列。
第一行输入一个仅由小写英文字母组成的字符串 S。 第二行输入一个整数 K,表示最大合并次数。
输出最终 Token 序列,Token 之间用一个空格分隔,行末不输出多余空格。
hughug 1
h ug h ug
考点:模拟
限制 2 秒 / 256MB | 标准输入输出
参考方向:模拟
不涉及复杂算法,把题目描述的流程原样翻译成代码逐步执行即可。
思路框架(模拟 通法 · 非本题专属)
实现要点:结构上通常是一个外层循环包住若干 if/else 分支;只要状态定义清楚,正确率很高。
复杂度:时间 O(操作次数) | 空间 O(状态数)
该范式的通法易错点
本题在源数据中没有官方考点标签,方向由题面特征推断,仅供参考。
样例 1
hughug 1h ug h ug解析由校招宝本地引擎整理(依据源站考点标签 / 人工判题标注 / 题面规模信号),非官方题解,仅供思路参考。
本题来源:2026年-华为-05月13号AI岗。