大模型领域 token 这个词, apple 的翻译

Ayanokouji 2026-08-11 14:09 1

token 这个词,苹果在不同地区采用了不一样的翻译。

大陆:词元,台湾:符元。你更喜欢哪一个?


说句题外话,为什么想到看苹果的翻译了呢。是想到了 memory 这个单词的翻译,大陆叫内存,台湾叫记忆体。


来源:苹果官网小字注释,可以搜 元 字。

https://www.apple.com.cn/macbook-pro/

Apple 于 2025 年 9 月使用试生产的配备 Apple M5 芯片 (集成 10 核中央处理器和 10 核图形处理器)、32GB 统一内存和 4TB 固态硬盘的 14 英寸 MacBook Pro 系统,已上市的配备 Apple M4 芯片 (集成 10 核中央处理器和 10 核图形处理器)、32GB 统一内存和 2TB 固态硬盘的 14 英寸 MacBook Pro 系统,以及已上市的配备 Apple M1 芯片 (集成 8 核中央处理器和 8 核图形处理器)、16GB 统一内存和 2TB 固态硬盘的 13 英寸 MacBook Pro 系统进行了此项测试。首个词元的响应时间通过运行一条包含 16K 词元的提示词测得,采用一个 80 亿参数模型 (4 位权重和 FP16 激活)、mlx-lm 和预发布版 MLX 框架。性能测试在特定电脑系统上进行,能够大致反映 MacBook Pro 的性能。


https://www.apple.com/tw/macbook-pro/

測試由 Apple 於 2025 年 9 月使用配備 Apple M5 、10 核心 CPU 、10 核心 GPU 、32GB 統一記憶體、4TB SSD 的預量產 14 吋 MacBook Pro 系統;以及配備 Apple M4 、10 核心 CPU 、10 核心 GPU 、32GB 統一記憶體的已量產 14 吋 MacBook Pro 系統,和配備 Apple M1 、8 核心 CPU 、8 核心 GPU 、16GB 統一記憶體的已量產 13 吋 MacBook Pro 系統進行,所有系統皆配置 2TB SSD 。首個符元的生成時間是以一個含 16K 符元的提示詞,使用 80 億參數模型 (採用 4 位元權重與 FP16 活化值)、mlx-lm 和測試版 MLX 架構測量所得。效能測試使用特定電腦系統進行,可反映 MacBook Pro 約略效能。


https://www.apple.com/macbook-pro/

Testing conducted by Apple in September 2025 using preproduction 14-inch MacBook Pro systems with Apple M5, 10-core CPU, 10-core GPU, 32GB of unified memory, and 4TB SSD, as well as production 14-inch MacBook Pro systems with Apple M4, 10-core CPU, 10-core GPU, and 32GB of unified memory, and production 13-inch MacBook Pro systems with Apple M1, 8-core CPU, 8-core GPU, and 16GB of unified memory, all configured with 2TB SSD. Time to first token measured with a 16K-token prompt using an 8-billion parameter model with 4-bit weights and FP16 activations, mlx-lm, and prerelease MLX framework. Performance tests are conducted using specific computer systems and reflect the approximate performance of MacBook Pro.
最新回复 (19)
  • tgfbeta 08-11 14:16
    1
    文元,就是丁文元,王德成的那个。
  • yidinghe 08-11 14:23
    2
    叫偷啃算了
  • MIUIOS 08-11 14:26
    3
    爱叫啥就叫啥,懒得吵,有人喜欢叫令牌,有人喜欢叫词元,我直接一步到位,直接叫活珠子
  • g0blin 08-11 14:34
    4
    @MIUIOS 这是真 ikun
  • edgeedge 08-11 15:50
    5
    符元,感觉更有想象力、道家味道,联想符文、道家福禄,能驱使神秘力量

    词元有种正统、规规矩矩的感觉,儒家味道。感觉会联想到:词牌,元曲…这些词
  • enpitsulin 08-11 16:42
    6
    都可以接受,不过确实「符元」听着有点神叨叨的😂
  • Tink 08-11 16:44
    7
    符元还不如词元呢,什么玩意
  • ZRS 08-11 16:45
    8
    考虑到 token 是各种不同模态数据的抽象编码方式,叫词元过于狭隘

    符元更符合本意 也可以叫智元
  • zq11211277 08-11 16:45
    9
    应该造一个字,想当年没有 “砼” 来对应混凝土
    现在也需要造一个字来代替 token 那么就是 ”电仝“ 也读作 tong
  • xuanbg 08-11 16:53
    10
    「符元」很棒!提示词和画符也没差
  • sodesga 08-11 16:54
    11
    App 、Wi-Fi 、URL 这类也给安排上, 阿拉伯数字最好也用老祖宗的大写壹贰叁肆。🤣
  • zhmouV2 08-11 16:58
    12
    词元并非官方硬点才有的翻译。。。
  • Ayanokouji 楼主 08-11 18:02
    13
    我只是给个翻译的参考,大家有别的地方的翻译,也可以贴出来。我个人和别人交流都不翻译的
  • zhengqiang64 08-11 18:21
    14
    目前看,算元这次,最为贴切,其次我觉得词元也符合,符元我觉得就抽象了,符代表啥?符号?那不应该叫字元更适合?
  • docx 08-11 18:24
    15
    怎么每天都能有这个话题的帖子,想用啥用啥,能看懂就行了……两边争不出个答案的
  • unneeded 08-11 18:26
    16
    llm 的 token 你说词元说就说了,其他的 token…
  • charlie21 08-11 18:33
    17
    LLM 里的 token 其实就是 LLM 分词单位,它作为一个单位 用处很多,比如 LLM 的输出总长度是按照 LLM 输出的总分词单位数量(输出的总 token 数量)计算的
  • tgfbeta 08-11 19:19
    18
    @Tink token 编组的根本不是词,是文。所以,文元。
  • dacapoday 08-12 07:45
    19
    词元太狭隘,不能因为 NLP 用途出圈,就把其他用途也错用为词。符元其实最贴切,因为本就是代币,符号背后是字符,像素,音节都行,本就是抽象单元。
* 帖子来源V2EX
返回