Codex老是把中文读成乱码,然后发现乱码又知道修改读取时的编码,浪费token,有什么建议?

kkqy 2026-06-25 08:25 1

同样是GPT 5.5 ,我用OpenCode就没这个问题,反倒是它自家的Codex经常出这个问题。

我看很多人都说的写项目提示词,要求AI每次读取都用UTF-8。

适合写入全局提示词吗?

最新回复 (16)
  • suyi92 06-25 08:27
    1

    或者直接把文件格式改为UTF-8,codex就能直接读写正常中文了

  • AstralDream 06-25 08:29
    2

    1. 所有新建和修改文件必须保存为 UTF-8 编码,不要改变现有中文文本编码,读取和写入文件时显式使用 UTF-8。

    2. 关于文件写入的规则:需要分块执行;每次写入不超过 300 行;每次写入不大于 12000 字。


    文件写入失败的,在claude.md中加上这个就行了,agents.md也适用

  • Abyte 06-25 08:30
    3

    可以参考下这个,需要改个编码


    最近电脑重装了win11系统,忘记了codex还有中文乱码问题,之前使用的方案是修改系统设置,改编码为utf-8。这个方案一直认为不太好,正好这次改成PowerShell7。顺便记录一下,方便下次配置。

    安装PowerShell7

    CMD或PowerShell执行:
    winget install --id Microsoft.PowerShell -e

    验证:
    pwsh -v

    设…
  • XTer 06-25 08:30
    4

    Windows有一个开关


    叫beta什么的,反正开了以后默认就按UTF8编码了

  • Duolingo 06-25 08:30
    5

    可能是你的文本文件编码的问题吧,AI默认就会用UTF-8读,一般工具也是默认UTF-8。建议检查一下文件的编码。之前改一个很老很老的编码混杂UTF-16 LE BOM和GBK的项目的时候发现AI以及工具都会默认用UTF-8读,反而是别的编码要写进提示词

  • qyy 06-25 08:40
    6

    我也是这样,让他做事,一直输出什么乱码编码相关的日志,在那里浪费token自己改,还有时候一个中文文档中间夹杂着字段英文,这算降职了嘛

  • Mckenzie Vandebrink 06-25 08:40
    7

    wsl中用的话就没有这些问题了,不过如果用git的话得让它用Windows中的git不然每次读工作区都会把换行读成modify

  • niming 06-25 08:41
    8

    启动终端时先 chcp 65001,或者修改系统设置,AI 知道怎么搞的。让 AI 告诉你就行了

  • 娜娜米 06-25 08:47
    9

    不过正常情况下都会默认用 UTF-8 读吧,至少我是没遇到过你的这种情况

  • 娜娜米 06-25 08:48
    10

    这个其实不建议开,开了之后反而部分应用容易出现问题,比如图吧工具箱

  • jixule 06-25 08:51
    11

    用wsl就不会出现中文乱码的情况,然后在全局AGENTS.md里面写一下,忽略行尾符号的 git 差异,要不然整个仓库可能都会被误识别为有改动

  • なののの 06-25 08:54
    12

    我一直是写在AGENTS.md里面的,告诉他任何操作都要使用UTF-8编码,后面就没这个问题了

  • lukezh 06-25 09:01
    13

    最好的办法是别在 Windows 中开发 直接在 Windows 中装个 linux 虚拟机

  • JackRong 06-25 09:09
    14

    装个pwsh,不要用powershell,powershell的utf-8编码支持的不好

  • xiaonuozi 06-25 09:25
    15

    佬,你看一下那个powershell的版本,要更新到powershell7,这个原生支持utf-8

  • 栀子花 06-25 09:29
    16

    是这样的,windows开了这个能解决你现有的问题,但是有部分原来没问题的又会出问题,有些甚至不是文件里面,有些文件夹的名字都会变乱码

* 帖子来源Linux.do
返回