Skip to content
  • 0 Votes
    1 Posts
    131 Views
    A
    <p>以下介绍如何在 Codex 中为 GPT-5.6 Sol 启用 100 万 Token 上下文窗口。</p><p>尽管我们已对 Codex 的上下文限制进行了调优,以在性能和成本之间取得最佳平衡,但这是一个常见需求,因此在此记录配置方法。</p><p>更大的上下文窗口可让 Codex 在汇总较早内容之前保留更多代码、工具输出和对话历史。你需要使用支持该功能的模型。例如,GPT-5.6 Sol 的文档中标注了 1,050,000 Token 的上下文窗口。</p><p>打开 ~/.codex/config.toml,并在顶层添加或更新以下设置,放在任何 </p><p></p><p>[section] 标头之前:</p><p></p><p>model = "gpt-5.6-sol"</p><p>model_context_window = 1000000</p><p>model_auto_compact_token_limit = 900000</p><p></p><p></p><p>第一项设置用于选择模型。第二项告知 Codex 使用 100 万 Token 的上下文预算。第三项会在约 900,000 Token 时开始自动压缩历史记录,从而预留一些余量。保存后,重启 Codex 客户端并开启一个新会话。</p><p>若要在不更改默认设置的情况下,仅为单个 CLI 会话尝试此配置:</p><p></p><p></p><p>codex -m gpt-5.6-sol \</p><p> -c model_context_window=1000000 \</p><p> -c model_auto_compact_token_limit=900000</p><p></p><p></p><p>尽情使用,不过也请注意:我们已经认真调优了默认设置!</p><p></p><p>来自 Tibo:<a target="_blank" rel="noopener noreferrer nofollow" href="https://x.com/thsottiaux/status/2089082893804896524">https://x.com/thsottiaux/status/2089082893804896524</a></p><p></p>
  • 0 Votes
    1 Posts
    8 Views
    A
    引言 最近,一些用户注意到了一个不寻常的情况: “我只是发送了‘Hi’,为什么却消耗了 10,000+ 个 token?” 乍一看,这似乎有些出人意料。两个字符的消息,按理说应该只需要很少的 token,对吧? 答案是:模型处理的不仅仅是你看到的那条消息。 现代 AI 助手,尤其是像 Codex、Claude Code 以及其他基于 IDE 的 AI 编码代理,通常会在你的消息之外,一并发送更多信息,以帮助模型理解任务并提供更好的回答。 你的消息只是上下文中的一小部分 当你发送: Hi 实际发送给 AI 模型的请求,更可能像这样: System Instructions + User Settings + Configured Skills + Available Tools + Project Information + File Context + Previous Conversation History + Your Message: "Hi" 所有这些组成部分的总大小,才是模型实际处理的上下文。 因此,即使是一条非常短的消息,也可能消耗大量 token。 什么会增加上下文使用量? 1. 已配置的技能 如果你启用了自定义技能或 AI 能力,那么这些技能的指令也需要被加载进模型上下文。 例如: Skill A instructions: 2,000 tokens Skill B instructions: 3,000 tokens Skill C instructions: 1,500 tokens 甚至在你还没有输入任何内容之前,这些指令可能就已经占用了数千个 token。 2. 工具与代理能力 AI 编码助手通常会提供如下工具: 文件读取 代码搜索 终端执行 Git 操作 浏览器访问 外部集成 这些工具的定义和使用说明,同样会占用上下文空间。 3. 项目与文件上下文 当你在 IDE 或代码仓库中工作时,AI 客户端可能会自动附带: 项目结构 已打开的文件 代码片段 依赖项 配置文件 这能帮助 AI 理解你的项目,但也会增加上下文使用量。 4. 之前的对话历史 如果你是在继续一个已有对话,先前的消息通常会再次被一并发送,以便模型理解上下文。 例如: Previous discussion: 12,000 tokens New message: Hi 那么新的请求中,仍然可能包含前面的 12,000 个 token。 如何测试最小 Token 使用量 如果你想测量一条简单消息的 token 用量,请尝试以下方法: 创建一个全新的对话。 关闭自定义技能。 不附加文件。 不打开项目工作区。 只发送: Hi 这样可以更接近地观察最小上下文使用量。 上下文窗口 vs Token 使用量 有必要区分以下两个概念: Context Window 模型在一次请求中最多能够处理的信息量。 例如: 1M token context window 这表示模型理论上最多可处理 100 万个 token。 Token Usage 某一次具体请求中,实际包含的 token 数量。 例如: User message: Hi Actual request: System instructions + tools + history + "Hi" Total: 15,000 tokens 较大的上下文窗口,并不意味着每次请求只会消耗与你消息长度相当的 token。 结论 短消息带来的高 token 消耗,并不一定意味着模型或 API 出现了问题。 在 AI 代理环境中,总上下文通常包含许多为了实现智能操作而必须附带的隐藏组成部分。只发送一句简单的“Hi”,如果当前会话中还包含技能、工具、项目信息或历史记录,依然可能导致模型处理数千个 token。 如果你想测试最原始的 token 用量,我们建议在没有额外上下文的干净会话中进行测试。 感谢你的理解与持续支持。
  • 0 Votes
    2 Posts
    193 Views
    A
    已恢复