Loading video...

Video Failed to Load

Go Home

Codex 5.6 能省下 80% 重复 token 的技巧:能缓存的,就别让它重新读第二遍 很多人在用 Codex 进行vibe coding的时候,每次任务都让模型重新读一遍,项目说明、技术架构、测试规范、固定 Prompt 这就是在白烧 Token 正确做法是:动态信息让 Codex 直接看,静态信息让缓存背。 你可以直接丢这段 Prompt: “请先分析当前项目,把长期不变的项目背景、技术架构、编码规范、测试规则、固定业务约束等内容识别并整理成精简的静态上下文,后续任务优先复用这些已有信息,不要重复读取或重新总结;只有出现新需求、代码修改、新文件、报错日志、测试结果或运行结果等动态变化时才重新读取,并且每次执行任务前告诉我本次复用了哪些静态上下文、新读取了哪些动态信息,以及哪些内容无需重复读取,在保证准确性的前提下尽可能减少重复上下文和 Token 消耗。” 这样做的好处很直接: 1️⃣ 少读重复内容,Token 消耗大幅下降。 2️⃣ 上下文更干净,Codex 能把注意力放在真正变化的代码和需求上。

142,792 views • 1 month ago •via X (Twitter)

0 Comments

No comments available

Comments from the original post will appear here

Related Videos

Codex 5.6 这 4 个设置,能砍掉 80% 无效 token 浪费,复杂长任务效率还能提升 70% 很多时候不是模型不够强,而是你的上下文、缓存和工具配置正在拖后腿。 1️⃣ 尽量吃满 prompt cache 固定不变的项目规则、AGENTS.md、开发规范、长期 prompt 放前面,经常变化的需求放后面。这样更容易命中缓存,减少重复计算和重复上下文token消耗。 2️⃣ 长任务要及时压缩上下文 不要让日志、失败方案和旧历史一直堆在会话里。 直接输入prompt: “请整理当前任务上下文,清理失效方案、重复日志和无关历史,只保留当前目标、关键决策、核心约束、当前进度、未解决问题和下一步行动,后续基于最新摘要继续执行。” 3️⃣ MCP 不要装一堆不用的 Browser、Figma、GitHub、文档 MCP 都很强,但工具越多,上下文负担也越大。当前项目需要什么,就加载什么,别让一堆无关工具长期占着上下文。 4️⃣ 保持项目配置稳定 不要频繁切模型、工作目录、工具配置和开发规则。稳定的 prompt、稳定的工具链和固定项目结构,更容易持续复用缓存,也能减少 Agent 反复重新理解项目。 真正高效的 Codex 工作流: 高缓存命中 → 干净上下文 → 必要工具 → 稳定配置 很多时候 Codex 不需要再变强,你只需要做的,就是别再浪费它的上下文。

govin.eth | G哥

219,312 views • 1 month ago

Codex 5.6 必装 Obsidian,直接给 AI 装上安全免费的本地永久记忆库! 很多人想给 AI 增加长期记忆,但又担心云端 Memory 成本、隐私和数据安全问题 今天我找到了正确的解决方法:让 Obsidian 成为 Codex 的外部知识中枢,让Codex 根据当前需求检索相关知识;完成任务后,再把新的经验、结论和变化同步回知识库。 检索知识 → 执行任务 → 沉淀经验 → 优化知识库 直接用下面这段prompt(提示词): “请将当前 Obsidian 知识库作为我的跨项目长期记忆系统,为所有项目建立统一索引和知识结构。持续整理并维护项目背景、长期偏好、关键决策、已完成内容、当前进度、失败方案、踩坑记录、技术方案和下一步计划。 每次开始新任务前,先检索 Obsidian 中与当前任务相关的笔记,补充必要上下文后再执行任务;任务完成后,将新增的结论、重要决策、代码变更记录和项目进度同步更新到对应文档。 只保留未来有价值的信息,避免记录无关对话、重复内容或临时信息;不要保存密码、api Key、token 等敏感信息。” 还可以创建个自动化流程: “每次完成重要任务后,让 Codex 自动提取本次开发中的关键经验,包括技术决策、解决方案、踩坑原因和可复用方法,沉淀回 Obsidian,持续完善项目知识库。” 随着项目不断推进,Obsidian 不只是存储文件,将逐渐成为属于你的 AI 知识库大脑。

govin.eth | G哥

305,730 views • 1 month ago

Codex 5.6 真正与普通人拉开 90% 差距的,不是 prompt,而是你会不会配置 config.toml 很多人用 Codex 还停留在“打开就聊”,但真正重度使用的人,早就把模型、任务模式、项目规则和自动化流程写进配置里了。 现在 Codex 5.6 最值得折腾的 4 个专业设置: 1️⃣ 固定模型 + Reasoning Effort 别每开一个任务都重新选模型。 把默认模型和推理强度写进 ~/.codex/config.toml,日常任务追求速度,复杂架构任务再提高 reasoning effort。 输入prompt: 请检查我当前 Codex 5.6 实际支持的模型和 reasoning effort 配置,不要猜测或使用已经废弃的参数;然后修改 ~/.codex/config.toml,为日常 Coding 设置合理的默认模型与推理强度,并告诉我具体修改了哪些字段、为什么这样配置,最后验证配置是否成功生效。 2️⃣ 不同任务建立 Profile 写功能、修 Bug、Code Review、做系统架构,根本不应该用完全相同的配置。 Codex 支持 Profiles,可以针对不同任务切换不同工作模式。 配置用的prompt,直接用: 请基于我当前 Codex 5.6 配置创建 3 套 Profile:fast-dev 用于快速开发和小修改,code-review 用于 PR 和代码审查,deep-architecture 用于复杂系统设计;分别配置合适的模型、reasoning effort 和执行策略,不使用已经废弃的配置项,并告诉我之后如何通过 --profile 切换使用。 3️⃣ 给每个项目建立独立配置 全局配置解决“你习惯怎么工作”,项目配置解决“这个项目必须怎么工作”。 把技术栈、测试方式、项目约束和工具配置放进项目自己的 .codex/config.toml,不要每开新会话都重新解释。 直接输入: 请分析当前项目的技术栈、目录结构、测试方式和开发工具,为这个项目设计一份最小化的 .codex/config.toml,只写当前项目真正需要的配置,不覆盖无关的全局设置;完成后解释每项配置的作用,并检查项目级配置是否能够被当前 Codex 正确加载。 4️⃣ 用 Hooks 把规则变成自动执行 最浪费时间的方式,就是每次都提醒 Codex 改完记得跑测试、提交前记得检查、别忘了扫安全问题。 现在可以直接把这些规则做成 Hooks,在生命周期节点自动触发。Codex 当前官方配置已经支持 lifecycle hooks。 直接用这段: 请检查当前项目适合配置哪些 Codex lifecycle hooks,并为我建立最精简的一套自动化流程:代码修改完成后运行必要测试和 lint,关键变更执行安全检查,提交前执行最终验证;只配置真正必要的 Hook,避免重复执行和拖慢开发速度,完成后实际触发一次并验证每个 Hook 是否正常工作。 真正高效的 Codex 启动就知道该怎么工作。 赶紧配置试试吧!

govin.eth | G哥

154,237 views • 1 month ago

你是看不懂 Codex 里面那些英文技能是什么意思,对吧?​ 那就让它直接全部汉化。​ 不只是翻译名字,最好连每个技能的作用、什么时候用,也一起说明白。 如果你的 Codex 技能/工具列表里还有很多英文名称,可以让 Codex 帮你做一次本地中文化整理。 提示词: 请帮我检查本机 Codex 技能/插件列表里仍然显示英文的名称和说明,并把它们改成中文显示。 要求: 1. 先扫描以下目录里的技能和插件元数据: - C:\Users\Admin\.codex\skills - C:\Users\Admin\.agents\skills - C:\Users\Admin\.codex\plugins\cache - C:\Users\Admin\.codex\cache\remote_plugin_catalog 2. 重点检查: - display_name - short_description - 缺少 agents/openai.yaml 的技能目录 - 远程插件目录缓存里的 interface.display_name 和 interface.short_description 3. 对仍然是英文的技能名和说明,补充或改成自然中文。 例如: - Figma Code Connect → Figma 代码连接 - CI Debug → CI 调试 - Branded Presentation → 品牌演示文稿 - Channel Summarization → 频道总结 - BigQuery Data Transfer Service → BigQuery 数据传输服务 4. 不要改 SKILL.md 里的核心触发描述,除非确实需要;优先只改 agents/openai.yaml 和远程目录缓存里的显示字段,避免影响技能调用。 5. 修改前先备份相关目录,方便回滚。 6. 修改后重新检查: - 缺少 agents/openai.yaml 的技能数量是否为 0 - 纯英文 display_name 数量是否为 0 - 纯英文 short_description 数量是否为 0 7. 最后告诉我改了哪些类型的内容、备份在哪里、是否需要重启 Codex App 刷新缓存。

阿良|AI 工作流

17,733 views • 3 months ago

Claude有个很让人不爽的点!! 每次新模型发布,官方非订阅用户连体验的资格都没有!! 想起之前在 ZenMux 充了钱还没用完,登上去一看,没想到已经上架了Claude Fable 5 , 也算是第一时间体验上了这个“目前最强模型”。 听说这模型死贵!! 于是很慎重的用它跑了一个支付模块重构的任务! 零代码基础,只能把之前Codex的输出给复制进去, 任务要求比较复杂: 保持原 API 兼容; 拆出 PaymentRequested / PaymentSucceeded / PaymentFailed; 补幂等,避免重复扣款; 改状态机; 更新单测; 输出迁移风险; Fable 5 不算快,面对这个长任务,它做对了两件事: 第一,先拆计划,再执行。 它把兼容层、事件定义、状态机、handler、测试、回滚风险都列出来了。 第二,最后主动自检。 它自己指出:支付成功事件必须幂等;旧接口“返回成功”不再等于“扣款完成”,调用方文档要改。 结果看起来,还是一如既往的稳! 但是真的贵,就这么几分钟,直接跑了十多美金!! 所以,我觉得要是家里没有矿,还是不要随便用Fable 5 ,根本不适合当常驻模型! 感谢Zenmux让我体验了一下“宇宙最强”! 虽然有点贵,但有时候相比价格,省心省力会更重要。 比如多文件重构、复杂迁移、PR review、长链路 Agent workflow这些复杂任务,偶尔用用,还是可以的! 最后说一下 Zenmux,它有个PK 模式我一直很喜欢,可以同屏对比多个模型输出、延迟和成本。 现在刚好还有个限时的充值返赠活动: 充 20 美元送 10 美元 充 50 美元送 30 美元 如果你想第一时间体验Claude Fable 5或者其他模型,现在就是下手的最好时间!

沐阳

15,442 views • 3 months ago

刚去小米店摸了下它的折叠机有感,大家有没有注意到在安卓这边折叠机都叫“Fold”,而苹果选了“Duo”。 其实从字面意思来看,Fold就是折叠,强调这个动作,很直观,但苹果使用了Duo这个从拉丁语来的词,它其实是有一组,一对的意思,是个组合。重点从“能折”转到“两种体验(一个手机两个形态,手机+iPad)是一对、能一起用合二为一,强调的是体验。 现在在回过头来看苹果的那个折叠动画,就解释了这个Duo,它从手机形态打开到iPad形态,或者反过来闭合起来,动画是连续的,强调只是变了形态,从人的大脑认知来看也是一样,你看到的东西没有消失后又出现一次。并没有安卓那样,从一个形态关闭后,又重新打开了另一个形态,中间过程不连续,是断开的。所有安卓折叠机都是这样,你在外屏打开一个app,在展开的时候,内屏是从黑到重新打开app的一个过程。所以并不能简单理解苹果的和其它安卓在这方面,就是多做了个过场动画那么表面。 另外苹果在这个时候推出Duo,一个呢,当然也是供应链技术发展到了苹果认为相对成熟的时候,二呢,也是它的AI布局,目前Apple Intelligence在今年也会迎来大更新,苹果相信在手机+iPad这个二合一的组合形态下,人们可以更好的体验AI的各种操作。简单的任务可以在手机形态下进行,复杂点的比如Codex和Claude这样的编程任务,也方便在iPad这个形态下进行。 如果说安卓或者是更早的微软Surface Duo开启了折叠这个形态,那么Apple可以说是重新定义了它。后续发展会更有意思,感谢自己处在这个科技飞速发展的时代,可以亲自见证这些迭代的过程。 当然我个人现在并不会买第一代的Duo,毕竟它相机过于拉胯了,这个是我个人非常看重的一个工具。 大家Enjoy!😊

小鹏Digital

28,951 views • 22 days ago