正在加载视频...

视频加载失败

近期测试GLM 4.6在实际项目中的表现,以Claude Code API服务商的切换工具作为测试项目,其中码农工作量组成: 75% GLM 4.6 + 10% Claude Sonnet + 10% okooo5km + 5% KAT-Coder 大家需要这样的工具吗?此帖点赞如果超过 100 我就发布到Mac App Store😂

25,670 次观看 • 11 个月前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

Codex 5.6 真正与普通人拉开 90% 差距的,不是 prompt,而是你会不会配置 config.toml 很多人用 Codex 还停留在“打开就聊”,但真正重度使用的人,早就把模型、任务模式、项目规则和自动化流程写进配置里了。 现在 Codex 5.6 最值得折腾的 4 个专业设置: 1️⃣ 固定模型 + Reasoning Effort 别每开一个任务都重新选模型。 把默认模型和推理强度写进 ~/.codex/config.toml,日常任务追求速度,复杂架构任务再提高 reasoning effort。 输入prompt: 请检查我当前 Codex 5.6 实际支持的模型和 reasoning effort 配置,不要猜测或使用已经废弃的参数;然后修改 ~/.codex/config.toml,为日常 Coding 设置合理的默认模型与推理强度,并告诉我具体修改了哪些字段、为什么这样配置,最后验证配置是否成功生效。 2️⃣ 不同任务建立 Profile 写功能、修 Bug、Code Review、做系统架构,根本不应该用完全相同的配置。 Codex 支持 Profiles,可以针对不同任务切换不同工作模式。 配置用的prompt,直接用: 请基于我当前 Codex 5.6 配置创建 3 套 Profile:fast-dev 用于快速开发和小修改,code-review 用于 PR 和代码审查,deep-architecture 用于复杂系统设计;分别配置合适的模型、reasoning effort 和执行策略,不使用已经废弃的配置项,并告诉我之后如何通过 --profile 切换使用。 3️⃣ 给每个项目建立独立配置 全局配置解决“你习惯怎么工作”,项目配置解决“这个项目必须怎么工作”。 把技术栈、测试方式、项目约束和工具配置放进项目自己的 .codex/config.toml,不要每开新会话都重新解释。 直接输入: 请分析当前项目的技术栈、目录结构、测试方式和开发工具,为这个项目设计一份最小化的 .codex/config.toml,只写当前项目真正需要的配置,不覆盖无关的全局设置;完成后解释每项配置的作用,并检查项目级配置是否能够被当前 Codex 正确加载。 4️⃣ 用 Hooks 把规则变成自动执行 最浪费时间的方式,就是每次都提醒 Codex 改完记得跑测试、提交前记得检查、别忘了扫安全问题。 现在可以直接把这些规则做成 Hooks,在生命周期节点自动触发。Codex 当前官方配置已经支持 lifecycle hooks。 直接用这段: 请检查当前项目适合配置哪些 Codex lifecycle hooks,并为我建立最精简的一套自动化流程:代码修改完成后运行必要测试和 lint,关键变更执行安全检查,提交前执行最终验证;只配置真正必要的 Hook,避免重复执行和拖慢开发速度,完成后实际触发一次并验证每个 Hook 是否正常工作。 真正高效的 Codex 启动就知道该怎么工作。 赶紧配置试试吧!

govin.eth | G哥

154,237 次观看 • 27 天前

Anthropic推出了一项新功能,叫做“提示词改器”(Prompt Console)。 Claude 会使用思路链推理等提示工程技术自动对提示词进行改进,优化你的提示词,让AI的回答更准确、符合预期。 这项功能的主要作用: 1. 自动优化提示词:通过提示词改进工具,开发者可以让Claude模型自动优化现有的提示词(即向AI模型提出的问题或要求),以提高模型回答的质量。例如,工具会增加一个“链式思维”环节,让Claude在回答之前先有条理地思考问题,确保回答更精准。 2. 标准化和丰富示例:工具可以把提示中的示例转成统一的格式,比如XML格式,这样Claude更容易理解和处理。 3.示例增强:对现有示例进行自动补充,使其与结构化后的提示更加契合,包括增加链式思维的逻辑过程。 4.重写:对提示进行重写,明确其结构,并纠正小的语法或拼写错误,以提高提示的质量和易读性。 5.预填充:在Claude的助理消息中预填充内容,帮助引导Claude的行为,并确保输出格式符合需求。 一旦新提示生成,你还可以向Claude提供反馈,说明什么有效,什么不起作用,以进一步改进提示。 实际效果:根据Anthropic的测试数据,使用提示词改进工具后,模型的准确率在多标签分类任务中提升了30%,并且在摘要任务中能够100%完全遵循字数要求。

小互

39,813 次观看 • 1 年前