Загрузка видео...

Не удалось загрузить видео

На главную

Codex 这个用法一定要改,结果会好一个量级 90% 的人都把 Codex 当神仙了,一上来就直接 /goal: 帮我写一个 App,实际上它很难理解你的具体需求 分享一条OpenAI研究员 Vaibhav (VB) Srivastav 都在用的技巧:先让 Codex 做 research,再根据结论设置一个合适的 /goal,而不是一上来就直接 /goal 例如: 我要开发一个 XXX。 暂时不要写代码。 先帮我做 requirements gathering 和 research: 这个问题的核心约束是什么 有哪些成熟方案 / 同类实现可以参考 主要技术风险和容易踩的坑 最小可交付版本应该包含什么、排除什么 把调研结果整理清楚后,再根据结论 set 一个合适的 /goal 你也可以跟 Codex 对话: 1️⃣ 把需求和边界问清楚 2️⃣ 把现有方案和风险摸透 3️⃣ 再锁定一个真正可执行的 goal 等...

62,918 просмотров • 1 месяц назад •via X (Twitter)

Комментарии: 0

Нет доступных комментариев

Здесь появятся комментарии из оригинального поста

Похожие видео

卧槽,答案终于揭晓了! 那个在open router上持续霸榜的神秘模型,是阿里推出的全新大模型“蚂蚁百灵”!今天我们来深度聊一聊这个模型。 用过AI来完成前端开发的朋友肯定懂: 要让AI做出想要的UI总是要找参考,再不然就是要依赖设计 skill 的帮助。 但这种界面一旦看多了,就会陷入审美疲劳。 原因在于不管你是对标UI还是使用skill,结果都是被限定在固有的生成范围内。 最近小灰测了新模型 Ling-2.6-1T (由蚂蚁集团 Ant Ling 开发),发现它刚好就能打破这个限制。 它生成的页面不仅审美极度在线,而且自带高质量的交互效果,做出来的东西终于不再是干巴巴的呆板网页了。 但用它有个必须要避开的坑:Ling 2.6 1T 默认是没有深度思考模式的。 它在计算资源分配上极其克制,如果你偷懒丢一句"给我写个好看的界面",那么它大概率会给你一个准确但极其敷衍的结果。(视频1) 那么怎么取巧使用它? 小灰分享一个能逼出它真实设计水平的实操工作流:把它当成主规划师,先拆解风格,再写代码。 跟它对话时,你可以直接下这种指令: 1. 强制思考:先别急着写代码!帮我分析这个产品的定位,明确它的视觉情绪、色彩规范和排版布局,把思路列出来。(比如明确告诉它你要包豪斯风格或者北欧风)。 2. 落地执行:等它把设计语言梳理清楚,你确认没问题了,再让它基于这套标准去生成具体的 TailwindCSS 样式和前端页面。 用这种先 Plan 后做的方式,出来的页面不仅美观,而且风格极其统一。(视频2) 目前在Openrouter中可以免费体验该模型。 选对工具打破模板限制,用高审美的模型直接拔高视觉质感,能帮我们省下大把死磕 CSS 的时间。 期待大家都能快速做出让人眼前一亮的作品!

程序员小灰

15,021 просмотров • 5 месяцев назад

我让 AI 找一个值得做的产品,它盯上了律师账单里的 6 分钟 最近用 AI 做产品调研时,我越来越明显地感觉到一个问题: 信息并不缺,缺的是判断。 问“下一个 AI 机会在哪里”,很容易得到一长串听起来都对的答案:AI 法务、AI 财务、AI 营销、AI 编程…… 但真正准备行动时,还是不知道哪个需求真实存在,哪个只是被反复包装的趋势。 所以这次我换了一种问法。 我让 AI 从用户抱怨、产品评论、GitHub Issues、行业报告和现有产品中寻找信号。每提出一个方向,还必须主动寻找反证:竞争太强、付费意愿不足,或者已经有成熟工具解决,就淘汰。 它一共比较了12个方向。 广告上线前 QA 的损失很直接,但链接和落地页检查已经有成熟工具;AI 代码审计的痛点很强,但市场拥挤,而且人仍然可能需要逐行复核;财务对账高频,却绕不开数据权限和“到底以哪个系统为准”的问题。 最后留下的,是一个我原本完全没有想到的场景: 律师的工时记录与账单叙事(比如美国的法律服务)。 许多按小时计费的律师以0.1小时,也就是6分钟为单位记账。会议、邮件、电话和文档修改结束后,他们还要回忆自己做过什么、匹配案件、补记时间,再把记录改成客户能够接受的账单描述。 AI 在这里不需要替律师做法律判断。 它只需要把日历、邮件和文档活动整理成带来源的候选记录,再由律师确认、修改或删除。 它真正解决的也不是“写得更快”,而是减少漏记、降低审核返工,并让每条收费描述都有依据。 这次测试用的是 Apodex。它里面的 Deep Discover 最让我意外的地方,不是能生成多少想法,而是会主动反驳自己的想法,把一个宽泛的问题逐步收敛成可以验证的假设。 它也没有把这个结果包装成确定的创业机会,而是给出了一套30天验证方案:访谈律师和 billing manager,用脱敏样本测试草稿编辑时间,再验证是否真的有人愿意进入付费试点。 如果律师不愿开放数据、修改草稿和自己重写一样费时,或者现有软件已经够用,那这个方向就应该停止。 我觉得这才是这次测试最有价值的地方。 它没有替我宣布一个答案,而是帮我排除了一批看起来正确的答案,最后告诉我: 下一步最值得验证什么,以及出现什么结果时应该放弃。 有时候,真正有用的 AI 不是让人更快得到结论,而是让一个模糊的问题,终于有了可以行动的下一步。 Open Source Harness: Open Weights: Website:

Ashlyn He

15,534 просмотров • 1 месяц назад

说个暴论,你的审美和品味就是你的提示词,并决定了你使用AI的上限。 咱们看看这个案例, 零游戏开发经验,两周时间, 一个人,做出了一个完整可玩的3D外卖配送游戏🆒 主角是一只戴粉色头盔的卡皮巴拉, 骑着电动车在城市里穿梭接单, 订单会真实堆叠在后座,掉了就会失败, 还有完整的手机App导航和超市捡货系统, 很多人看完第一反应都是AI太厉害了,但其实并不是是AI的胜利, 本质是人类品味的胜利, 他没写几行代码, 所有的逻辑模型贴图音乐音效, 全都是AI生成的, 他只做了3件事, 1️⃣告诉AI我想要一个卡皮巴拉送外卖的游戏, 2️⃣然后在AI生成的一万个版本里, 3️⃣选出那个看起来最好玩的, 最后花两周时间一点点打磨细节, 调参数摆道具改手感, 其实这就是现在大家说的vibe coding, 让AI接管了所有的执行层, 人类只需要负责方向和品味, 以前你得学会编程建模配乐剪辑, 才能做出一个游戏, 现在你只需要知道, 什么东西是好的, 很多人说这是作弊, 但这才是真正的创意民主化呀, 一年前需要一个小团队干几个月的活, 现在一个普通人两周就能搞定, 我相信未来会有无数这样的作品冒出来,创意会比技术重要一百倍甚至更多。 这也回答了那个很多人都在问的问题, AI时代人类到底还有什么用❓ AI确实能生成一切, 但它不知道的是 什么东西看起来舒服, 什么东西玩起来爽, 什么东西能让人会心一笑, 比如那些纯AI生成的游戏为什么不好玩, 因为它们只有技术,没有灵魂, 那什么是灵魂呢? 我理解灵魂就是那个站在AI背后, 做每一个微小选择的人, 就是那个知道什么时候该停手, 什么时候该再改一下的人, 而且我觉得这只是一个开始, 今天是浏览器3D游戏, 那明天可能就是完整的App, 后天甚至是3A级别的游戏原型, 我们正在见证一个全新的创作时代, 任何人都能把自己的脑洞, 变成真正的产品, 游戏链接放在评论区了, 直接浏览器打开就能玩, 建议大家去试试, 你会真切地感受到, 那个属于普通人的创作黄金时代, 真的已经来了! #AI #游戏开发 #vibecoding

阿绎 AYi

12,095 просмотров • 5 месяцев назад

我去!image2和seedance2.0简直绝配 还记得在视频号上「流量上百万」靠流量日入过千的机器人变形视频吗 现在又有羊毛可以薅了 而且光变现就有两种方式,第一种直接发布这种视频,我能赚流量的钱 第二种,那通过这个视频会有很多的商家来找我给他们做,一单200,这个是我验证过的 而且获客也很简单,发两条在自己的视频号上就可以了,土老板很喜欢这个,做出来的视频样式就在下面 而且这个平台是「字节官方开白名单的平台」我一定要推荐一下! 就是之前我推GPT会员购买的GamsGo做出来的rita 真的一定要去试一下,链接我放下面了,而且这是我实际接到的第一个需求,后面还有一个需求,我下一条就马上写出来给你。真的AI赚钱很轻松 而且 Rita 不只是视频生成这一个功能,它一站式集成了 Seedance 2.0、Kling、Runway 这些视频模型,还有 Midjourney、Flux 、image2这些生图模型,Claude、GPT、Gemini 这些对话模型 一个平台搞定全部,不用在五六个工具之间反复横跳,效率真的不是提升一点 还有一点很实在:新人注册直接送 100 积分,Seedance 2.0 可以先体验再决定要不要付费 Mega 套餐 $11.99 一个月,1200 积分,算下来比官方便宜不少,试错成本低很多。 想试试的直接点这个链接,有什么问题直接评论区反馈给我!:

叫我阿杭

60,231 просмотров • 5 месяцев назад

最近我用了 Grok Bot 一段时间,这是我最近最喜欢的 Agent 产品之一。 原因甚至不是 Grok 有多聪明。 是它真的有一台自己的电脑。 AI Agent 的最终形态,其实就是给 AI 发一台电脑。 xAI 给 Grok Bot 配了一台持续存在的云电脑,里面有浏览器、文件系统和终端。登录状态、文件、浏览器 Session 都会留下来,你把电脑关了,它也可以继续干活。 听起来只是一个产品功能,实际用起来,我觉得它把 Agent 的体验往前推了一大截。 比如我每天都要刷 X。 以前让我用 AI 帮忙看 X,工作流通常是这样的: 我刷到一条东西,复制给 AI;AI 觉得有意思,我再去找原帖;再开几个链接;再把资料复制回来;让它查证;最后再让它帮我写。 AI 干了很多活,但真正操作互联网的那个人一直是我。 Grok Bot 让我第一次很自然地把这部分也扔掉了。 我直接在它那台电脑上把 X 登录好,然后告诉它去刷我的 timeline,看看今天大家在讨论什么,发现有意思的东西就点进去,把原帖、引用、相关讨论都看一遍,再去外面查资料,最后觉得值得写的,帮我整理成帖子。 它就真的去操作浏览器了。 网页没有 API 没关系,没有 MCP 也没关系。只要人能打开网页、登录、点击,它就有机会自己完成。xAI 自己对 Grok Bot 的定义其实也很明确,它可以登录并使用网站和 App,用 computer use 处理那些没有干净 API 的软件。 这才是 Agent 真正重要的一步。 过去一年大家一直在给 Agent 加工具,Search、Browser、Code、MCP、Connector… 工具越来越多,可我的体验经常还是我才是所有 Agent 背后那个最累的 Agent。 我同时开着好几个 AI。这个查资料,那个写代码,另一个做图,还有一个跑 Deep Research。 A 做完以后我复制给 B,B 做完以后再扔给 C。 名义上我有一支 AI 团队,实际上我是这支团队里专门负责复制粘贴、开网页和催进度的项目经理。 Grok Bot 有一个特别戳我的能力**,它甚至可以去操作另一个 Agent。** 我可以在它的浏览器里登录其他 AI 产品,然后告诉 Grok Bot 这个任务你去交给它。 等它跑完,把结果拿回来,然后继续完成后面的事情。 到这里整个关系就开始发生变化了。 以前是我管理五个 Agent。 现在我开始尝试只管理一个 Agent,然后让它去管理剩下几个。 而 Grok Bot 本身也支持多个 Bot 协作,它们可以互相发消息、传递上下文、交接任务,同时共享用户的云电脑、文件和登录状态。 我觉得这才是真正让我兴奋的地方。 过去我们把 Agent 想成一个会调用很多工具的模型。Grok Bot 给我的感觉,更像是第一次给 AI 分了一张办公桌。 电脑在那,账号在那,浏览器开着。有什么事情直接发消息给它,它自己去开网页、找东西、操作软件、叫别的 Agent 干活。 这和在聊天框下面再塞十个按钮,完全是两种产品感受。 只要 Agent 真正获得了电脑,它能接管的就不再是一两个 AI 功能,而是今天已经存在的整个软件世界。 几十年来所有软件,最终都默认一个前提是屏幕前坐着一个人。 现在这个人,第一次可以不是我了。

sleepy.md

21,551 просмотров • 26 дней назад

Damn.. 一款今年你一定要体验下的产品 上次我发的这个落地页火了,随手还赚了2000块。有不少推友想要,我们今天打算开放出去。但方式来点不一样的 这次你甚至不需要安装skill、配置你的agent,你只需要点开我配置好的agent 聊天即可 这个就是Bloome这个产品的妙处,也是我们企业内部正在走的路~ 我之前一直也在思考一个问题,目前AI Agent 市场还是没有全面铺开,很大一部分原因就是不会配置,龙虾经常挂掉。 现在好了,有了Bloome 你只需要与配置好的agent 聊天即可获得你想要的东西 Bloome 最酷的点,是把Agnet 变成了我们IM里的成员: 以前分享AI能力,是发prompt、workflow、skill 让别人自己配置,但是没法产品化,没法赚钱 现在让别人把你配置好的agent 拉进群或者单聊,它就能把你干活了,如果你的agent足够有价值,那就可以开启赚钱之路了! 同时关于AI Agent 社区怎么做分享几点心得: 我在Bloome 里与Yiming Zhang 数字人(agent)聊天,他提到: 用户来这里,能不能比自己找信息快10倍? 不是快一点,是数量级的差异。比如一个人想搞清楚怎么用Agent做客服自动化,他在你的社群里,3分钟就能拿到一个经过验证的方案、别人踩过的坑、可以直接跑的配置。这个体验如果在外面需要30分钟甚至3小时,那你就有价值。 具体怎么做到: 一是让Agent本身成为社群的基础设施,不只是讨论的话题。用户进来不是看别人聊Agent,而是直接跟Agent协作、测试、分享workflow。社群的核心资产是可复用的Agent配置和经验,不是聊天记录。 二是结构化沉淀。聊天是最低效的信息载体。好的社群产品应该把对话里的有价值信息自动提取、结构化,变成可检索的知识。下一个人进来不需要重新问。 三是匹配。不是所有人都需要看所有内容。谁在做什么、谁解决过什么问题、谁的经验跟我最相关——这个匹配做好了,社群的信息效率就上去了。 最怕的是做成一个"AI爱好者交流群"。那个东西微信群就能干,没有产品壁垒。 现在我们可以靠着Bloome 来卖我们的idea了~ 评论区分享手把手教agent 配置、分享的方法👇 我们这个agent体验地址:

岚叔

18,241 просмотров • 4 месяцев назад

DEXX被盗,certik的审计有没有责任?外行如何查看审计报告? ➤首先来说,Certik多少是有些问题的。 第一,打开项目页,首先是评分!一个审计机构,你评分是什么鬼? 我们看审计报告,需要知道的是风险有多大,而不是项目或代码有多好! 第二,上来还有项目亮点。而且你看DEXX这亮点都是啥?推特关注者数量、社群、还有市场稳定性。这和你审计业务有啥关系,就这能叫亮点? 第三,可是涉及到审计的关键问题时,点击”查看漏洞信息“,然后接下来,不但没有显示漏洞信息,整个代码审计这块就没了……不信的话大家可以自己去试一下,我也录了个视频。 第四,其实页面上有pdf审计报告文件可以查看,但是位置不太明显。另一方面,审计报告里的风险事件情况不写在页面上,反而在页面上写一些与安全无关的亮点和评分…… ➤其次,外行看审计报告,应该至少看一下风险摘要。 一般审计报告会把风险划分为致命的、主要的、中度、轻度、信息化几个级别。 我们可以看一下每个级别有多少风险问题,有多少已经解决、有多少还没有解决。 像DEXX这个审计报告上写了,有1主要问题——中心化。 4个中度问题——易受攻击代码。这个已经比较直白了。已解决2个,未解决2个。 4个轻度问题——设计问题,已解决1个,未解决3个。 已解决就是已经解决了问题,已知悉,就是没解决的意思哈哈。 这么说吧,审计报告没问题,不一定真的没问题。但审计风险摘要里都有问题的,那确实是真的有问题的。 ➤对比其他DEX的审计报告 ❚ DYDX 既然说到DEX,我们可以看一下著名的DEX #dydx 的审计情况。 DYDX也没有花钱请certik进行审计,而是由不同的代码审计人员组成审计组进行非正式审计共6次。最近一次审计报告显示: 共有: 中度风险1项,未解决。 低风险6项,2个已解决,4个暂未解决。 信息性风险7项目,7个暂未解决。 ❚ DeGate 再来看一个基于以太坊二层的DEX #DeGate ,2023年8月上线至今天,一共由3家审计机构进行代码,包括 Trail of Bits 、Least Authority 和 #Secbit 共进行5次代码审计。 看一下最近一次的审计报告,审计机构是Secbit。审计报告的地址是 。 中度风险4个,全部已经解决。 低风险8个,其中5个已经解决,3个暂时未解决。 信息性风险4个,1个已解决,3个暂时未解决。 还有4个讨论级别的风险,2个已解决,2个暂时未解决。这类风险应该是需要讨论的,不确定是否存在问题。 没有发现更高级别的风险了,剩下的最高风险是低风险。 DYDX 和 DeGate审计的共同点是: 第一,都没有花钱给Certik去"镀金",而是由多个审计主体进行了多次审计,这样可以相对更充分的发现代码中的安全问题。 第二,审计报告发布在Github平台,而不是审计机构或项目方的官网,这样可以看见审计报告文件的提交修改删除等行为,更公开更透明。 第三,这两个DEX的审计报告中都没有未解决的中度风险。根据审计情况都把风险控制在低风险级别下。 DYDX V4和DeGate分别已经安全运行了14个月和16个月。 可见,无论是大型DEX还是中小型DEX,都可以对比出DEXX的不安全。 ➤写在最后 作为代码小白的我们,听说项目方有代码审计,我们要打开审计报告看了一下。而不是听项目方说有多少个安全性通过。 以DEXX为例,虽然Certik把它的代码排名在10%以内,但是它的评分只有59.31分。这说明DEXX实际的安全性可能更差。只要我们打开这份审计报告,什么也看不懂,起码能看见59.31这个评分。再仔细往下看就会发现"易受攻击代码"的字样。当时看过这两个细节,估计我们也不会去使用这个DEXX了。 打开审计报告以后,即使英文不好,也可以查找Medium这个词,找到风险事件摘要,看一下已发现的各级别的风险问题有多少个,多少已解决、多少未解决。 虽然代码审计安全的项目不一定安全,虽然我们可能看不懂具体的代码风险,但是发现风险级别较高的因素尚未解决,很可能说明项目代码可能处于比较潦草的阶段,还有待的完善安全性,我们在使用时要慎之又慎。 而参与审计的主体多、审计次数多,项目的安全性可能会相对更好一些。当然,也仅仅是相对安全。毕竟很多风险事件不一定是代码层面上的。 提升安全性,我们的资产可以分散存储,大额长期投资使用冷钱包。在应用的用户端,手机电脑的环境保持安全性也非常重要,参与交易和持币的浏览器、设备等与日常使用等进行隔离。在操作资产时,包括交易、游戏等等行为,要慢,要慢,要慢,仔细核对信息……欢迎补充

TVBee🦅

53,242 просмотров • 1 год назад

最近有一个很大的感受, 我们大部分人做副业赚不到钱,真不是不够努力, 以及流传甚广的先发够100条就是骗人的屁话, 纯浪费时间,大家别再信了, 很多人还在用十年前的规则玩今天的游戏, 要知道AI 已经把自媒体副业的玩法整个改写了。 而且很多人没有策略,也不知道方法, 起号之前最重要的是先拆解对标账号,这是一定必须做的, 但拆对标账号放之前是一个非常耗时间精力的活,拆一个赛道起码要熬一周,一条条翻笔记、扒数据,导致很多人偷懒就直接跳过, 最近发现一个特别好用的agent工具, 十几分钟就能出一份完整的对标拆解报告, 我真的惊呆了, 以前要踩几万块的坑才摸透的规律, 现在你照着别人已经跑通的路走就行, 以及很多人说小红书现在入场晚了,饱和了等, 可我这一个月看到冒头的,好几个都是以前压根没碰过小红书的普通人,不太会写文案、不会拍视频、甚至没有自己的产品, 他们就核心干一件事:把对标账号的爆款拆开,照着结构和选题,用 AI 改写成自己的话,然后……就出结果了,有一个兄弟小红书笔记都是AI生成的,几个月干到了一万多粉丝你们敢相信吗哈哈, 总结下来没啥玄学和门槛,就三步: · 别硬刚原创,先对标对的人 · 别憋文案,先拆爆款公式 · 别等流量,先算清楚钱从哪来 我拆完以后最反直觉的一个收获是: 这个赛道 85% 的收入不是靠带货,主要是接品牌广, 所以兄弟们清醒一点,如果方向一开始就搞错, 越使劲越白费,

AYi

14,364 просмотров • 3 месяцев назад