
余温
@gkxspace • 42,575 subscribers
🌸05年连续创业者 | 专注 AI 产品 | 项目营收 7 位数+ ✨记录真实的创业路:项目复盘、踩坑总结和成长思考 💗AI 产品构建 & AI 商业化方案 & 企业 AI 转型
Shorts
Videos

Kimi K3 和 Qwen3.8 前后发新模型,都说自己仅落后 Fable5,K3 套餐现在抢都抢不到,千问还是随便买,我干脆买来测一测到底有没有那么强!!! 结果让我很震惊,某些情况下国产模型做的比 Fable5 还好,并且 Qwen3.8 同一个任务比 Fable5、K3便宜5-10倍,详细聊一聊: 第一个活,让 Qwen3.8、KimiK3、Fable5 复刻 macOS,同样一条一条 prompt(具体对比参考视频): Qwen 3.8 做的最好,一口气写1500 多行代码,菜单栏、Dock 弹性动画、可拖拽窗口等基础的不说,Spotlight、终端、通知中心全都真的能用。这是三板中能做得最全的,UI 也是最舒服的。 第二个活,让它写一个植物大战僵尸那样的塔防游戏。植物、僵尸、阳光经济、10 波进攻,最后一波有僵王坐镇,每条路还配了救场小推车。点开就能玩,同样一句话完成。 中间还顺手让它搓了个黄金矿工,像素怀旧风,放钩抓金块、炸药、道具商店、关卡倒计时全有,一次成型零报错。 然后计算了一下Token消耗和价格,这几个活加起来,Qwen3.8 花 4 毛钱,我以为自己少数了俩零,Fable 5 折算 5块4,K3 收了我 3块4。。。 同样的题三个模型的测试下来都能交货,但测完我的结论是: 国产这俩说仅落后 Fable 5,还真不算吹,差距已经缩小。但价格上 Qwen3.8 确实香,限时优惠+39 块上车不限购,烧 token 多但还是最便宜,而且这还只是预览版,2.4T 参数的正式版说是很快开源。 所以说,国产模型现在都很不错,兄弟们,你会选哪家呢🤔
余温132,189 Aufrufe • vor 3 Tagen

建议大家都把这个号码存进通讯录:+1-650-213-7322 它是一个活在 iMessage 里的 AI,你发短信派活,它能操纵一台云端手机!!! Reddit 在国内是出了名的上不去,挑网还爱封号,但信息又极度优质,很适合看最新的AI讨论、找产品需求、做产品调研! 而且就算你就算能上去,也不清楚到底应该去哪个社区刷帖,整个时间成本也是非常高。 我试着给 +1-650-213-7322 发了句话: "帮我看看AI相关社区的帖子,大家在讨论什么,把讨论焦点和高赞观点整理给我" 它就开始调用云端手机执行,找到一些高质量AI社区刷帖,几分钟后,给我了一份总结文档。 我接着又发了句: "把这些帖子评论区里老外抱怨最多、反复在找的东西整理成一份清单" 他同样会按照我们的需求去刷帖,我们做产品的看这份清单是机会,别人还在刷资讯,你就已经让AI给你拿到需求了。 并且,我全程没开🪜,手机里也没装任何新App。 原理就是:Airtap Ai 在云端跑着一台真手机,你发短信派活,它就在那台手机上打开网页和App,国内上不去的平台,对它来说就是本地环境。 顺着这个思路,其实还可以干很多事: 1、翻YouTube上AI Agent相关的高播放视频,把评论区被问得最多的问题整理成选题清单 2、查Gmail有没有新邮件,有没有新任务,或者然它把刚收到的验证码发给我(你就不用打开🪜了) 3、存定时任务:"每天早上8点把Reddit热帖自动跑一遍发给你" 当然,当你有一台 AI云手机,玩法远不止这些,并且你也不用装App不用注册,第一条消息发出去账号就开好了,目前免费开放! #justtextit #textyourapps #airtap
余温370,504 Aufrufe • vor 9 Tagen

从大一开始 AI 创业,三年间,我一直在想 AI 时代到底什么最值钱? 现在,可以做一个复盘,把这件事好好梳理一下,也给同在创业的朋友一些建议: 技术是最不值钱的东西,记好、记好、记好!!!!!! 真正值钱的是渠道,是你能触达谁、链接谁 我有个很佩服的老板,他公司没有一个技术,之前帮企业做抖音运营,攒了一批客户关系。 AI 这波起来之后直接转型做 AI 企业服务,拿了一堆代理,又招了一批代理帮他卖,一个纯销售公司硬是变成了 AI 服务商,你细品~ 技术不需要他管,让第三方去对接就行了,他不需要懂GEO怎么做的、AI获客怎么做,他只需要做好销售,利用好他的渠道就够了,关于研发和交付这种脏活累活,谁爱干谁干(当然,我也只配给他干脏活累活,呜呜呜) 今年上半年我自己也在拼命做渠道,线下活动跑了好多场,链接了几百位老板,一个个聊一个个转化 说实话,太慢了 而且不只是渠道。找客户、找投资人、找合伙人、招人,哪件都难。优质的人不刷招聘网站,好的客户不看你的推广帖,投资人更不可能主动来找你 我一直在想有没有更快的办法,最近试了个叫 Lev8 的工具,直接跟它说"帮我找做过企业数字化转型的公司负责人,给我联系方式" 几分钟出来了。背景、公司、最近在忙什么全标好 我又试了"帮我找最近在看 AI 赛道的早期投资人",一样精准出来 更有意思的是,它还帮你写个性化的触达消息,对方最近在忙什么就从什么角度切入,每封都不一样。邮件、LinkedIn、WhatsApp 一键发出去 而且还能设监控???你关注的人换工作了、拿融资了,自动提醒你 不过工具终归是工具,你自己不知道要找什么人、说什么话,发再多也白搭。 但是如果你现在有明确想找的客户、投资人、合伙人等,那么这个非常值得你尝试一下了!!! 希望这些对大家能有帮助,产品链接放到评论区👇
余温704,096 Aufrufe • vor 23 Tagen

这个新开源 TTS 太牛逼了,打算直接替换掉原来的 TTS 了 之前测试很多 TTS 都是很死板的"AI 音",今天发现这个,真可以直接拿去商用了 多语种翻译、声音克隆、情绪语气保持,三件事同时拉满的开源模型我是第一次见 我直接拿世界杯名场面解说暴力测试了,选了三段,每段翻四种语言: 梅西帽子戏法那段,西班牙语解说 GOOOOOL 嘶吼到破音,翻成日语、阿拉伯语、中文,那种快吼劈嗓子的劲儿,四个版本居然都在 姆巴佩 96 分钟绝杀世界波,英语解说那种"安静一秒然后炸开"的节奏,翻成德语、日语、中文,全部对上 另外,佛得角 Vozinha 赛后感言,带有哽咽的感觉,葡语翻英语、日语、中文,声音里的颤抖感翻完居然也在 这确实是把 TTS 最难做到的“情绪”给做好了! 它是有道子曰的 Confucius4-TTS,3 秒克隆声音,14 种语言,并且是开源,完全可以自部署 整体效果非常惊艳,个别长句有一点 AI 感,短句高情绪片段已经很离谱了。 做了对比视频,可以听一听感受一下👇 #有道TTS
余温129,886 Aufrufe • vor 22 Tagen

我现在逢人就劝:普通人现在最值得做的事,就是搞自媒体,国内海外一起做!!! 我是看着身边人都真金白银赚到了。你但凡任何一个平台有起色,一个月搞个两三万不是玩一样? 钱会从你想不到的地方冒出来: 咨询、卖课、接定制开发、品牌商单、开社群、拿分佣,还有对自己业务的赋能,但凡能吃到一个,一个月几万块真不难,反正比大多数人上班赚得多 但太多人人卡死在同一个地方:机会来了,不知道怎么变现,不知道怎么承接。。。。。。 比如: 咨询不好意思收费,商单不知道怎么报,社群不知道定位和定价,问题就在这里:对方真正想买什么?该做成什么产品?收多少钱?怎么确认真的有人愿意付钱? 这就是问什么,很多人搞自媒体就是不赚钱。这当时也困扰了我很久,最近,这段最难的部分,我最近用 atypica.AI 跑通了: 把账号定位、受众和已经出现的需求放进去,让它去研究不同买家的真实诉求、公开讨论、同类产品和付费意愿。 并且去搜索各种社交平台(如:TK、Ins、小红书、推特等)真实的评论。 还还会模拟你的粉丝、付过费的人、品牌方等,组成焦点小组访谈,最后帮你把一堆模糊的信息,整理成产品、价格和承接方案。 我现在越来越鼓励大家大胆展示、大胆销售,先把自己的账号做起来。 很多钱,真的要先让别人看见你,才会出现。敢去承接,才能赚钱。 也推荐大家遇到赚钱问题时和 atypica 聊一聊,🔗放评论区:
余温45,245 Aufrufe • vor 9 Tagen

发现一个很疯狂的开源工具,你输一句话描述你要什么数据,它派出一群 AI Agent 并行跑到各个网站上调研,几分钟后汇总成一张结构化表格给你 其实数据都摆在网上,但想变成一张能用的表格,历来都是苦力活,过去这是一个工程项目: 拼搜索、写爬虫、设计 Schema、去重,再加个定时任务保持更新,每个数据集都要重来一遍。 Exa 融了 2.5 亿验证了一件事:这个距离可以缩短到一句话。 但 Websets 目前只覆盖公司、人和论文。而且都是cacheddata TinyFish 开源了一个叫 Bigset 的东西,做同样的事,但不限主题。 我试了一句:“提供免费层或 Freemium 方案的热门 B2B SaaS 工具,包含名称、类别、免费层概要和定价页面。”几分钟后拿到一张完整的表。 背后是真正的多 Agent 架构:编排 Agent 发现实体,并行子 Agent 各自调研,工具预算 6 次封顶,数据来源可追溯。整个代码库 AGPL-3.0 开源,自托管,用你自己的 Key。 如果 BigSet 对你有用,记得去 GitHub repo 点个 star →
余温126,251 Aufrufe • vor 1 Monat

这才是 AI Native 团队的最终形态! 我之前花三周用 OpenClaw 搭 AI 团队,让多agent在Discord里协作,纯属浪费时间(我想我不是一个人) 之前我自己搭的遇到的问题: token 烧得飞快、gent 之间"打架"、两个 AI 对一直互相@个没完,钱全给我浪费了... 我试了各种 prompt 约束、加中间裁判、限制轮次,怎么调都不对。有时协作太死板丢,有时权限一放开就失控。 所以当我看到 Helio ,让多个 AI 在频道里工作,我第一反应是不信,然后就去试了试。。。 但实际试了之后发现,我还是把它想简单了,它不是"让 agent 互相发 prompt",是给每个 AI 一个独立身份(有名字、有邮箱、有明确的职责范围)。 比如,产品经理只管拆需求,设计师只管出方案,各干各的然后在频道里同步。并非无限对话,而是分工协作。 还有个让我意外的机制:每天凌晨 AI 会"做梦",回顾当天工作,找出什么做对什么做错,更新自己的行为规范。 回头看,我在 OpenClaw 上踩的坑(token 浪费和 agent 死循环),本质上是因为把"多智能体协作"当成了 prompt 链编排问题。 而他们直接给 AI 身份和职责边界,让协作像人与人配合一样发生。这条路目前看下来挺对的。
余温68,950 Aufrufe • vor 1 Monat

一个河南奶奶拿着手机问豆包问题,豆包用河南话回复她。 就这一个场景,我突然就理解了什么叫“国民级应用”。 不是功能多牛、模型多强,而是我奶奶也能用。 很多AI产品,我自己用着觉得很厉害,但让大众试试,他们根本不知道怎么开始。 豆包确实把门槛降到了最低。各种内置方言、音色克隆、人性化设置、简洁的交互。拿起来就能用,不用人教,不需要理解各种概念。 如果你还没使用过豆包,可以体验一下,但是这种体验并非Claude、GPT等极致的能力,而是真正感觉到它是服务于大众。 我给家里长辈手机上装的也都是豆包,因为他们真的能用起来。 一个产品,如果只有懂技术的人能用,那它再厉害也只是小众玩具。 能让普通人、老年人、不懂技术的人都用起来,这才是真正的好产品。 我认为豆包做到了。
余温163,499 Aufrufe • vor 5 Monaten

wok,发现宝了,之前折腾各种远程方案都可以扔了 我经常出门要背那块砖一样的 16 寸 MacBook,就因为随时可能要操作电脑。 期间试过 Tailscale +tmux、Todesk 这些方案,不是配置折腾就是体验差,始终不满意。 最近圈子里有不少大佬在用UU远程,我也试了一下。 看我刚用手机录的这段视频,手机操控电脑几乎零延迟,最高 4K蓝光144 帧,两个显示器来回切也完全流畅。 但最让我惊喜的还是终端功能。 我平时一直在电脑上让AI跑任务,出门在外想看一眼任务状态,就折腾了Tailscale +tmux,说实话,体验确实一般,还总是中断。 UU 远程直接给了终端入口,手机上就能登陆终端看信息和进程。 整个过程就是纯命令行,跟在电脑前开Terminal体验一样,对玩 AI 的人来说这个功能是真的刚需。 UU远程已经两年了,说实话刚开始以为网易迟早要收费,结果到现在依然完全免费、零广告,这两年更新了几十个版本,体验越来越流畅延迟越来越低,还陆续加了远程开关机等实用功能。一直在迭代变好,但始终没收费。 支持手机对电脑、电脑对电脑多端远程控制,还有内网穿透能力,我到现在都不知道他们靠什么回本。
余温58,919 Aufrufe • vor 1 Monat

发现一个很离谱的模型,400 TPS 的输出速度,比 DeepSeek-V4 Flash 快 2 倍多 还有超强的多模态理解 + 搜索检索 + 推理综合,这居然是一个 Flash 模型能同时做到的 我让它帮我写了一个竞品分析 Agent: 输入一张产品官网截图,自动完成"读图提取 → 搜索市场数据 → 输出竞争分析"的全流程。 然后用 Cursor 的定价页试了一下,不到一分钟跑完,花了一毛多: 它先读懂了整个页面(四档定价 × 各档功能差异 × 推荐标签与社会证明),提取出完整的结构化数据。 然后自己决定搜什么,自动生成搜索 query 去查竞品定价、用户评价、市场对比。 最后综合视觉提取 + 搜索结果,给了我完整的竞争分析:定价对比、竞品定位差异、真实壁垒在哪里、切入建议。 这个模型就是 StepFun 的 step-3.7-flash,多模态 + 搜索 + 推理一体化内嵌在模型里,如果你在构建 AI Agent、编码工作流或多模态系统,Step 3.7 Flash 很推荐大家尝试一下: Step海外平台: Step国内平台:
余温40,767 Aufrufe • vor 1 Monat

Vibe Coding 让每个人都有做软件的能力,我见过很多人做了几十个产品,纯特么自嗨,没有一毛钱盈利。 现在 AI 一晚上能做一个产品,代码成本趋近于零,成本低到大家觉得不需要验证,做完了自然有人用。 但事实上大家都在做“玩具”,因为 Vibe Coding 解决的是 how,但 what 和 why 被跳过了。 我最近一个多月一直在用 atypica.AI ,就是在写代码之前,先把想法丢进去跑一轮用户验证。 它会有一套完整的研究链路: 先帮你拆研究计划,然后从百万级真实用户数据构建的 AI 人设库里挑人,组成一个焦点小组(AI Panel),让这些虚拟用户讨论你的产品、互相辩论、给出反对意见。 并且,这个焦点小组可以反复用,每次你有新想法、新定价、新包装、新广告语,都可以拉同一批人再聊一轮。 我刚用它测过的场景: 上周我想做一个给老板用的 AI 助手,它帮我组了 12 个不同行业的老板人设(persona)并沉淀成我可以反复调用的Panel 。 30 分钟跑完,从报告中发现3件我完全没想到的事: 1. 当AI变得太懂老板反而会引发不安全感(尤其是很懂账目和客户关系时,会觉得被盯着); 2. 最抗拒 AI 的老板也不是完全不用 AI ,只是不想换工作方式(能继续发微信、拍照、说语音,后台自动整理); 3. 他们愿意为 AI 付钱不是因为功能多,而是因为它能帮自己少亏一次钱(少一次压货、客户流失或管理损耗,比“智能助手”这个概念更能打动人)。 根据这些发现我当场调整了方向,然后用panel里的同一批人再验证了一轮。两轮下来,避开了至少三个致命错误。 Vibe Coding 把做产品的门槛降到了零,但做对产品的门槛一点没变,如果你想要靠产品盈利,最好还是先想清楚: 你在解决真实需求,还是在解决自己幻想的问题。
余温27,280 Aufrufe • vor 1 Monat

我靠,Adobe Premiere Pro 和 After Effects 这波直接原地起飞!!! 对于真正复杂的剪辑(多机位对切、精细调色),PR是专业剪辑师的不二之选,而且PR 的时间线能力目前没有 AI 能替代。 现在,Higgsfield 给 Adobe 做了个插件,直接把 AI 塞进了工作流里。 以前: 纯手动,多个APP来回折腾,抠背景、重拍竖版、做特效...... 现在: 1、改画幅:横版 16:9 一键转抖音、小红书的竖版 9:16,AI 自动补画面边缘,主体不裁、不糊。拍一条适配全平台。 2、抠像:手机在各种场景随手拍,不用绿幕,一键把人抠出来换任意背景。 3、提画质:导出时直接拉到 4K,各种低分辨率素材直接拉回来。 4、画笔编辑:你只需要在视频上圈出要改的,告诉 AI 怎么改,指哪改哪。 5、生成:图片、视频、转场都能直接在时间线里生成,生成完直接拖进去就能剪。 全部在 Premiere 时间线里原地完成,不跳任何外部工具,一个人就干了之前一整个后期团队的活。
余温32,811 Aufrufe • vor 1 Monat

好家伙,被这场直播彻底震惊。 研究 12 年因果 AI 的华人,把我对大模型的认知改变了: 你们天天用的 LLM,本质是在死记硬背。 AI 圈“以胖为美”,因为模型在死记硬背,见过的一切全背下来,模型没到 TB 级,都不好意思说在做 LLM。 但你想想上学那会,班里牛逼的同学,都是把公式吃透的,因为题目是无限的,公式是有限的。 物理世界同理:数据无限,背后的规律有限。用无限堆数据的方式去逼近有限的东西,方向本身有问题。 这是黄碧薇教授 Biwei Huang 在极客公园直播里提到的,她判断下一代范式是真正理解规律的因果世界模型。 模型一旦真的理解规律,体格直接小一个量级。同样的数据,她们的因果世界模型成功率高 25-50%,样本省 5-10 倍。 强烈大家看一看完整对话:
余温24,649 Aufrufe • vor 1 Monat

看到个很惊艳的 AI PPT 项目,从任何文档生成可原生编辑的 PPTX 文件,还内置了 AI生图、动画、旁白等功能。 AI 生图,内置 gpt-image-2 等 14 个后端。 也有内置的网络搜图。 你自己有图的话,也可以帮你处理。 然后是动画和旁白,这块做得很细。 动画是真正的 OOXML 原生动画。AI 生成的 SVG 里每个顶层分组,导出后就是一个独立的动画对象,进入页面时自动级联播放。 旁白默认 edge-tts,免费。 还可以接入其它家(可克隆自己的声音),ElevenLabs、MiniMax都行。 旁白嵌进 PPT 后,每页的自动翻页时间会自动对上轨道的长度。 输入端 PDF、Word、Excel、网页、公众号、Markdown 都能吃。输出端 16:9、小红书、朋友圈、抖音、A4 都能出。
余温36,141 Aufrufe • vor 2 Monaten

卧槽,被这个思路震惊了,简直是 AI 视频领域的 Figma,完全解决了目前的痛点 GPT-image-2 画故事板,Figma 风格画布编辑,Seedance 2.0 出片 当你在脑子里想好了画面,写成文字描述给 AI,AI 理解偏了,你再改,再生成。来回几轮,时间和 Token 全耗在“让 AI 理解脑子里的画面”。 Topview Canvas 直接加了一步:生成视频之前,先用 GPT-image-2 把故事板画出来。 每一帧长什么样,你都能先在画布上看到。不满意就改图,比改 prompt 快且精确。排好了再一键 Seedance 2.0 出片。 像 Figma 之于设计,先规划再动手永远比边做边猜效率高,TopviewAI 这一步走的太好了。
余温26,694 Aufrufe • vor 1 Monat

最近看到一个很牛逼的 AI research 产品,能帮助我们验证产品可行性,避免陷入自嗨陷阱,它叫atypica。 你丢给它一个商业问题后,它会先澄清你的需求,像研究团队规划研究,再去搜公开信息、找合适的persona、模拟用户做访谈,最后给你一份结构化报告。 能站到目标用户视角,去提前验证一个产品值不值得做。 比如: 1. 你可以用它研究,自己的受众到底更想看教程、案例,还是观点类内容 2. 你也可以用它研究,一个AI产品在真实 persona 眼里,到底哪里有吸引力 他们现在底层有100w+ 基于真实社媒内容分析拟合成的AI personas,也有基于真实深度访谈构建的 10 万+ 高质量 persona。 如果这个方向继续成熟下去,我觉得它最有价值是帮更多创作者、营销人、产品团队,在真正花时间和预算之前,先把明显错误的方向排掉。 接下来我来拆解atypica.AI ,讲一下这个产品为什么有点东西,🔗放评论区:
余温32,272 Aufrufe • vor 3 Monaten

23年,用 AI 代写的人赚到第一桶金 25年,会 Vibe coding 的人赚了一波 下一波风口,可能到 AI 视频了: Sora 2、Veo 3.1 出来后,AI 视频达到了"生产级" 现在的工具(比如 Medeo): 对话式修改 全品类视频 支持 角色一致性 稳定 1. 需求一直在 企业培训、知识付费、短视频、广告... 视频需求量是文字大得多 但供给跟不上: 外包做:200-500/条,还要等 自己学:3个月学习,2小时制作 2. 技术刚到临界点 以前的 AI 视频:质量不行,商用不了 具体机会在哪? 机会1:接单做视频: 企业培训(500-5000/条) 知识科普(150-300/条) 课程配套(300-800/条) 机会2:批量做账号 用 AI 批量生产内容 做知识科普、技能教学账号 机会3:做虚拟IP 用角色一致性、生成固定形象 做系列内容、打造IP 为什么我说是可以蹲一波? 1. 价格仍然太高(目前API价格太贵,成本太高) 2. 技术还有很大进步空间(Sora 2、Veo 3.1) 3. 市场还没爆(大部分人还不知道)
余温56,507 Aufrufe • vor 6 Monaten

想做视频但不会剪辑的人,终于有救了 过去 10 年,“剪辑”是视频创作最大的门槛 各种剪辑工具:剪映、PR、AE 学不会?找人做,200 一条起步 学得会?花 3 个月,做一条要 2 小时 “剪辑门槛”,拦住了 90% 想做视频的人 但是现在,这道门槛正在消失 我最近测了一个叫 Medeo 的工具,它让我重新理解了一件事👇 做视频,真的不一定要学剪辑了 用 Medeo:你只需要会说话 步骤 1:把文案丢进 Medeo(1 分钟) "帮我做一个 1 分钟的读书分享视频,风格温暖有书卷气" 步骤 2:AI 自动生成初稿(5 分钟) 它会自动搞定: 配套画面(根据文案智能匹配) 配音(自动选合适音色) 背景音乐(氛围匹配) 字幕(自动生成) 步骤 3:对话式修改(5分钟) 像和朋友聊天一样改视频: "配音换成温柔女声" "第二段节奏快一点" "整体色调偏暖,像下午的咖啡厅" 并且,不止是动漫,还有绘本、广告、各类动画、新闻等风格的视频,都可以用Medeo来完成。 只要你会说话、会表达,就能做视频,你甚至可以利用它进行赚钱。
余温56,690 Aufrufe • vor 6 Monaten

Google Antigravity 实测:目前最有“未来感”的 AI IDE。 我用三次对话,0报错,复刻了高完成度的 X 页面,视频为详细拆解。 它是 Agent-First 开发环境: 自动规划、跑代码、开浏览器找 bug、捕捉错误并修复、录屏生成一个 Walkthrough 文档,整套流程像在“看 AI 工作”。 亮点: Task/Plan/Walkthrough 组成的可协作工作流,特别适合产品经理,任务完成度极高。 免费额度慷慨(Gemini 3 Pro → Claude Sonnet 4.5) 以下是一个完整的项目综合分析:
余温26,464 Aufrufe • vor 8 Monaten