
余温
@gkxspace • 47,582 subscribers
🌸05年连续创业者 | 专注 AI 产品 | 项目营收 7 位数+ ✨记录真实AI创业:AI干货分享、项目复盘、踩坑总结 💗付费咨询 & AI 商业化方案 & 企业 AI 服务 📮[email protected]
Shorts
Videos

卧槽,这套 GTM 能力太牛逼了,这是真正能帮你赚钱的东西啊,做产品和出海的兄弟们,必须狠狠收藏!!! 它把一整套 GTM 数据能力直接接进了 Codex、Claude: 1、Similarweb:网站流量、访问渠道、受众、排名、关键词,数据直接来自官方,不是爬虫或镜像站。 2、Ahrefs、Semrush、DataForSEO:SEO、外链、SERP、付费搜索和内容缺口。 3、X、Reddit、Instagram、YouTube、Pinterest:用户讨论、反对意见、内容趋势和创作者表现。 4、Apollo、WaveInflu:找公司、岗位联系人、达人和公开联系方式。 5、Oxylabs:查品牌在 ChatGPT、Gemini、Perplexity、Google AI Overview 里的可见度和引用来源。 以前做一次正经的市场研究,要开一堆数据平台,自己一点点分析。现在你只需要给 Agent 一个业务目标。 我最近想做一个 AI UGC 生成产品,于是拿它深度测了一把,效果真的惊呆了,它直接从 AIsa 调 Similarweb、Ahrefs、Semrush、DataForSEO……等十几个产品、40 个关键词,还有流量渠道、定价、招聘和用户评论。 你不需要研究每个平台怎么用。Agent 会根据任务自己找数据,最后直接给你竞品、需求、用户痛点、SEO 和 GEO 机会,还有具体的获客方向。 以前一个团队花大几万都很难集齐的专业能力,现在一个 Key 就能按需调用,丢给 Agent 几分钟全自动跑完,而且全是有据可查的真数据。 我把完整过程和最终报告都录进视频了,做产品、出海、SEO 或 GEO 的兄弟们,真的值得看看。 🔗:
余温28,234 Aufrufe • vor 22 Stunden

卧槽!谁不想在自己婚礼上搞这一出啊??? 我看完这段真的惊呆了! 上面用 Seedance 2.5 在 Higgsfield 做的,下面是婚礼现场,新娘新郎坐在那看自己。 1900 年代的老码头、古罗马斗兽场、西部片骑马追火车、假面舞会......最后落回他们真实相遇的电梯。 AI 很大的意义,我觉得就在这种地方。 而且,兄弟们!这绝对是一门好生意啊!!! 谁结婚不想要啊?传统摄影根本拍不了这个,结婚、求婚这种事,有情感寄托,是给那两个人的,人就愿意为它掏钱。 况且,这种场景多的是:求婚、金婚、纪念日、孩子的成人礼,全是人这辈子最舍得花钱的时刻...... AI 视频的质量越来越高,门槛越来越低,想象空间越来越大。总之,大有可为啊兄弟们!!!
余温469,400 Aufrufe • vor 26 Tagen

卧槽,现在一个人真的能把一支视频团队的活全干了!!! 产品广告、科普动画、数据视频、课程解说,给 Fotor 一句需求和素材,它自己从脚本一路做到可编辑成片。 最牛逼的是文字、图片、图表、数字、Logo、旁白和音乐全部分轨,想怎么改怎么改!!! 比如,参数写错了直接改数字,Logo 想换就替换,某个镜头不满意也可以只重做那一段。 特别是在做 MG 动效和数据解说: 以前做专业 MG 动效只能靠 AE 一帧帧抠,在剪映、PR、AE 来回倒腾,一条要几天,普通 AI 视频做出来的动效又画质糊、数据错乱。 Fotor 中能将图片、PDF、Excel、网址等各种信息丢进去,直接做专业级信息型 MG 动效,4K 分辨率,速度是传统 AE 的 50 倍,成本是AE制作的1/200。 它能覆盖的场景非常多: 1、商品图做电商广告和上新视频。 2、给 SaaS 做演示、Product Hunt 上线视频。 3、PDF、文章和论文做专业 MG 知识科普。 4、Excel、CSV 做 4K 动态数据报告。 5、口播原片自动补 B-roll、字幕和动态图形。 6、把课程讲义和培训文档做成一套教学视频。 无论你是做产品、做电商、知识内容还是企业服务的,都很值得试一下这个产品:
余温69,296 Aufrufe • vor 5 Tagen

爽了!打死我都不敢信,有公司愿意把这种东西开源! AI 视频圈最没用的就是“只放成片”,但 Higgsfield 把 95 分钟的 AI 长片《Hell Grind》完全开源了,每条提示词、每份素材,全部公开。 这部片子成本 50 万美元,上过戛纳电影市场,几乎看不出 AI 感,说是实拍我都信。 我翻了一圈,做 AI 视频一定要把这几条都用到自己的工作流里: 1、prompt 别写短句碎片,人家平均一条 3000 个词,等于把分镜脚本直接写成 prompt 2、画面发飘就把物理规则写进提示词:遵守重力和惯性、不要漂浮的道具,一条条明确写 3、去 AI 感靠自然光描述,专门压那种过亮过假的质感 4、复杂动作戏先生成一张俯视地图,再逐个机位写 prompt,镜头才不乱 5、心态放平:视频前 25 分钟是从 16181 次生成里筛出来的 253 个镜头,64 抽 1,就算是专业团队要靠抽卡 这就是最好的学习“AI 视频”的方法,真建议每个做内容的人都去研究一遍,冲!!!
余温344,491 Aufrufe • vor 1 Monat

从大一开始 AI 创业,三年间,我一直在想 AI 时代到底什么最值钱? 现在,可以做一个复盘,把这件事好好梳理一下,也给同在创业的朋友一些建议: 技术是最不值钱的东西,记好、记好、记好!!!!!! 真正值钱的是渠道,是你能触达谁、链接谁 我有个很佩服的老板,他公司没有一个技术,之前帮企业做抖音运营,攒了一批客户关系。 AI 这波起来之后直接转型做 AI 企业服务,拿了一堆代理,又招了一批代理帮他卖,一个纯销售公司硬是变成了 AI 服务商,你细品~ 技术不需要他管,让第三方去对接就行了,他不需要懂GEO怎么做的、AI获客怎么做,他只需要做好销售,利用好他的渠道就够了,关于研发和交付这种脏活累活,谁爱干谁干(当然,我也只配给他干脏活累活,呜呜呜) 今年上半年我自己也在拼命做渠道,线下活动跑了好多场,链接了几百位老板,一个个聊一个个转化 说实话,太慢了 而且不只是渠道。找客户、找投资人、找合伙人、招人,哪件都难。优质的人不刷招聘网站,好的客户不看你的推广帖,投资人更不可能主动来找你 我一直在想有没有更快的办法,最近试了个叫 Lev8 的工具,直接跟它说"帮我找做过企业数字化转型的公司负责人,给我联系方式" 几分钟出来了。背景、公司、最近在忙什么全标好 我又试了"帮我找最近在看 AI 赛道的早期投资人",一样精准出来 更有意思的是,它还帮你写个性化的触达消息,对方最近在忙什么就从什么角度切入,每封都不一样。邮件、LinkedIn、WhatsApp 一键发出去 而且还能设监控???你关注的人换工作了、拿融资了,自动提醒你 不过工具终归是工具,你自己不知道要找什么人、说什么话,发再多也白搭。 但是如果你现在有明确想找的客户、投资人、合伙人等,那么这个非常值得你尝试一下了!!! 希望这些对大家能有帮助,产品链接放到评论区👇
余温711,706 Aufrufe • vor 2 Monaten

建议大家都把这个号码存进通讯录:+1-650-213-7322 它是一个活在 iMessage 里的 AI,你发短信派活,它能操纵一台云端手机!!! Reddit 在国内是出了名的上不去,挑网还爱封号,但信息又极度优质,很适合看最新的AI讨论、找产品需求、做产品调研! 而且就算你就算能上去,也不清楚到底应该去哪个社区刷帖,整个时间成本也是非常高。 我试着给 +1-650-213-7322 发了句话: "帮我看看AI相关社区的帖子,大家在讨论什么,把讨论焦点和高赞观点整理给我" 它就开始调用云端手机执行,找到一些高质量AI社区刷帖,几分钟后,给我了一份总结文档。 我接着又发了句: "把这些帖子评论区里老外抱怨最多、反复在找的东西整理成一份清单" 他同样会按照我们的需求去刷帖,我们做产品的看这份清单是机会,别人还在刷资讯,你就已经让AI给你拿到需求了。 并且,我全程没开🪜,手机里也没装任何新App。 原理就是:Airtap Ai 在云端跑着一台真手机,你发短信派活,它就在那台手机上打开网页和App,国内上不去的平台,对它来说就是本地环境。 顺着这个思路,其实还可以干很多事: 1、翻YouTube上AI Agent相关的高播放视频,把评论区被问得最多的问题整理成选题清单 2、查Gmail有没有新邮件,有没有新任务,或者然它把刚收到的验证码发给我(你就不用打开🪜了) 3、存定时任务:"每天早上8点把Reddit热帖自动跑一遍发给你" 当然,当你有一台 AI云手机,玩法远不止这些,并且你也不用装App不用注册,第一条消息发出去账号就开好了,目前免费开放! #justtextit #textyourapps #airtap
余温378,543 Aufrufe • vor 1 Monat

Kimi K3 和 Qwen3.8 前后发新模型,都说自己仅落后 Fable5,K3 套餐现在抢都抢不到,千问还是随便买,我干脆买来测一测到底有没有那么强!!! 结果让我很震惊,某些情况下国产模型做的比 Fable5 还好,并且 Qwen3.8 同一个任务比 Fable5、K3便宜5-10倍,详细聊一聊: 第一个活,让 Qwen3.8、KimiK3、Fable5 复刻 macOS,同样一条一条 prompt(具体对比参考视频): Qwen 3.8 做的最好,一口气写1500 多行代码,菜单栏、Dock 弹性动画、可拖拽窗口等基础的不说,Spotlight、终端、通知中心全都真的能用。这是三板中能做得最全的,UI 也是最舒服的。 第二个活,让它写一个植物大战僵尸那样的塔防游戏。植物、僵尸、阳光经济、10 波进攻,最后一波有僵王坐镇,每条路还配了救场小推车。点开就能玩,同样一句话完成。 中间还顺手让它搓了个黄金矿工,像素怀旧风,放钩抓金块、炸药、道具商店、关卡倒计时全有,一次成型零报错。 然后计算了一下Token消耗和价格,这几个活加起来,Qwen3.8 花 4 毛钱,我以为自己少数了俩零,Fable 5 折算 5块4,K3 收了我 3块4。。。 同样的题三个模型的测试下来都能交货,但测完我的结论是: 国产这俩说仅落后 Fable 5,还真不算吹,差距已经缩小。但价格上 Qwen3.8 确实香,限时优惠+39 块上车不限购,烧 token 多但还是最便宜,而且这还只是预览版,2.4T 参数的正式版说是很快开源。 所以说,国产模型现在都很不错,兄弟们,你会选哪家呢🤔
余温144,494 Aufrufe • vor 1 Monat

这个新开源 TTS 太牛逼了,打算直接替换掉原来的 TTS 了 之前测试很多 TTS 都是很死板的"AI 音",今天发现这个,真可以直接拿去商用了 多语种翻译、声音克隆、情绪语气保持,三件事同时拉满的开源模型我是第一次见 我直接拿世界杯名场面解说暴力测试了,选了三段,每段翻四种语言: 梅西帽子戏法那段,西班牙语解说 GOOOOOL 嘶吼到破音,翻成日语、阿拉伯语、中文,那种快吼劈嗓子的劲儿,四个版本居然都在 姆巴佩 96 分钟绝杀世界波,英语解说那种"安静一秒然后炸开"的节奏,翻成德语、日语、中文,全部对上 另外,佛得角 Vozinha 赛后感言,带有哽咽的感觉,葡语翻英语、日语、中文,声音里的颤抖感翻完居然也在 这确实是把 TTS 最难做到的“情绪”给做好了! 它是有道子曰的 Confucius4-TTS,3 秒克隆声音,14 种语言,并且是开源,完全可以自部署 整体效果非常惊艳,个别长句有一点 AI 感,短句高情绪片段已经很离谱了。 做了对比视频,可以听一听感受一下👇 #有道TTS
余温131,351 Aufrufe • vor 2 Monaten

发现一个很疯狂的开源工具,你输一句话描述你要什么数据,它派出一群 AI Agent 并行跑到各个网站上调研,几分钟后汇总成一张结构化表格给你 其实数据都摆在网上,但想变成一张能用的表格,历来都是苦力活,过去这是一个工程项目: 拼搜索、写爬虫、设计 Schema、去重,再加个定时任务保持更新,每个数据集都要重来一遍。 Exa 融了 2.5 亿验证了一件事:这个距离可以缩短到一句话。 但 Websets 目前只覆盖公司、人和论文。而且都是cacheddata TinyFish 开源了一个叫 Bigset 的东西,做同样的事,但不限主题。 我试了一句:“提供免费层或 Freemium 方案的热门 B2B SaaS 工具,包含名称、类别、免费层概要和定价页面。”几分钟后拿到一张完整的表。 背后是真正的多 Agent 架构:编排 Agent 发现实体,并行子 Agent 各自调研,工具预算 6 次封顶,数据来源可追溯。整个代码库 AGPL-3.0 开源,自托管,用你自己的 Key。 如果 BigSet 对你有用,记得去 GitHub repo 点个 star →
余温126,251 Aufrufe • vor 3 Monaten

豆包进飞书后,飞书直接成了自媒体创作神器,打通了选题、创作、复盘全流程!!! 飞书多维表格、云文档、知识库配合 CLI 够爽了,现在飞书里的豆包可以读你的资料、操作电脑、浏览器、做PPT、图片、视频...... 我这次直接拿“一个人+飞书做 AI 自媒体”跑了一遍: 1、找选题:打开浏览器搜近期内容,最后找了 10 个公开来源,把标题、链接、发布日期、核心信息、互动数据和用户问题全部写进飞书。 2、内容存档:直接建好多维表格。它自己做了 14 个字段,按照账号匹配度、热度和信息增量打分,再做出选题优先级视图和数据看板! 3、创作:选中一条继续创作。它沿着表里的资料写完一篇 X 长帖,又生成了 3 套封面标题、3 组提示词和 3 张封面图,全部写回同一条记录。 它搜索的资料、做的判断、生成的内容和图片,全都留在飞书里。整个过程每一步都能看、能改,包括来源、评分规则也都可以调,标题和图片不满意就让它重做。 飞书负责把资料、选题和成品整理并存好,豆包负责搜索、整理、判断和创作。全自动在浏览器、文档、表格和生图工具之间调用。
余温47,047 Aufrufe • vor 1 Monat

一个河南奶奶拿着手机问豆包问题,豆包用河南话回复她。 就这一个场景,我突然就理解了什么叫“国民级应用”。 不是功能多牛、模型多强,而是我奶奶也能用。 很多AI产品,我自己用着觉得很厉害,但让大众试试,他们根本不知道怎么开始。 豆包确实把门槛降到了最低。各种内置方言、音色克隆、人性化设置、简洁的交互。拿起来就能用,不用人教,不需要理解各种概念。 如果你还没使用过豆包,可以体验一下,但是这种体验并非Claude、GPT等极致的能力,而是真正感觉到它是服务于大众。 我给家里长辈手机上装的也都是豆包,因为他们真的能用起来。 一个产品,如果只有懂技术的人能用,那它再厉害也只是小众玩具。 能让普通人、老年人、不懂技术的人都用起来,这才是真正的好产品。 我认为豆包做到了。
余温163,856 Aufrufe • vor 7 Monaten

我现在逢人就劝:普通人现在最值得做的事,就是搞自媒体,国内海外一起做!!! 我是看着身边人都真金白银赚到了。你但凡任何一个平台有起色,一个月搞个两三万不是玩一样? 钱会从你想不到的地方冒出来: 咨询、卖课、接定制开发、品牌商单、开社群、拿分佣,还有对自己业务的赋能,但凡能吃到一个,一个月几万块真不难,反正比大多数人上班赚得多 但太多人人卡死在同一个地方:机会来了,不知道怎么变现,不知道怎么承接。。。。。。 比如: 咨询不好意思收费,商单不知道怎么报,社群不知道定位和定价,问题就在这里:对方真正想买什么?该做成什么产品?收多少钱?怎么确认真的有人愿意付钱? 这就是问什么,很多人搞自媒体就是不赚钱。这当时也困扰了我很久,最近,这段最难的部分,我最近用 atypica.AI 跑通了: 把账号定位、受众和已经出现的需求放进去,让它去研究不同买家的真实诉求、公开讨论、同类产品和付费意愿。 并且去搜索各种社交平台(如:TK、Ins、小红书、推特等)真实的评论。 还还会模拟你的粉丝、付过费的人、品牌方等,组成焦点小组访谈,最后帮你把一堆模糊的信息,整理成产品、价格和承接方案。 我现在越来越鼓励大家大胆展示、大胆销售,先把自己的账号做起来。 很多钱,真的要先让别人看见你,才会出现。敢去承接,才能赚钱。 也推荐大家遇到赚钱问题时和 atypica 聊一聊,🔗放评论区:
余温46,104 Aufrufe • vor 1 Monat

好家伙,qwen3.8-max 正式版来了,2.4T 参数、1M 上下文,下周 Max 和 27B 的权重都开源(听说 27B 在本地 17GB 内存就能跑)!!! 它绝对是非常被低估的模型,视觉理解、前端、复杂任务都是全球第一梯队,API 价格也是旗舰里最便宜的一档。 两周前我复刻 macOS、植物大战僵尸和黄金矿工,当时已经觉得前端能力挺牛逼,,今天我又拿正式版整了个大活: 第一个,我扔给它一张 2D 户型图,让它把房子装修后 3D 展示: 它先把图重画成带尺寸标注的标准户型图,再 1:1 盖成 3D,家具全配好,可以第一人称走进去逛,切到俯视图和图纸完全对得上,连每扇门往哪边开都没错。 做装修、中介的兄弟们想想这个场景,可以玩起来了。 第二个,我让它做一个能开车、逛街、有昼夜循环的 3D 开放世界城市游戏: 它自己选型、写代码,第一版帧率只有 6 帧,它自己查出来是灯光加太多,改了渲染方式拉回 50 帧。 最后交给我的网页版小 GTA,完全达到了我预期的效果,而且细节做的非常完善。 模型越来越强,Coding的想象空间太大了,等后续再给大家很多的测评和反馈,下面的视频展示效果👇:
余温31,867 Aufrufe • vor 1 Monat

这才是 AI Native 团队的最终形态! 我之前花三周用 OpenClaw 搭 AI 团队,让多agent在Discord里协作,纯属浪费时间(我想我不是一个人) 之前我自己搭的遇到的问题: token 烧得飞快、gent 之间"打架"、两个 AI 对一直互相@个没完,钱全给我浪费了... 我试了各种 prompt 约束、加中间裁判、限制轮次,怎么调都不对。有时协作太死板丢,有时权限一放开就失控。 所以当我看到 Helio ,让多个 AI 在频道里工作,我第一反应是不信,然后就去试了试。。。 但实际试了之后发现,我还是把它想简单了,它不是"让 agent 互相发 prompt",是给每个 AI 一个独立身份(有名字、有邮箱、有明确的职责范围)。 比如,产品经理只管拆需求,设计师只管出方案,各干各的然后在频道里同步。并非无限对话,而是分工协作。 还有个让我意外的机制:每天凌晨 AI 会"做梦",回顾当天工作,找出什么做对什么做错,更新自己的行为规范。 回头看,我在 OpenClaw 上踩的坑(token 浪费和 agent 死循环),本质上是因为把"多智能体协作"当成了 prompt 链编排问题。 而他们直接给 AI 身份和职责边界,让协作像人与人配合一样发生。这条路目前看下来挺对的。
余温69,049 Aufrufe • vor 3 Monaten

wok,发现宝了,之前折腾各种远程方案都可以扔了 我经常出门要背那块砖一样的 16 寸 MacBook,就因为随时可能要操作电脑。 期间试过 Tailscale +tmux、Todesk 这些方案,不是配置折腾就是体验差,始终不满意。 最近圈子里有不少大佬在用UU远程,我也试了一下。 看我刚用手机录的这段视频,手机操控电脑几乎零延迟,最高 4K蓝光144 帧,两个显示器来回切也完全流畅。 但最让我惊喜的还是终端功能。 我平时一直在电脑上让AI跑任务,出门在外想看一眼任务状态,就折腾了Tailscale +tmux,说实话,体验确实一般,还总是中断。 UU 远程直接给了终端入口,手机上就能登陆终端看信息和进程。 整个过程就是纯命令行,跟在电脑前开Terminal体验一样,对玩 AI 的人来说这个功能是真的刚需。 UU远程已经两年了,说实话刚开始以为网易迟早要收费,结果到现在依然完全免费、零广告,这两年更新了几十个版本,体验越来越流畅延迟越来越低,还陆续加了远程开关机等实用功能。一直在迭代变好,但始终没收费。 支持手机对电脑、电脑对电脑多端远程控制,还有内网穿透能力,我到现在都不知道他们靠什么回本。
余温59,541 Aufrufe • vor 3 Monaten

好家伙,Seedance 2.5 居然能把动作戏做到这种程度??? 你甚至可以逐帧学习/复刻,因为 Higgsfield 刚把 K-pop 爆火的 Zephyr: Special 开源了。 每个 prompt、每份素材、每个角色全公开,你可以去逐帧研究,成片质量很顶。 我拆了整个项目,这几点真离谱: 1、去 AI 脸有一套固定词库:毛孔、绒毛、碎发、左右脸不对称、皮肤哑光......(牛逼) 2、角色一致性全靠参考图:每条 prompt 都要写清楚 image_1 = 谁、image_2 = 谁,参考图,角色、机甲、场地、连一罐拉面都要有自己的参考图 3、风格锚直接写摄影师名字:不写"电影感"仨字,写 诺兰的摄影指导 + 65mm 大画幅 + 胶片颗粒 + 24fps 做 AI 视频的,这就是现成的教材,项目链接我放评论区,翻起来!!!
余温16,472 Aufrufe • vor 27 Tagen

发现一个很离谱的模型,400 TPS 的输出速度,比 DeepSeek-V4 Flash 快 2 倍多 还有超强的多模态理解 + 搜索检索 + 推理综合,这居然是一个 Flash 模型能同时做到的 我让它帮我写了一个竞品分析 Agent: 输入一张产品官网截图,自动完成"读图提取 → 搜索市场数据 → 输出竞争分析"的全流程。 然后用 Cursor 的定价页试了一下,不到一分钟跑完,花了一毛多: 它先读懂了整个页面(四档定价 × 各档功能差异 × 推荐标签与社会证明),提取出完整的结构化数据。 然后自己决定搜什么,自动生成搜索 query 去查竞品定价、用户评价、市场对比。 最后综合视觉提取 + 搜索结果,给了我完整的竞争分析:定价对比、竞品定位差异、真实壁垒在哪里、切入建议。 这个模型就是 StepFun 的 step-3.7-flash,多模态 + 搜索 + 推理一体化内嵌在模型里,如果你在构建 AI Agent、编码工作流或多模态系统,Step 3.7 Flash 很推荐大家尝试一下: Step海外平台: Step国内平台:
余温41,274 Aufrufe • vor 3 Monaten

太离谱了,我真的就一句话,AI 给我做的黏土风视频,这类视频可以直接去卖“少儿AI教学”了吧。。。 起因是看到老外那闷声发财的赛道: 无人出镜解说频道。不露脸不出镜,全靠解说视频吃广告分成,做得好的一个月几万刀。 我就尝试用 Higgsfield 试了一下,给它一个提示: 「为什么 AI 上下文一长就变笨,用小孩喜欢的黏土风演示给我」。 然后它自己去查资料,写解说稿、配音、生成画面、配字幕,几分钟后直接甩给我一条成片。我中间啥也没干,连剪辑软件都没打开。 以前做这种无人出镜的解说视频,需要:设计、写稿、配音、找素材、剪辑、上字幕,一条视频搞一天很正常。 所以老外那边那些不露脸的解说频道,一直是个闷声赚钱的赛道,门槛全在工作量上。 现在这个门槛又被AI冲没了:脚本、配音、画面、字幕,我直接用 Higgsfield 的 Explainer 内置的,你只需要出选题。 风格啥的随便挑,黏土、动画、涂鸦、剪纸都有,配音想要什么语言就什么语言,已经到了人人都能上桌的地步了。
余温22,517 Aufrufe • vor 1 Monat