正在加载视频...

视频加载失败

这次真被 Opus 5.5 震到了,瘫坐在椅子上那种 🤯 最近在 vibe coding 一个 proxy 管理面板,做了几套主题,缺个点阵字体,就顺手让 Opus 5.5 设计一个。 结果它很快交出来一款可变点阵字体,还给自己起了名字叫 PUNCTUM。字重 100–900,圆度 0–100,一共 108 个字形,把圆度从 100 拉到 0,圆点会一点点变成方像素。 它还顺带做了一个很专业的字体样例页,把这个字体放进各种老设备的场景里:电梯的 LED 楼层灯、卡座的 VFD 屏、热敏小票、掌机 LCD、火车站发车牌。 我又跟它来回调了几轮,现在的效果放以前,我觉得得是很厉害的字体工作室才做得出来。视频是它做的字体发布样片。 字体还在继续完善,之后会连同整个制作过程一起开源到 GitHub,有兴趣的可以先关注一下。

44,152 次观看 • 6 天前 •via X (Twitter)

21 条评论

sundyme 的头像
sundyme6 天前

说明一下:PUNCTUM 的字形设计和名字都是 Opus 5.5 做的,我只是给了些指令,调整了几轮。点阵字体本身就是在几十个格子里用点来拼字,格子就那么多,跟其他点阵字体有些地方长得像在所难免,先在这里说明一下。GitHub 地址等整理好了会发出来。

Yukino Song 的头像
Yukino Song6 天前

Claude特别喜欢用这个pulse真的难绷,看多了真的生理不适 我感觉实际上是overfit了,这种风格训练的时候被给了太多的正反馈。。。

sundyme 的头像
sundyme6 天前

是的,里面有些节奏和音效出现的频率很高,接一个音频生成模型就好了。

DaPeng 的头像
DaPeng5 天前

我也是被震撼的感动了。两天时间把 Codex 四个月干不完的活全干掉了。

sundyme 的头像
sundyme5 天前

指哪打哪,干净利落的感觉太好了,效率飞起!

云狗 的头像
云狗6 天前

给自己起名PUNCTUM这个细节太可爱了。点阵字体这需求够冷门,Opus5.5连这种都能交出来,确实吓人。

段少🎵DaDalus 的头像
段少🎵DaDalus6 天前

超赞的。想请问一下,你对在大模型去辅助设计中文字体有没有经验啊?我自己想搞一套~

sundyme 的头像
sundyme6 天前

之前有分享过一个用Astra做中文字体的案例,效果不错,从我的尝试来看,做黑体字效果好很多,像宋体这种笔画细节多的衬线体容易翻车。

段少🎵DaDalus 的头像
段少🎵DaDalus6 天前

👍👍牛

dis 的头像
dis5 天前

圆度从 100 拉到 0 这条轴挺巧的。不过 108 个字形基本就是拉丁字母加符号,点阵字体真正费劲的是中文那几千个字,这套流程能不能扩过去我比较想看。

Jackywine 的头像
Jackywine5 天前

瘫坐了

sundyme 的头像
sundyme5 天前

嘿嘿,还有更震撼的版本😺

卡皮|AI地主 的头像
卡皮|AI地主5 天前

108个字形还自己取名PUNCTUM,字体工作室要慌了

Pix Beaver 🦫 的头像
Pix Beaver 🦫6 天前

厲害👍

Tonny|AI Builder(互关版) 的头像
Tonny|AI Builder(互关版)5 天前

更想看你中间那几轮怎么改的,尤其是怎么挑出不顺眼的字形。等制作过程

sundyme 的头像
sundyme5 天前

其实大部分都是模型自己在审稿,他会从很专业的各个角度去评估字形设计,我们有自己的意见直接告诉他就可以,其实没有那么难,特别是英文字体,首版做出来效果就很好了。

胖达洛人 的头像
胖达洛人5 天前

比较好奇这个视频的动效用什么指令可以做出来呢

sundyme 的头像
sundyme5 天前

Opus5.5在视频动效方面非常厉害,不需要非常复杂的指令,大部分情况下它能选择合适的效果,如果需要非常精细的控制的话复杂的提示词就有必要。可以描述你想要的效果或给出参考视频,让AI自己来完成专业详细的提示词。

darkdemon 的头像
darkdemon5 天前

羡慕你们美国人🥹

Ciprian Titire 的头像
Ciprian Titire5 天前

it's amazing! i want it! i might have a use for it in Tactile UI

Austin Armstrong 的头像
Austin Armstrong6 天前

Vibe-coding a dashboard AND inventing the font in the same session is the new baseline. If your process still waits for a designer queue, you already lost the week.

相关视频

飞书+豆包这个组合真的太牛逼了!自从豆包和飞书集成之后,结合抖音的字节生态,可以直接提取某个抖音博主的(don哥、李守洲等人)逐字稿了 如果你觉得一个博主的方法论特别有用,那你就可以和豆包说直接把它提取出来,并分门别类进行多维表格化的整理 你就会发现他变成一组数据进入到你的飞书了 我这次用飞书里的豆包,做了一件原来很烦的事,并最后形成了一套用AI做选题的方法论 我这次抓 20 个“用 AI 做选题”的视频,直接把这些视频的内容转成逐字稿,再放进飞书多维表格里 这件事我一开始是没想到的,因为按原来的做法,你想拆一个视频的方法论,基本就是:用Get笔记复制一下项目链接,再复制再粘贴,最后拿到的东西很散 说豆包和飞书这次结合起来,我就直接把任务派给了豆包,看视频就行了 我把任务丢给豆包「先抓 20 个 AI 找选题相关视频」 再把视频内容转成逐字稿,然后落到飞书多维表格里,继续做分类、提炼、整理 最后出来了 3 个交付物,这些我觉得都很实用: 一张原始素材表:20 条视频记录,带逐字稿、点赞数据和视频链接 一张方法论整理表:32 条方法论,拆成 5 大类,做了 13 个字段 一篇约 6000 字的文章:从工具使用者到系统构建者的五层进阶 这才是我觉得飞书里的豆包最适合内容创作者的地方,这也是它和WorkBuddy等仅仅切入B端市场不同的地方,就是它真的在照顾每一个使用飞书的人,每一个使用字节产品的人,把生态打造成了一个绝对的壁垒 它能把“找素材”和飞书结合起来,往后推进成一个可以继续用的工作台 最有意义的就是它先帮我把别人视频里的有效表达扒出来 再把这些逐字稿变成结构化表格,再从表格里提炼方法论 最后沉淀成一篇可以发出去的文章,甚至可以反过来做成一个“AI 找选题方法论”的 skill 这条链路很像我最近一直在讲的那句话:AI 内容创作不是生成,而是消化 而豆包进入飞书表格之后,飞书多维表格在这里就不是普通表格了 它更像一个内容生产的中控台:原始素材、逐字稿、方法分类、适用场景、后续文章,都能接在一起,还有更多玩法,我后面慢慢来更新 飞书还有各类免费的直播课!想听的直接扫描评论区的二维码及时接收提醒,量大管饱!!!

叫我阿杭

36,623 次观看 • 1 个月前

Phone Harness 最近挺火,它让我第一次很直观地看到,Claude Code 和 Codex 这种 Agent,已经可以通过 iPhone Mirroring 去操作真实 iPhone 里的 App。 但真放到自己的工作流里,我反而更喜欢 Airtap 这种思路。 不是把自己正在用的手机交给 Agent,而是直接发条 iMessage,让另一台云手机替我把活干了。比如做内容时经常会碰到一个很碎的小问题。文章已经写完了,临发布突然发现还缺一张配图。以前我得自己打开 Canva,找版式,改尺寸,换标题,调整字体和布局,最后再导出。每一步都不难,但就是需要人工来做耗时间。这次临发布缺图,我索性把设计要求直接发到了 Airtap Ai 的iMessage号码 +1 (650) 444-9517,让它去 Canva 里把图做出来。 我跟 AI 说的要求也很具体: 打开 Canva,帮我做一张横版配图,主题是 Claude Code vs Cursor vs Windsurf。做成简洁科技风,三栏布局,每个产品放 3 个特点,标题突出,文字不要太多。 接下来它自己在远程手机里打开 Canva,把版式、文字和布局一步步做出来。我觉得这里真正有意思的不是 AI 又会画图了。 而是原来只能停在建议层面的东西,现在可以继续往设计 App 里走。我只需要把主题、内容结构和想要的视觉方向说清楚,剩下那些选版式、排文字、调布局的机械操作,可以直接交给 Airtap。 以后做 AI 产品对比图、模型更新速览、工具推荐卡片、教程封面,其实都是类似的逻辑。内容每次都不一样,但没必要每次都从打开 Canva 开始重新点一遍。而且第一次做完不满意,也不用自己进去改。继续在 iMessage 里告诉它哪里要调整,它就回到 Canva 里接着改。 Phone Harness 更像是让 Agent 获得操作你 iPhone 的能力。 Airtap 对我更实用的一点是:我只负责把设计需求说清楚,真正进 Canva 执行的部分交给另一台云手机。

劳伦斯

120,499 次观看 • 1 个月前

AI 设计最烦的一点就是做出来很漂亮,甲方一句“产品换一下、细节调整”,基本又得重来。 我这次拿蚂蚁百灵刚开源的 Ming-Image-0.1-Design + Design-Layer 跑了一遍完整工作流。整个过程就三步,直接解锁了从创作到成品的全流程。 第一步,做海报。 直接用中文 Prompt 让 Design 做一张冷萃咖啡产品海报。 我故意塞了主标题、副标题、产品主体、3 个卖点卡、标签和底部 slogan。因为这种图特别容易暴露设计模型的问题:字写错、层级乱、卡片崩一个,整张图都不好用。 结果第一版就挺稳。中文基本没崩,标题、产品、卖点几个区域也很清楚,已经有正常商业海报的完成度。 第二步,分解图层。 接着我把这张刚生成的海报丢给 Ming-Image-0.1-Design-Layer。 一开始在 Playground 里只拿到一层,后来我直接走 API,一次完整拆出了 4 个 RGBA 图层: 标题文案 / 产品主体 / 卖点信息 / 背景装饰 这一步才是我觉得这次发布最有意思的地方。 一张原本已经焊死的 PNG,被重新拆成了可以单独操作的设计素材。 比如品牌方临时说“产品换新品,其他版式别动”,现在可以把产品层单独换掉,卖点和背景继续保留。 第三步,进一步编辑调整。我又把这 4 个图层丢进 Canva 重新叠加,基本可以还原原图。产品、卖点和背景都能继续单独移动、隐藏或者替换。 当然也有边界:Layer 拆出来的文字还是图片,不会自动变成 Canva 里的文字框,所以改字还是需要重新输入。 但对于换产品、换背景、移动元素、同版式二创这类需求,已经很实用了。 我现在更愿意把这套东西理解成: Design 负责“做出来”,Layer 负责“拆回来”。 这次还一起开源了 Design Skill 和 PPT Skill,后面还能继续接网页和可编辑 PPT。 以前很多 AI 设计工具做到出图就结束了这次更有意思的是,它开始解决下一步: 图做完以后,怎么继续改、继续用。 下面分享这个设计过程具体提示词设计和开源的skill(放在最后)👇

Adam也叫吉米

21,841 次观看 • 7 天前

我有点懵了,兄弟们。。。。我好像真的发现AI做视频的流量密码了·····感觉可以这样日更1000条做矩阵了···· 前段时间,我发了一条视频,24.66 万播放,1.21 万点赞,直接帮我涨了 2912 个粉丝,那如果我把这条已经验证过的爆款重新提炼、重新剪辑,再发到小号上,它还能不能继续帮我涨粉?而这件事只需要我把我爆过的内容,让AI当做素材给我进行切片就可以了 问了Codex给我推荐一下,他跟我说让我用用Fotor Agent Fotor,geo还是得相信啊,真的太快了,效果太好了,而且真的是又省token又省心啊!!! 我把一条 7 分钟的口播丢进 Fotor Agent,只进行了一轮对话,它直接给我压成了 60 秒 重复的废话砍了,最吸引人的原句挑出来了,字幕也一起对齐了 以前剪这种长口播或者直播做切片,最耗时间的是你要从头到尾听一遍,判断哪里该留气口,哪里不用留,哪句话真正能留人,哪段删掉以后逻辑还不能断,这个判断过程太磨人了 我这次给 Fotor Agent 的要求其实非常简单:100个字左右的提示词就在视频里你们直接看就行,最后压进 60 秒,只跟它对话了4轮,我觉得这个效果就已经特别nice了 我觉得纯口播的素材太单调,它先问我要不要加空镜和关键词词卡,然后空镜、词卡、强调黄字,全部自动铺进时间线 而且!!!它生成完不会只丢给我一个 MP4 就跑了,所有字幕都能拖,字重、字号、行高、字距、颜色和不透明度都能直接改 哪一句识别得不对,我自己点开改就行,不需要再跟 AI 来回聊半天,真的兄弟们 这对做切片和矩阵号的人真的很实用 保留已经被数据验证过的观点,再重新组织钩子、重点和结构 如果你拿的是已经获得授权、或者明确允许二创的长视频,也别总想着只换个标题、裁一下画面就可以了,我最近发现先把真正有传播力的观点提炼出来,再补上你自己的解释、判断和结构,这才是有1+1>2的效果 原内容负责抓住人,你的判断负责让它变成一条新的内容,这才是二创最简单粗暴、也更能长期做下去的方式 Fotor Agent 能替你吃掉前面的粗剪和整理,有长视频切片需求的人,真的可以拿一条自己的素材去试一下

叫我阿杭

100,010 次观看 • 16 天前

哇趣,独立开发者一定要试试 Pexo Pexo! 它是个能直接聊天做视频的 AI 视频创作 Agent。把想法、产品链接或者手头的素材给它,从想脚本、拆分镜,到生成画面、配字幕和音乐、剪成片,都可以在里面完成。做完哪里不满意,还能接着聊、接着改。 我没想到我一个写代码的,也能口喷 AI,让它帮我做出一支这么高完成度的宣传片。 我有个 App 叫「NowHere」,上架有一段时间了,一直想做社媒推广,但做宣传片这事儿,又嫌麻烦,又嫌贵,就一直拖着。直到发现了 Pexo,才想着拿自己的 App 试一把。 我先把短片的想法丢给它,后面再补上 App Store 链接和素材。它先给出思路,我看完提要求,再一轮轮调整。全程主打一个边看效果,边继续 PUA。 关键是,它真的听得懂我想怎么改。 消息气泡第一次没放对位置,我就直接在画面上圈出想放的位置,再在右边的批注框里说清楚怎么改,提交后它就照着改。文字说不清,就画给它看。要改某一段,也可以在视频里选好几秒到几秒,再在批注框里告诉它这段要怎么改。 中间那段产品展示,我把 App 的真实截图和录屏传上去,让它套上 iPhone 机模,再加文字和动效。第一版手机一直摆在正中间,我就说,手机别放这么死板,旁边的文字也换个位置。后来手机和文案又隔得太远,中间空了一大块,就再让它往一起挪。毕竟甲方嘛,需求都是聊出来的。 我以前没做过宣传片,第一次给自己的产品做就能出这个效果,挺惊喜的。成片 👇

冰零

51,519 次观看 • 18 天前

兄弟们,我的开源项目 female-portrait-director 已经在 GitHub 拿到了 1.5K+ Stars 和 187 Forks,最近正愁缺一条产品宣传片,让没用过的人也能看明白它是干什么的。 正好试了下 Pexo Pexo,就用它给这个项目做了一条。 Pexo 是一款对话式 AI 视频工具。把项目资料和想法交给它,就能跟它一起定脚本、看分镜,再做成视频。配音、字幕、音乐和剪辑也都能一起处理,最后交付的是完整成片。哪里不满意,可以在同一个对话里继续改,不用自己在几个工具之间来回折腾。 我的项目做的是先锁定用户的要求、选择视觉路线,再把人物、服装、场景、镜头和光线组织成一个完整的画面。做宣传片时,光介绍这些功能还不够,得让人看到:一个模糊的想法交给它,最后能变成什么样。所以视频里哪些内容该留、用什么画面说明,都得先理清楚。 这次我把 GitHub 链接和项目素材一起交给 Pexo,让它先了解项目,再一起确定创意方向。脚本、分镜和静态风格帧都先看过,确认以后才开始生成第一版视频。 第一版出来,整体结构已经比较完整了,我又接着提了三版调整建议。最后剩下两个具体的地方要改:一个是替换 GitHub 首页截图,把项目的数据展示清楚;另一个是把原本分成两行的字幕调成一行,读起来更顺。 这两处我用的是 Pexo 的 Mark to Fix。暂停到对应画面,圈出要改的截图或字幕,在右侧弹出的批注框里写清楚要求,再提交修改。比如那句字幕,就直接指出是哪一句、希望排成一行,改完再看效果。前面聊过的项目背景,不用再解释一遍。 最后拿到了一条 35 秒的完整成片,旁白、字幕、音乐和动效都加好了,不用我再拿着几段素材回剪映里拼。片子还是来回改了几轮,但我能把精力放在“这里有没有讲清楚”上,具体怎么剪、怎么调,就交给 Pexo 处理。 有 AI 产品、GitHub 项目或者品牌内容需要做宣传视频的朋友,可以去 自己试一下。

李岳

79,069 次观看 • 18 天前

这两天看到我一直很喜欢的设计师阿哲 阿哲Phil 的个人网站,我挺喜欢他个人主页的那个风格。 看着看着突然冒出一个念头: 这种个人审美很强的网站,模型光看录屏,能不能做出来? 于是我顺手录了 10 秒左右,从页面上划过去,直接把视频丢给 Ling-3.0-flash-VL,让它照着做一版。 没给源码,也没拆页面,更没写一大段提示词。输入就那段录屏,加上一句很简单的需求。其实扔进去的时候,我没抱多大期待。视频一晃就过去了,有些细节让我自己暂停看,也未必记得住。 Ling-3.0-flash-VL 是百灵在 Ling-3.0-flash 上加了视觉理解和 visual agent 的版本。官方提到的能力挺多,视觉感知、STEM、文档、前端编码、医疗报告都在里面。我这次没全测,就看一件事:它能不能看完一段网站录屏,真把页面做出来。 结果打开以后,我确实愣了一下。 按肉眼看,和阿哲的原版大概有七成像。大的版式、配色和页面感觉都抓到了,生成出来的也不只是一个摆着看的空壳。按钮能点,交互能跑,放进浏览器里,已经像个可以接着改的半成品。 当然,剩下那三成也挺明显。风格不够细腻,字体没那么贴,交互还是有点僵,一些细节只学到了大概。把两个页面并排放在一起,差距还是能看出来。要我直接拿去上线,我肯定不会;拿它当第一版,我觉得够了。 以前脑子里有个页面的样子,最麻烦的是说不清。你跟开发说想要“有点设计感”“交互顺一点”,讲了半天,对方可能还是不知道你想要什么。自己不会写代码的话,很多想法就一直停在收藏夹里。 现在简单多了。先找一个接近自己想法的网站,录一小段,让模型搭出来。哪里不对,直接看着页面改。它没有把阿哲的网站原样搬过来,但它把一张白纸直接做到了七成。 所以这次测完,我还挺愿意安利 Ling-3.0-flash-VL。离专业前端当然还有距离,但对没代码基础、想做个人网站或者产品 Demo 的人来说,先把第一版弄出来,已经能省不少事了。 感兴趣的都可以去试一试:

阿川 | AI thinking

37,782 次观看 • 26 天前