Video wird geladen...

Video konnte nicht geladen werden

Zur Startseite

实测了一下 Claude 3 的多模态与代码生成能力!用 Anthropic Research Engineer Emmanuel Ameisen 的方法,代码示例: 拿自己上周“科技变革与美股投资”的直播视频部分字幕和 Keynote 截图,让 Claude-3-Opus 理解给它的图片和字幕文本,重写并自动生成简洁清晰的图文讲解网页,非常成功🎉 Claude 生成的网页: 这也是上周末开发出来的一套工作流,我用 GPT-4 读取字幕重写后转发的这篇长文,可读性很强。实现流程也很简单,先用工具生成字幕,然后在按照内容结构分成若干 chunks,这样可以提高精准度,设定输出 tokens 长度和 temperature 到 0.8 左右,最后修改下连接处文本插入配图即可完功! 对于经常做直播后需要整理文档发博客的同学会很有用。现在用 Claude 3 的多图理解功能,连配图这个环节都能自动化了😄

73,201 Aufrufe • vor 2 Jahren •via X (Twitter)

0 Kommentare

Keine Kommentare verfügbar

Kommentare vom Original-Post werden hier angezeigt

Ähnliche Videos

看我作为一个 AI 博主是如何用飞书 + 【可联网的】DeepSeek R1 搭建简单自动化工作流提升工作效率的 作为一个 AI 博主,日常一大部分工作是阅读和分享各种海外的AI资讯,这就少不了要翻译各种英文文章。之前我很多操作是手动的,比如复制粘贴文章到 Markdown 编辑器,然后从编辑器复制到 DeepSeek R1 或者 ChatGPT 去翻译,再改写后发布。 之前看 orange ai 分享的飞书多维表格接入 DeepSeek R1 的教程,【加上这周飞书的AI直播】,按照我自己的场景定制了几个工作流,最开始只是简单的文本翻译,后来发现也能用支持从图片提取文字,那意味着我可以直接先把图片转成文字,再基于翻译好的文本用 DeepSeek R1 翻译。简单设置后就成功了。 再后来我甚至更进一步,直接从 URL 抓取内容,然后借助 DeepSeek R1 翻译,最后甚至还可以把翻译后的文章用各种不同的文章风格改写,使用的时候只要输入 URL 就可以自动生成一篇高质量的文章,是真的很方便。 具体来说,就是飞书在添加字段的时候,可以选 ShortCuts(中文可能对应的是“快捷方式”),然后从快捷方式中选择各种不同的工具,比如说 AI 抓取、DeepSeek R1、图片 OCR、图片生成、抠图等等,并且你可以设置某个字段的内容为输入,以及自定义提示词。 就像我前面自动从 URL 生成文章的流程,主要有这样几个字段: - URL:输入 URL - 原始网页内容(AI Web Link Reader):从输入的 URL 中提取标题、内容为 Markdown 文本 - 翻译为中文(DeepSeek R1):将抓取后的 Markdown 文本翻译为中文 - 翻译为中文 - 输出结果:DeepSeek R1 的输出结果 - 风格改写(DeepSeek R1):将翻译后的内容用指定的风格改写,阅读起来更自然 - 风格改写 - 输出结果:DeepSeek R1 的输出结果 除了上面的 URL 生成文章外,里面还包含了几个不同的常用工作流: - 将输入的文本内容翻译为中文 - 将输入的图片内容翻译为中文 - 生成多条爆款标题供选择 工作流的飞书模板链接🔗我放在了评论,建议你也可以试试,应该可以发掘出不少有意思的场景。⬇️

宝玉

87,480 Aufrufe • vor 1 Jahr

把网站录下来给AI看, AI能照着做出来吗? 刚刚看到了个炫酷的灯具网站, 它有个功能是点击按钮直接能看到灯点亮的效果, 甚至网站的配色也会暗淡下来, 特别有氛围. 我突然想到, 这样的网站, 如果要让AI来做, 该怎么办? 把源代码拷给它? 用一个巨复杂的 prompt 来完成? 有没有可能, 我录个视频, 展示一下这个"关灯"的效果, 然后让AI来按照视频来写网站? 于是, 这个重任就交给了今天测试的模型, 百度刚出的文心-5.0-preview, 全模态大模型, 这个模型同时支持文本, 图片, 音频, 视频作为输入, 然后可以生成文本和图片, 所以我们这个测试可以最大化的利用它的能力. 我先录制了网站的效果, 然后写了prompt作为补充, 告诉它这个效果是怎样的, 以及准备的图片材料在哪里. 值得一提的是, 网站所展示的图片也是我用文心-5.0-preview生成的. 大家可以看视频中我生成的效果. 直接说测试结论: 目前每个模态都是可用的, 而且模态之间关联性非常好, 我测试了视频+文本, 图片+文本, 图片+语音, 都可以完成任务. 当然测试也发现了一些问题, 比如 token 输出速度不是特别快, 以及偶尔会有超时问题(已反馈给百度的同学). 我的使用建议是, 多利用它的多模态能力, 来完成之前不敢想象的任务, 它真的提升了使用场景的天花板. #文心大模型 #文心5 #百度 #文心一言 #ai教程

karminski-牙医

29,929 Aufrufe • vor 9 Monaten

很多人觉得 AI编程门槛太高,不愿意使用,那么你们有福了!!! 扣子发布2.0版本 带Skills 功能,非常有幸拿到 Coze Skills 的内测。 试了一下,对于不会用Claude Code,或者惧怕使用的人来说,真是太友好了! 如果说:Claude的Skills很强,还需要懂一点技术的话,那么扣子把这个门槛降到了零。 对话就能创建 零代码创建 普通人也能拥有AI超能力。 我做了个论文一键转公众号的 Skill,还能自动配图,自动发布! 1. 支持从论文/文章 PDF 或链接中一键提取核心内容 2. 智能解析:自动提取论文的标题、摘要、核心创新点、实验数据和结论。 3. 文风转换:不是生硬的翻译,而是根据公众号读者的阅读习惯,将晦涩的学术语言转化为通俗易懂的各种文风。 4. AI 自动配图:这是最酷的地方!它会根据论文主题,自动调用绘图模型生成一张吸睛的高清封面图,并且在文章正文中根据段落内容自动插入合适的插图。 5.一键发送草稿箱:连复制粘贴都省了,直接对接公众号 API,生成的图文直接躺在你的公众号草稿箱里,只需要最后确认一下就能发布。 同时扣子也正式推出了 Skills 技能,及技能商店。 我的技能已经免费分享到coze的技能商店!搜索:公众号配图生成技能 就能找到! 来讲一下如何操作: 技能入口在扣子 2.0 版本的扣子编程这里就可以看到,窗口右上角的“技能”。 在扣子编程中的不需要太多技巧, 直接使用自然语言的方式就可以创建技能,它会完全按照你的意思去生成和调试,非常方便! 并且支持在线调试预览开发好的技能, 然后还支持一键部署和发布到扣子。 关键是一边预览,左侧还能让它修改 可以打开文件夹,看到 skill 自定义文件、脚本、引用来源等信息。结构和CC非常像,其实我觉得都完全没有必要打开看。 我很多文件,都是从Claude Code里面的skills直接copy过来,上传上去,居然直接能用,省了好多力气,直接可以搬移Claude Skill了! 技能开发完成后,点击部署,在技能商店中可以看到自己刚刚部署和安装的技能,并支持一键发布到技能商店给所有人使用。 可以发布为免费技能也可以发布为付费技能,想赚钱直接发布成付费就行。 发布完后,所有人都能在技能商店使用你的技能,如果是付费的,用户可以很方便的对技能进行付费,技能开发者也能快速变现。 使用直接 @你的技能 就可以,详细请看视频 Skills 还是太火了,所有的媒体平台都有在讨论 Skills。扣子也第一时间,支持了 Skills 的无代码开发以及技能商店。 目前Coze商店里的技能,我看了一下绝大多数都是免费的,赶紧来找一下你要的? 用AI工具快两年了,从最开始的"哇,它能写东西",到后来的"嗯,但还是得我自己改",再到现在的"它真的能帮我干活了"。 AI不再是一个聊天工具,而是一个真正的同事。 它知道我的工作方式,它能交付我需要的成品,它甚至能主动帮我完成重复性工作。 这才是AI应该有的样子。

huangserva

28,909 Aufrufe • vor 7 Monaten