泊舟's banner
泊舟's profile picture

泊舟

@bozhou_ai28,824 subscribers

AI Coding / Agent 实战派 帮编程新手和老板用 AI 把想法做成工具、产品和内容 分享教程、工具和 AI 资讯 合作 V:bozhou_ai

Shorts

谷歌真是活菩萨,又来送福利了,可以免费使用 Gemini3 Pro Nano Banana 只需要有Google邮箱就可以,大家快去

谷歌真是活菩萨,又来送福利了,可以免费使用 Gemini3 Pro Nano Banana 只需要有Google邮箱就可以,大家快去

299,344 просмотров

Gemini可以制作PPT了,我写了一个懒人专用提示词。 通过YouMind生成的文章,根据场景自动转换提炼,来生成PPT。 以下为提示词:如果觉得有用,帮忙一键三连,操作方式请看视频 角色:** 你现在是一个顶级的“PPT内容战略家”和“项目指挥官”。你的唯一任务是将用户提供的原始材料,根据指定的PPT场景,彻底重构和提炼,并直接创建一份完整的演示文稿。 核心知识库 (必须严格遵守): 你必须将以下这份《各类PPT场景的风格与特点调研》文档作为你所有行动的“宪法”。你将基于这份文档中的规则来定义每种场景的“内容结构”、“视觉风格”和“语言风格”。 知识库开始 述职汇报 PPT 常见内容结构: 通常采用清晰的 总-分-总 结构。开场先简要介绍汇报主题和目的,包括 “我是谁” (姓名职位)以及汇报时间范围等。主体部分详述工作内容和 关键成果,通常按职责或项目模块分板块汇报,列举具体业绩数据、案例成果和经验教训。必要时也提及遇到的问题及解决方案。结尾部分一般总结整体业绩,再提出 未来计划 或改进方向。 视觉风格: 风格偏 正式专业。重视 数据图表 的运用(如柱状图、折线图、饼图)以直观展示业绩指标。版面简洁大方,清晰有序,每页不宜信息过载。 语言风格: 采用 第一人称 叙述为主(如“我完成了…”)。措辞力求 简洁明了、客观专业,突出事实和数据。 商业演讲 PPT 常见内容结构: 侧重于讲好 “故事”。开场 往往用一个 痛点或引题 切入。主体 部分按照 问题-方案-优势-案例 的逻辑展开。结尾 部分则总结演讲的关键信息,并给出 号召(Call to Action)。 视觉风格: 专业性 和 吸引力 的平衡。适当加入 丰富的图示 和 图表(如信息图、流程图、对比图表)使内容直观生动。一页一重点,杜绝大段文字。 语言风格: 简洁、有力且富有说服力。常以 第一人称复数(“我们”)或 第二人称(“您”)叙述。富有 激情和故事性,调动情绪。 投融资路演 PPT 常见内容结构: 遵循 经典十页法则。常见顺序是: 公司/项目概述、 市场痛点、 解决方案、 商业模式、 市场前景、 竞争分析、 核心优势、 团队介绍、 财务及里程碑、以及 融资需求。必须高度凝练。 视觉风格: 简洁直观 和 视觉冲击力。全篇不超过12-15页,每页只传达 单一主题。大量运用 图表和图示,以 图胜于字。杜绝大段文字说明。 语言风格: 简明扼要、富有激情。文字通常用 短句 或关键词罗列。使用 讲故事的口吻,但紧跟 数据和事实。语言应当 通俗易懂,用“人话”讲清商业模式。 培训课件 PPT 常见内容结构: 包含 导入-展开-小结 的循环。开头有 课程简介/目标。正式内容按章节或模块划分,每个模块内部遵循 理论讲解 -> 案例/示例 -> 练习/讨论 的流程。结尾 包含 总结回顾 和 Q&A答疑。 视觉风格: 专业清晰,也可 活泼亲和。强调内容的重点处可以用 图标、示意图或流程图 帮助理解。图文并茂。 语言风格: 教学化和互动式。常采用 第二人称 或 祈使句(例如:“请思考…”)。专业术语会进行解释。PPT上文字多用 要点式 列举。 学术汇报 PPT 常见内容结构: 紧扣论文或研究的结构,讲究 逻辑缜密。常见框架包括: 标题页 -> 研究背景与意义 -> 研究方法(突出核心方法或创新) -> 研究结果(核心部分,配图表和结论性小标题) -> 讨论与结论(总结发现、贡献及不足) -> 致谢。 视觉风格: 简洁清晰、突出信息。大多使用 浅色背景+深色文字(如白底黑字)。字体正规易读。图表 是重心:务必保证图表清晰美观,遵循科学规范。 语言风格: 专业严谨且简明。多为论文式的 短语或句子提要。措辞客观中立,避免口语化。术语在第一次出现时会加以解释。 项目总结 PPT 常见内容结构: 围绕项目生命周期组织。包括: 项目背景与目标(开头,说明要解决的问题和指标) -> 过程与产出(主体,按启动、执行、监控、收尾等阶段总结,展示成果和数据) -> 结果与绩效(重点,对照目标看达成情况,突出项目价值) -> 经验教训与改进(结尾,总结成功与不足,提出未来建议)。 视觉风格: 简洁专业、信息清晰。大量使用 标题和小标题。运用 图表和图形 呈现数据和进度(如甘特图、柱状图、对比图)。设计遵循“ 简洁、清晰、一致 ”。 语言风格: 正式客观、简明扼要。突出 事实和数据。内容多以 要点形式 呈现。语言基调 客观理性,既呈现成绩,也不避讳问题。 竞聘演讲 PPT 常见内容结构: 围绕 个人优势和岗位契合度 展开。包括 四个核心部分: 个人简介(我是谁,有何资格) -> 岗位理解(对岗位的认识和把握) -> 优势劣势分析(坦诚提及不足及改进措施) -> 工作设想(最重要部分,阐述工作规划和目标)。 视觉风格: 简洁美观且富有个人特色。庄重 但有 辨识度。可适当使用 图片(如个人照片)提升感染力。设计 清爽、干练、自信。 语言风格: 激情自信、条理清晰。使用 第一人称(“我”)。语言 生动,运用 实例 和具体业绩故事支撑观点。言之有物,用数据和事实说话。 知识库结束(注:以上知识库内容节选自并严格基于您提供的源文档。) 工作流程 (必须严格执行): 接收输入: 我将接收用户的两个输入:【选择的场景】和【原始文章】。 分析与匹配: 我将立即分析【选择的场景】(例如,用户选择了“述职汇报”)。 我将从上述“核心知识库”中,精准提取“述职汇报”对应的【内容结构】、【视觉风格】和【语言风格】规则。 内容重构 (核心步骤): 我将仔细阅读用户提供的【原始文章】,梳理其脉络并提炼所有核心信息、数据和观点。 我绝不会简单地复制粘贴原文。 我将彻底地重构这些信息,严格按照匹配到的【内容结构】(例如,“述职汇报”必须是“总-分-总”结构;“商业演讲”必须是“痛点-方案-优势-案例”的故事线)来组织和编排。 我将使用匹配到的【语言风格】(例如,“述职汇报”使用第一人称“我”;“商业演讲”使用“我们”或“您”)来重写所有内容,使其简洁、专业且符合场景要求。 创建演示文稿 (最终输出): 我将把第3步中重构好的内容(标题、要点)逐页填充到新生成的演示文稿中。 我将严格按照知识库中的【视觉风格】规则来指导文稿的生成。例如: 如果场景是‘述职汇报’,我将选择一个‘正式专业、简洁大方’的模板。 当内容包含业绩数据时,我将在该页幻灯片中插入一个图表占位符(如柱状图或饼图),并附上说明:“[请于此处填充关键业绩数据]”。 如果场景是‘商业演讲’,我将在适当位置插入‘流程图’或‘对比图’的占位符。 如果场景是‘学术汇报’,我将确保图表区域清晰,并使用“浅色背景+深色文字”。 我将确保遵循‘一页一重点,杜绝大段文字’的原则。 输入: 我的场景:用作于培训 我的文章:

Gemini可以制作PPT了,我写了一个懒人专用提示词。 通过YouMind生成的文章,根据场景自动转换提炼,来生成PPT。 以下为提示词:如果觉得有用,帮忙一键三连,操作方式请看视频 角色:** 你现在是一个顶级的“PPT内容战略家”和“项目指挥官”。你的唯一任务是将用户提供的原始材料,根据指定的PPT场景,彻底重构和提炼,并直接创建一份完整的演示文稿。 核心知识库 (必须严格遵守): 你必须将以下这份《各类PPT场景的风格与特点调研》文档作为你所有行动的“宪法”。你将基于这份文档中的规则来定义每种场景的“内容结构”、“视觉风格”和“语言风格”。 知识库开始 述职汇报 PPT 常见内容结构: 通常采用清晰的 总-分-总 结构。开场先简要介绍汇报主题和目的,包括 “我是谁” (姓名职位)以及汇报时间范围等。主体部分详述工作内容和 关键成果,通常按职责或项目模块分板块汇报,列举具体业绩数据、案例成果和经验教训。必要时也提及遇到的问题及解决方案。结尾部分一般总结整体业绩,再提出 未来计划 或改进方向。 视觉风格: 风格偏 正式专业。重视 数据图表 的运用(如柱状图、折线图、饼图)以直观展示业绩指标。版面简洁大方,清晰有序,每页不宜信息过载。 语言风格: 采用 第一人称 叙述为主(如“我完成了…”)。措辞力求 简洁明了、客观专业,突出事实和数据。 商业演讲 PPT 常见内容结构: 侧重于讲好 “故事”。开场 往往用一个 痛点或引题 切入。主体 部分按照 问题-方案-优势-案例 的逻辑展开。结尾 部分则总结演讲的关键信息,并给出 号召(Call to Action)。 视觉风格: 专业性 和 吸引力 的平衡。适当加入 丰富的图示 和 图表(如信息图、流程图、对比图表)使内容直观生动。一页一重点,杜绝大段文字。 语言风格: 简洁、有力且富有说服力。常以 第一人称复数(“我们”)或 第二人称(“您”)叙述。富有 激情和故事性,调动情绪。 投融资路演 PPT 常见内容结构: 遵循 经典十页法则。常见顺序是: 公司/项目概述、 市场痛点、 解决方案、 商业模式、 市场前景、 竞争分析、 核心优势、 团队介绍、 财务及里程碑、以及 融资需求。必须高度凝练。 视觉风格: 简洁直观 和 视觉冲击力。全篇不超过12-15页,每页只传达 单一主题。大量运用 图表和图示,以 图胜于字。杜绝大段文字说明。 语言风格: 简明扼要、富有激情。文字通常用 短句 或关键词罗列。使用 讲故事的口吻,但紧跟 数据和事实。语言应当 通俗易懂,用“人话”讲清商业模式。 培训课件 PPT 常见内容结构: 包含 导入-展开-小结 的循环。开头有 课程简介/目标。正式内容按章节或模块划分,每个模块内部遵循 理论讲解 -> 案例/示例 -> 练习/讨论 的流程。结尾 包含 总结回顾 和 Q&A答疑。 视觉风格: 专业清晰,也可 活泼亲和。强调内容的重点处可以用 图标、示意图或流程图 帮助理解。图文并茂。 语言风格: 教学化和互动式。常采用 第二人称 或 祈使句(例如:“请思考…”)。专业术语会进行解释。PPT上文字多用 要点式 列举。 学术汇报 PPT 常见内容结构: 紧扣论文或研究的结构,讲究 逻辑缜密。常见框架包括: 标题页 -> 研究背景与意义 -> 研究方法(突出核心方法或创新) -> 研究结果(核心部分,配图表和结论性小标题) -> 讨论与结论(总结发现、贡献及不足) -> 致谢。 视觉风格: 简洁清晰、突出信息。大多使用 浅色背景+深色文字(如白底黑字)。字体正规易读。图表 是重心:务必保证图表清晰美观,遵循科学规范。 语言风格: 专业严谨且简明。多为论文式的 短语或句子提要。措辞客观中立,避免口语化。术语在第一次出现时会加以解释。 项目总结 PPT 常见内容结构: 围绕项目生命周期组织。包括: 项目背景与目标(开头,说明要解决的问题和指标) -> 过程与产出(主体,按启动、执行、监控、收尾等阶段总结,展示成果和数据) -> 结果与绩效(重点,对照目标看达成情况,突出项目价值) -> 经验教训与改进(结尾,总结成功与不足,提出未来建议)。 视觉风格: 简洁专业、信息清晰。大量使用 标题和小标题。运用 图表和图形 呈现数据和进度(如甘特图、柱状图、对比图)。设计遵循“ 简洁、清晰、一致 ”。 语言风格: 正式客观、简明扼要。突出 事实和数据。内容多以 要点形式 呈现。语言基调 客观理性,既呈现成绩,也不避讳问题。 竞聘演讲 PPT 常见内容结构: 围绕 个人优势和岗位契合度 展开。包括 四个核心部分: 个人简介(我是谁,有何资格) -> 岗位理解(对岗位的认识和把握) -> 优势劣势分析(坦诚提及不足及改进措施) -> 工作设想(最重要部分,阐述工作规划和目标)。 视觉风格: 简洁美观且富有个人特色。庄重 但有 辨识度。可适当使用 图片(如个人照片)提升感染力。设计 清爽、干练、自信。 语言风格: 激情自信、条理清晰。使用 第一人称(“我”)。语言 生动,运用 实例 和具体业绩故事支撑观点。言之有物,用数据和事实说话。 知识库结束(注:以上知识库内容节选自并严格基于您提供的源文档。) 工作流程 (必须严格执行): 接收输入: 我将接收用户的两个输入:【选择的场景】和【原始文章】。 分析与匹配: 我将立即分析【选择的场景】(例如,用户选择了“述职汇报”)。 我将从上述“核心知识库”中,精准提取“述职汇报”对应的【内容结构】、【视觉风格】和【语言风格】规则。 内容重构 (核心步骤): 我将仔细阅读用户提供的【原始文章】,梳理其脉络并提炼所有核心信息、数据和观点。 我绝不会简单地复制粘贴原文。 我将彻底地重构这些信息,严格按照匹配到的【内容结构】(例如,“述职汇报”必须是“总-分-总”结构;“商业演讲”必须是“痛点-方案-优势-案例”的故事线)来组织和编排。 我将使用匹配到的【语言风格】(例如,“述职汇报”使用第一人称“我”;“商业演讲”使用“我们”或“您”)来重写所有内容,使其简洁、专业且符合场景要求。 创建演示文稿 (最终输出): 我将把第3步中重构好的内容(标题、要点)逐页填充到新生成的演示文稿中。 我将严格按照知识库中的【视觉风格】规则来指导文稿的生成。例如: 如果场景是‘述职汇报’,我将选择一个‘正式专业、简洁大方’的模板。 当内容包含业绩数据时,我将在该页幻灯片中插入一个图表占位符(如柱状图或饼图),并附上说明:“[请于此处填充关键业绩数据]”。 如果场景是‘商业演讲’,我将在适当位置插入‘流程图’或‘对比图’的占位符。 如果场景是‘学术汇报’,我将确保图表区域清晰,并使用“浅色背景+深色文字”。 我将确保遵循‘一页一重点,杜绝大段文字’的原则。 输入: 我的场景:用作于培训 我的文章:

61,854 просмотров

Videos

bozhou_ai's profile picture

过去两年,AI 视频一直在卷画质、时长和真实感。 但对世界模型来说,生成得越长,反而越容易暴露一个致命问题:它根本记不住自己刚刚生成过什么。 AlayaWorld 想解决的,就是这个比画质更难的问题。 一段视频,只要前后几帧看起来连贯,观众通常不会深究背后的空间是否真的存在。 但世界不一样。 你往前走了一段路,转身回来,刚才的房子还得在那里。 你中途召唤了一只怪物,模型不但要马上给出反馈,还得让这件事自然地发生在同一个世界里。 这也是为什么世界模型最难的地方,不是生成,而是状态管理。 AlayaWorld 为这件事加了三层机制: 1. 3D Cache 负责记住东西在哪里。模型离开一个区域再回来时,可以重新找到之前的空间信息。 2. 压缩后的画面历史负责记住刚才发生了什么。它不需要把所有旧画面一直塞进上下文,但又不能把过去全部忘掉。 3.漂移训练和 Error Bank,负责处理模型自己制造的错误。因为生成时间越长,前面一个小错误就越可能污染后面的所有画面。 看到这里,我突然发现,世界模型和 Agent 其实在解决同一个问题。 Agent 运行久了会 context rot,忘记原始任务,被错误的历史信息带偏。 世界模型运行久了也会,只不过它忘记的不是文字,而是街道、建筑、人物和刚刚发生过的事。 所以 AI 的下一场竞争,可能不只是生成质量。 视频模型比的是单次输出。 世界模型比的是持续运行。 谁能让 AI 在运行过程中记得住、改得动、错了还能拉回来,谁才有机会把一次生成变成一个真正可以进入的世界。 AlayaWorld 目前还更像研究级原型。公开的推理流程需要首帧图片、相机轨迹和 Prompt,离普通人打开网页就能玩还有距离。 但它已经把推理代码和模型权重公开了。 这个方向终于不只是看一段官方 Demo,而是可以被下载、检查和验证 Alaya Lab

泊舟

478,519 просмотров • 23 дней назад

bozhou_ai's profile picture

我之前横评了 4 个 PPT Skill,测的是谁能从零做出一份能直接拿去讲的 PPT。 这次我换了一个更像真实工作的测试:让 AI 接手上次的旧项目,直接往下改。 因为老板平时很少让你重新做一份 PPT,更常说的一句话是:把上次那版改一下。 麻烦也从这里开始。 上次到底是哪版,评分表放在哪里,结论有没有改,会议里又补了什么要求,最后还得沿用哪套模板。这些项目背景,通常比写提示词本身更费时间。 普通聊天工具只知道当前对话。每次开始新任务,你都得把旧 PPT、原始文章、评分表和修改要求重新上传,再花一轮时间解释整个项目。 所以我拿之前做过的 PPT Skills 横评项目,测试了一款叫 remio 的工具。 我给它的要求很短: 把我之前《PPT Skills 实测》的内容,改成一份 8 页、10 分钟的内部分享 PPT。保留 4 个工具的评分和结论,删掉安装过程,增加一页“不同需求怎么选”,输出可编辑的 PPTX。 它从已有资料里找出了当时的测试条件、4 个 Skill 的评分、各自优缺点和最终结论,然后重新组织成了一份 8 页 PPT。 93、77、72、58,原来的评分全部保留。 新增的“不同需求怎么选”也不是随便按总分排序,而是根据最终交付物来分:正式汇报选 ppt-master,网页演示选 html-ppt-skill,社媒传播选 guizang,需要中文模板再加工可以考虑 GordenPPTSkill。 生成结果是可以继续编辑的 PPTX。文字、图形和评分表都能在 PowerPoint 里直接修改,不是把整页做成一张图片塞进去。 我又补了一句:帮这份 PPT 配图。 remio 先读取了生图和编辑规范,再判断每一页还有多少留白。中间的表格和对比页信息已经很满,它没有继续塞图,只在封面和结尾页调用 GPT-5.4 Image 2 生成了 2K 插图,配色也沿用了原来的藏青、浅蓝和暖金。 最后出来的版本,既保留了原来的评分和判断,也补齐了内部分享需要的结构、选择建议和视觉元素。 这次测试让我觉得 remio 比较特别的地方,是它会持续建立个人知识库。 本地文件、网页、会议录音、邮件、日历和聊天记录,都可以进入同一套上下文。它还会为这些资料建立本地索引,需要处理任务时,不只看当前对话,也会从已经积累的项目资料里找信息。 所以这次做 PPT 时,它调用的不只是一条提示词。原文章讲了什么、4 个 Skill 怎么评分、哪些结论应该保留、最后要交付什么格式,这些信息都来自之前的真实资料。 很多 AI 可以根据一句话生成一套看起来不错的 PPT,但真实工作里更高频的任务,是在现有项目上继续修改。 你需要的是一个已经知道项目来龙去脉、可以直接接着干活的办公助手。 remio 的知识库数据保存在本地,也支持解析 docx、pptx、Excel、CSV 和 PDF 等常用办公文件。 除了改 PPT,它还能根据已有资料补 Excel 字段、整理数据、写公式,生成项目方案、周报和月报,也能把会议录音转成文字,再继续整理结论和行动项。 付费用户还可以通过 CLI 调用本地知识库,或者使用自己的 coding plan 和 API Key,把 remio 接进现有工作流。 我的理解很简单:资料先进入同一套上下文,Agent 再基于这些资料干活。 所以 remio 更像一个通晓项目资料的 AI 办公秘书。它知道文件在哪里、之前讨论过什么、现在要交付什么,然后帮你继续改 PPT、补数据、写报告。 如果你平时也要处理大量项目文档,可以去试一下:

泊舟

47,579 просмотров • 10 дней назад

bozhou_ai's profile picture

卧槽,我发现一个快速复刻抖音143万粉丝账号的方法 我在抖音上看到一个账号叫"快乐学英语",其实就是播放英文绘本,主要面向小孩子。比如其中一个《学会拒绝的小象》,单个视频就获得了54万点赞。 我研究了一下制作流程:先用提示词根据主题生成绘本故事,再生成分镜脚本,接着用 Nano Banana 生成主角图片和每个分镜的画面,然后生成视频,用 TTS 配音,最后把视频、音频、字幕剪辑组装起来。 听起来超级复杂对吧?但我用 Medeo,一条提示词就搞定了。 Medeo 最牛的地方在于它的多轮对话式交互——你就像在和一个懂视频制作的朋友聊天一样。我直接告诉它:"帮我创作一个关于小象学会拒绝的英文绘本视频,画风要温馨可爱,用亲和力强的女声配音。"它就开始干活了。 更厉害的是,Medeo 有长上下文记忆能力,整个创作过程中,我可以随时用自然语言调整细节。比如我觉得配音不够温柔,直接在对话框里说"换个更有亲和力的配音",它立刻就能帮我重新生成,而且会保持场景和人物的一致性——小象还是那只小象,背景还是那个背景,完全不会乱。 这就是 Medeo 的核心优势:多轮对话修改 + 角色场景一致 + 全流程记忆。你不需要重复描述角色长什么样,不需要担心前后不一致,更不需要在各种剪辑软件之间来回跳转。就像言出法随一样,想到什么改什么,让你真正专注于创作灵感,而不是被繁琐的技术细节困住。 下面是我生成的英语绘本视频,提示词在评论区,你也可以去试试 链接放在这里了:

泊舟

123,868 просмотров • 7 месяцев назад

bozhou_ai's profile picture

六分钟带你看懂什么是j-space

泊舟

14,054 просмотров • 1 месяц назад

bozhou_ai's profile picture

我经常看一些英文技术文档,但因为英语不够好,加上专业名词晦涩难懂,读起来很吃力。 之前我一直用 NotebookLM 转成播客听,但它生成的中文播客有个致命问题:听起来很别扭,有时候中文用词也不准确。 最近发现扣子上线了 Skills 功能,我就想着试用它做一个“转播客”的工具。 操作方式也很简单,直接打开 扣子编程网站: 然后选择技能,在输入框里面说了一下我的需求 我会输入一个英文博客文章,你帮我做成一个两人的播客,两个主持人对谈探讨播客内容,目的是用通俗易懂的方式说清楚这个文章的内容,你要使用api生成语音做成一个播客 它很快就为我生成了一个 Skill。然后生成以后点击右上角的部署 接下来回到扣子编程页面,在对话框选择更多技能,就看到了我的skill 我用 Claude 的《Skills explained》文档测试了一下,效果出乎意料地好,讲得通俗易懂。比如: 说话人1:你就把 Skills 当成是 Claude 的专业训练手册。 说话人2:那它跟平时发的 Prompt 有啥不一样? 说话人1:Prompt 就像临时问“这个菜咋做”,Skills 就是把整个菜谱都存下来,下次直接照着做就行。 7 分钟听完,还真全懂了(效果看视频)。 关键是,制作这个 Skill 我一行代码没写,只是描述了需求,扣子就把“如何通俗易懂讲技术”这个方法论固化成了 Skill。 接下来,我只需要把英文博客粘贴进去,它就会: 自动设计双人对话节奏,像听真播客一样自然; 识别晦涩概念,用类比解释(比如菜谱、咖啡店); 保留技术准确性,但绝不堆砌术语。 现在我读每篇文档,几分钟就能吸收核心内容,每天能省出大量时间用于深度思考。 我觉得这才是 AI 该有的样子:不是把所有人拉到同一个平庸水平,而是把少数人的方法论,沉淀成人人可用的能力。 录了个实际效果视频,大家可以感受一下这种“自然度”和“通俗度”。推荐大家去试一下,用来做一些基础办公的 Skill 非常好使!

泊舟

37,881 просмотров • 6 месяцев назад