GitHubDaily's banner
GitHubDaily's profile picture

GitHubDaily

@GitHub_Daily84,264 subscribers

💡 挖掘开源的价值 🧑🏻‍💻 坚持分享 GitHub 上高质量、有趣、实用的教程、AI工具、前沿 AI 技术 🧐 A list cool, interesting projects of GitHub. ✏️ 公众号:GitHubDaily

Shorts

之前跟大家分享过 Android 系统开源虚拟定位工具 GoGoGo,底下评论不少人在问 iOS 有没有。 无独有偶,今天在 GitHub 上发现了一款支持虚拟定位到全球任意位置的跨平台开源工具:GeoPort。 不仅支持 iOS 17/18 系统,还可以在 Windows 和 Mac 上运行,无需复杂的 Python 环境配置,直接开箱即用。 GitHub: 主要功能: - 全球任意位置模拟,可随便更换任意城市或地标 - 支持最新 iOS 17 和 iOS 18 系统的位置欺骗 - 一键启用开发者模式,自动处理复杂的权限设置 - 提供直观可视化界面,点几下就能开启虚拟位置 在项目的 GitHub 发布页就提供了安装包下载,有需要的同学可以试下。

之前跟大家分享过 Android 系统开源虚拟定位工具 GoGoGo,底下评论不少人在问 iOS 有没有。 无独有偶,今天在 GitHub 上发现了一款支持虚拟定位到全球任意位置的跨平台开源工具:GeoPort。 不仅支持 iOS 17/18 系统,还可以在 Windows 和 Mac 上运行,无需复杂的 Python 环境配置,直接开箱即用。 GitHub: 主要功能: - 全球任意位置模拟,可随便更换任意城市或地标 - 支持最新 iOS 17 和 iOS 18 系统的位置欺骗 - 一键启用开发者模式,自动处理复杂的权限设置 - 提供直观可视化界面,点几下就能开启虚拟位置 在项目的 GitHub 发布页就提供了安装包下载,有需要的同学可以试下。

76,091 Aufrufe

录屏容易,但想让演示视频看起来专业,就得折腾后期剪辑。加个缩放、美化光标、套个好看的背景框,折腾半天。 偶然找到了 Recordly 这个开源工具,用它录屏和后期编辑一站式搞定,直接出成品级的演示视频,可作为 ScreenStudio 的开源平替版。 录完屏自动跳转编辑器,能根据光标活动智能生成缩放建议,还能给画面套上壁纸、渐变、圆角、阴影等样式框,省去单独做动效的麻烦。 GitHub: 摄像头画面可以作为悬浮气泡叠加在录屏上,支持自定义位置、圆角和阴影,还能跟随缩放自动调整大小。 时间轴编辑器支持拖拽裁剪、变速、标注和额外音轨,还可以保存为工程文件随时继续编辑,导出支持 MP4 和 GIF 两种格式。 支持 macOS、Windows 和 Linux 三个平台,如果你经常需要录制产品演示或教程视频,这个工具值得收藏备用。

录屏容易,但想让演示视频看起来专业,就得折腾后期剪辑。加个缩放、美化光标、套个好看的背景框,折腾半天。 偶然找到了 Recordly 这个开源工具,用它录屏和后期编辑一站式搞定,直接出成品级的演示视频,可作为 ScreenStudio 的开源平替版。 录完屏自动跳转编辑器,能根据光标活动智能生成缩放建议,还能给画面套上壁纸、渐变、圆角、阴影等样式框,省去单独做动效的麻烦。 GitHub: 摄像头画面可以作为悬浮气泡叠加在录屏上,支持自定义位置、圆角和阴影,还能跟随缩放自动调整大小。 时间轴编辑器支持拖拽裁剪、变速、标注和额外音轨,还可以保存为工程文件随时继续编辑,导出支持 MP4 和 GIF 两种格式。 支持 macOS、Windows 和 Linux 三个平台,如果你经常需要录制产品演示或教程视频,这个工具值得收藏备用。

19,810 Aufrufe

前端开发者在使用 Cursor、Windsurf 等 AI 开发工具时,有时候需修改 UI 界面的样式颇为麻烦,需要准备告诉 AI 具体元素位置相关信息。 给大家推荐 stagewise 这款开源工具,它提供了一个浏览器工具,让我们能直接在网页上选择元素并添加评论。 然后帮助我们将元素截图、DOM 结构等关键信息一键发送给 Cursor 等 AI 助手进行处理。 GitHub: 主要功能: - 直接在浏览器中选择任意 UI 元素并发送给 AI 助手; - 自动连接 VS Code 扩展,无需额外配置; - 支持多种前端框架:React、Vue、Next.js、SvelteKit 等; - 可通过自定义插件系统扩展功能; - 提供 DOM 元素、截图和元数据给 AI 代理; - 不会影响应用的打包体积,仅在开发模式下生效。 对于前端开发工程师,如果有在使用 Cursor 这些 AI 开发工具,不妨搭配这款工具使用试试。

前端开发者在使用 Cursor、Windsurf 等 AI 开发工具时,有时候需修改 UI 界面的样式颇为麻烦,需要准备告诉 AI 具体元素位置相关信息。 给大家推荐 stagewise 这款开源工具,它提供了一个浏览器工具,让我们能直接在网页上选择元素并添加评论。 然后帮助我们将元素截图、DOM 结构等关键信息一键发送给 Cursor 等 AI 助手进行处理。 GitHub: 主要功能: - 直接在浏览器中选择任意 UI 元素并发送给 AI 助手; - 自动连接 VS Code 扩展,无需额外配置; - 支持多种前端框架:React、Vue、Next.js、SvelteKit 等; - 可通过自定义插件系统扩展功能; - 提供 DOM 元素、截图和元数据给 AI 代理; - 不会影响应用的打包体积,仅在开发模式下生效。 对于前端开发工程师,如果有在使用 Cursor 这些 AI 开发工具,不妨搭配这款工具使用试试。

64,111 Aufrufe

在 GitHub 上发现一个开源项目:Memvid,颠覆传统的向量数据库处理方式,直接将文本数据编码成视频文件。 通过将数百万文本块压缩到单个 MP4 文件中,不仅实现了 10 倍的存储压缩率,还能在亚秒级时间内完成语义搜索,完全无需数据库服务器。 GitHub: 并且内置对话功能,可与知识库进行上下文感知的对话,同时支持直接导入 PDF 文档并自动索引处理。 可完全离线工作,视频生成后无需网络连接。正在构建大型知识库的 AI 开发者不妨看下这个项目。

在 GitHub 上发现一个开源项目:Memvid,颠覆传统的向量数据库处理方式,直接将文本数据编码成视频文件。 通过将数百万文本块压缩到单个 MP4 文件中,不仅实现了 10 倍的存储压缩率,还能在亚秒级时间内完成语义搜索,完全无需数据库服务器。 GitHub: 并且内置对话功能,可与知识库进行上下文感知的对话,同时支持直接导入 PDF 文档并自动索引处理。 可完全离线工作,视频生成后无需网络连接。正在构建大型知识库的 AI 开发者不妨看下这个项目。

57,673 Aufrufe

又发现一款跨设备文件分享的开源免费工具:Croc,可以放弃使用网盘或硬盘了。 无需在同一网络下,允许任意两台电脑之间传输文件或文件夹,不限制大小,并提供端到端加密,更安全更快速地分享。 GitHub: 除此之外,还支持多文件传输,以及中断后的断点续传功能。 支持 Windows、Linux 和 macOS 一键安装使用。

又发现一款跨设备文件分享的开源免费工具:Croc,可以放弃使用网盘或硬盘了。 无需在同一网络下,允许任意两台电脑之间传输文件或文件夹,不限制大小,并提供端到端加密,更安全更快速地分享。 GitHub: 除此之外,还支持多文件传输,以及中断后的断点续传功能。 支持 Windows、Linux 和 macOS 一键安装使用。

53,688 Aufrufe

对于短视频自媒体人来说,这款开源免费工具价值上百元。 social-auto-upload:实现一键上传,自动化发布短视频到各个主流平台。 GitHub: 同时还支持多账号定时执行各自的任务,助力我们矩阵化运营。 目前已支持抖音、B 站、视频号、TikTok、小红书等平台。

对于短视频自媒体人来说,这款开源免费工具价值上百元。 social-auto-upload:实现一键上传,自动化发布短视频到各个主流平台。 GitHub: 同时还支持多账号定时执行各自的任务,助力我们矩阵化运营。 目前已支持抖音、B 站、视频号、TikTok、小红书等平台。

52,779 Aufrufe

日常使用浏览器,有时候需要访问一些移动端网页,老是动不动就让下载 APP,体验确实不太好。 GitHub 上 TrayChrome 这款开源工具,正好解决了这个问题,开发者灵感来自于 Mac 的 MenubarX 应用。 基于 WPF 和 WebView2 开发,能直接隐藏到系统托盘的轻量级浏览器,支持同时打开多个独立运行。 GitHub: 并且默认使用移动端模式浏览网页,对小白来说将其友好,不需要按 F12 键进入开发面板再切换,而且界面简洁流畅。 除此此外,还支持深浅主题切换、窗口置顶功,以及丰富的启动参数配置。 提供了开箱即用的 exe 安装包,有需求的同学可在发布页面下载双击运行即可使用。

日常使用浏览器,有时候需要访问一些移动端网页,老是动不动就让下载 APP,体验确实不太好。 GitHub 上 TrayChrome 这款开源工具,正好解决了这个问题,开发者灵感来自于 Mac 的 MenubarX 应用。 基于 WPF 和 WebView2 开发,能直接隐藏到系统托盘的轻量级浏览器,支持同时打开多个独立运行。 GitHub: 并且默认使用移动端模式浏览网页,对小白来说将其友好,不需要按 F12 键进入开发面板再切换,而且界面简洁流畅。 除此此外,还支持深浅主题切换、窗口置顶功,以及丰富的启动参数配置。 提供了开箱即用的 exe 安装包,有需求的同学可在发布页面下载双击运行即可使用。

36,311 Aufrufe

想快速了解全球动态或市场行情,打开浏览器信息太多反而不知道看什么,专业情报工具又太复杂。 最近发现了 Watchtower 这个极简的终端情报仪表盘,帮我们把全球资讯浓缩在命令行里。 聚合了全球 RSS 新闻源、实时加密货币与股票市场数据,甚至还能显示本地天气。 GitHub: 甚至还能调用 AI 生成当日新闻摘要,支持 Groq(免费)、OpenAI、Deepseek、Gemini 等多个模型。 数据源基本都是免费公开接口,只有 AI 摘要功能需要 API Key,配置存在本地不会上传。 可通过 Docker 快速部署,适合不想离开终端,又希望对外部世界保持敏锐感知的开发者朋友。

想快速了解全球动态或市场行情,打开浏览器信息太多反而不知道看什么,专业情报工具又太复杂。 最近发现了 Watchtower 这个极简的终端情报仪表盘,帮我们把全球资讯浓缩在命令行里。 聚合了全球 RSS 新闻源、实时加密货币与股票市场数据,甚至还能显示本地天气。 GitHub: 甚至还能调用 AI 生成当日新闻摘要,支持 Groq(免费)、OpenAI、Deepseek、Gemini 等多个模型。 数据源基本都是免费公开接口,只有 AI 摘要功能需要 API Key,配置存在本地不会上传。 可通过 Docker 快速部署,适合不想离开终端,又希望对外部世界保持敏锐感知的开发者朋友。

21,786 Aufrufe

在学习机器学习时,网上大部分教程只讲概念,又或者直接上代码,让我们很难真正理解算法背后的原理。 今天在 GitHub 上发现 Machine Learning Visualized 开源项目,非常不错,它用可视化方式带我们深入了解每个算法的工作原理。 那些复杂的机器学习算法被拆解成直观的可视化过程,并结合完整的数学推导和交互式界面,让我们清晰地看到算法在训练过程中权重的变化。 GitHub: 主要内容: - 神经网络、逻辑回归、感知器等核心算法的完整实现 - 每个算法都有详细的数学推导过程,从第一性原理开始讲解 - 交互式 Marimo 笔记本,可以实时调整参数观察效果 - 训练过程可视化,直观展示算法收敛到最优权重的过程 - 涵盖 PCA、K-means 聚类、梯度下降等多种算法 项目基于 Jupyter Book 构建,可在线浏览学习,也可以通过 Docker 本地一键部署,即可使用。

在学习机器学习时,网上大部分教程只讲概念,又或者直接上代码,让我们很难真正理解算法背后的原理。 今天在 GitHub 上发现 Machine Learning Visualized 开源项目,非常不错,它用可视化方式带我们深入了解每个算法的工作原理。 那些复杂的机器学习算法被拆解成直观的可视化过程,并结合完整的数学推导和交互式界面,让我们清晰地看到算法在训练过程中权重的变化。 GitHub: 主要内容: - 神经网络、逻辑回归、感知器等核心算法的完整实现 - 每个算法都有详细的数学推导过程,从第一性原理开始讲解 - 交互式 Marimo 笔记本,可以实时调整参数观察效果 - 训练过程可视化,直观展示算法收敛到最优权重的过程 - 涵盖 PCA、K-means 聚类、梯度下降等多种算法 项目基于 Jupyter Book 构建,可在线浏览学习,也可以通过 Docker 本地一键部署,即可使用。

36,926 Aufrufe

平时浏览到一篇比较好的国外文章时,常常会想着让 AI 翻译或总结整理笔记,若直接复制会带有乱七八糟的 HTML 标签。 面对这个问题,在 GitHub 上发现了一款浏览器插件:cpdown,可一键复制网页内容并转换为 Markdown 格式。 GitHub: 主要功能: - 一键复制任何网页内容为干净的 Markdown 格式 - 支持 YouTube 视频字幕提取和转换 - 自动去除广告、导航栏等无用 HTML 元素 - 显示内容的 token 数量,方便给 LLM 使用 - 支持键盘快捷键操作,提高工作效率 目前已上架到 Chrome 应用商店,可直接安装,其他浏览器,可手动下载代码本地加载使用。

平时浏览到一篇比较好的国外文章时,常常会想着让 AI 翻译或总结整理笔记,若直接复制会带有乱七八糟的 HTML 标签。 面对这个问题,在 GitHub 上发现了一款浏览器插件:cpdown,可一键复制网页内容并转换为 Markdown 格式。 GitHub: 主要功能: - 一键复制任何网页内容为干净的 Markdown 格式 - 支持 YouTube 视频字幕提取和转换 - 自动去除广告、导航栏等无用 HTML 元素 - 显示内容的 token 数量,方便给 LLM 使用 - 支持键盘快捷键操作,提高工作效率 目前已上架到 Chrome 应用商店,可直接安装,其他浏览器,可手动下载代码本地加载使用。

37,848 Aufrufe

在 GitHub 上发现一款创新性的开源自动化 AI 工具:Terminator。 它不像以往通过 OCR 识别屏幕内容,而是直接 “理解” 电脑上的应用像解析 HTML 网站一样,快速、准确地控制我们电脑上的各种软件。 对比传统 OCR 自动化工具,有如下的特点: - 速度特别快,比传统方法快很多倍; - 即使软件窗口被遮挡或在后台,也能操作; - 非常稳定,不容易因为界面变化而失效。 GitHub: 目前主要支持 Windows 系统,macOS 系统仅支持部分功能。 如果你对让电脑自动完成任务感兴趣,这个项目的原理不妨学习看下。

在 GitHub 上发现一款创新性的开源自动化 AI 工具:Terminator。 它不像以往通过 OCR 识别屏幕内容,而是直接 “理解” 电脑上的应用像解析 HTML 网站一样,快速、准确地控制我们电脑上的各种软件。 对比传统 OCR 自动化工具,有如下的特点: - 速度特别快,比传统方法快很多倍; - 即使软件窗口被遮挡或在后台,也能操作; - 非常稳定,不容易因为界面变化而失效。 GitHub: 目前主要支持 Windows 系统,macOS 系统仅支持部分功能。 如果你对让电脑自动完成任务感兴趣,这个项目的原理不妨学习看下。

38,589 Aufrufe

写自动化测试脚本或者写爬虫时,用传统的 Playwright 往往需要频繁维护各种元素选择器。 一旦目标网页的结构发生微调,原有的脚本就容易直接报错罢工,维护起来颇为费神。 最近在 GitHub 上看到到 HyperAgent 这个开源项目,巧妙地将 Playwright 与大模型结合在了一起。 通过自然语言就能控制浏览器,完成复杂的自动化任务,不用再写一堆脆弱的选择器代码。 GitHub: 支持单步操作,速度快成本低,以及能处理多步骤复杂任务,支持视觉理解和自适应调整。 还内置动作缓存功能,录制一次工作流后可以反复回放,不需要每次都调用大语言模型。 底层直接使用 Chrome 开发者工具协议,动作执行更精确,自动过滤广告框架,支持深层嵌套的 iframe 操作。 同时支持云端扩展,可以通过 Hyperbrowser 快速扩展到数百个会话,还能连接 MCP 工具实现完整工作流。 如果你正在用 Playwright 做自动化测试或数据采集,又厌倦了频繁维护选择器代码,这个项目值得一试。

写自动化测试脚本或者写爬虫时,用传统的 Playwright 往往需要频繁维护各种元素选择器。 一旦目标网页的结构发生微调,原有的脚本就容易直接报错罢工,维护起来颇为费神。 最近在 GitHub 上看到到 HyperAgent 这个开源项目,巧妙地将 Playwright 与大模型结合在了一起。 通过自然语言就能控制浏览器,完成复杂的自动化任务,不用再写一堆脆弱的选择器代码。 GitHub: 支持单步操作,速度快成本低,以及能处理多步骤复杂任务,支持视觉理解和自适应调整。 还内置动作缓存功能,录制一次工作流后可以反复回放,不需要每次都调用大语言模型。 底层直接使用 Chrome 开发者工具协议,动作执行更精确,自动过滤广告框架,支持深层嵌套的 iframe 操作。 同时支持云端扩展,可以通过 Hyperbrowser 快速扩展到数百个会话,还能连接 MCP 工具实现完整工作流。 如果你正在用 Playwright 做自动化测试或数据采集,又厌倦了频繁维护选择器代码,这个项目值得一试。

17,999 Aufrufe

平时跟朋友分享大文件时,各种软件文件大小、格式限制,用网盘又要注册登录,甚是头疼。 最近发现 PocketChest 这个开源项目,用最简单的方式安全分享任何文件,解决了这个文件分享难题。 支持高达 200GB 的大文件上传,每个文件包会生成一个 6 位字符的取件码,就像快递取件一样简单方便。 GitHub: 主要功能: - 支持文件和文本内容上传,无需注册直接使用 - 大文件友好支持,最大可上传 200GB 单个文件 - 自动过期机制,可设置 1/3/7/15 天后自动删除 - 6 位取件码分享,比长链接更容易记忆和传播 - 可选 TOTP 双重认证,保护敏感文件安全访问 - 响应式设计,手机电脑都能流畅使用 通过 Cloudflare Workers 部署即可使用,并提供详细的部署使用教程。

平时跟朋友分享大文件时,各种软件文件大小、格式限制,用网盘又要注册登录,甚是头疼。 最近发现 PocketChest 这个开源项目,用最简单的方式安全分享任何文件,解决了这个文件分享难题。 支持高达 200GB 的大文件上传,每个文件包会生成一个 6 位字符的取件码,就像快递取件一样简单方便。 GitHub: 主要功能: - 支持文件和文本内容上传,无需注册直接使用 - 大文件友好支持,最大可上传 200GB 单个文件 - 自动过期机制,可设置 1/3/7/15 天后自动删除 - 6 位取件码分享,比长链接更容易记忆和传播 - 可选 TOTP 双重认证,保护敏感文件安全访问 - 响应式设计,手机电脑都能流畅使用 通过 Cloudflare Workers 部署即可使用,并提供详细的部署使用教程。

32,003 Aufrufe

又发现 GitHub 上一款开源强大的文本转语音工具:Abogen。 能快速将 ePub、PDF 或文本文件转换成高质量音频,并生成匹配的字幕。 GitHub: 主要特性: - 支持 ePub、PDF、TXT 多种文件格式输入 - 基于 Kokoro-82M 模型生成自然流畅语音 - 自动生成时间同步字幕文件 - 内置语音混合器创建个性化声音 - 支持多种语言包括中文、英文、日语等 - 批量队列处理多个文件 提供 Windows 一键安装器,同时支持 pip 安装和 Docker 部署方式。

又发现 GitHub 上一款开源强大的文本转语音工具:Abogen。 能快速将 ePub、PDF 或文本文件转换成高质量音频,并生成匹配的字幕。 GitHub: 主要特性: - 支持 ePub、PDF、TXT 多种文件格式输入 - 基于 Kokoro-82M 模型生成自然流畅语音 - 自动生成时间同步字幕文件 - 内置语音混合器创建个性化声音 - 支持多种语言包括中文、英文、日语等 - 批量队列处理多个文件 提供 Windows 一键安装器,同时支持 pip 安装和 Docker 部署方式。

31,126 Aufrufe

在 GitHub 上发现一款完全本地运行的开源 AI 助手:Eclaire,集成了超多 AI 功能。 支持文档、图片、笔记、书签等数据类型的统一管理,并通过本地 LLM 模型提供问答对话。 同时内置强大的文档处理能力,支持 PDF、Docx、PNG 等多种格式。 GitHub: 除此之外,还有 OCR 文字识别、批量格式转换等 AI 功能。 通过 Docker 一键部署使用,支持 macOS、Linux、Windows 系统,并提供 API 接口,兼容 OpenAI 标准格式。

在 GitHub 上发现一款完全本地运行的开源 AI 助手:Eclaire,集成了超多 AI 功能。 支持文档、图片、笔记、书签等数据类型的统一管理,并通过本地 LLM 模型提供问答对话。 同时内置强大的文档处理能力,支持 PDF、Docx、PNG 等多种格式。 GitHub: 除此之外,还有 OCR 文字识别、批量格式转换等 AI 功能。 通过 Docker 一键部署使用,支持 macOS、Linux、Windows 系统,并提供 API 接口,兼容 OpenAI 标准格式。

26,221 Aufrufe

Videos