Загрузка видео...

Не удалось загрузить видео

На главную

用Deepseek V4 Pro 0813跑了三个简单任务。 1. 第一个是开发部署一个网站,需要调用3个Skill,完成网站开发,子域名解析和上线。 2. 第二个是模仿60种设计风格,生成Bento卡片图展示。 3. 第三个是Threejs 生成一个3D打砖块游戏。 大家可以看看效果,我感觉还行。

68,352 просмотров • 13 дней назад •via X (Twitter)

Комментарии: 0

Нет доступных комментариев

Здесь появятся комментарии из оригинального поста

Похожие видео

Kimi-K2.6 前端/后端/Agent编程能力实测! 甚至还帮我做了个游戏! 给大家带来刚刚正式发布的 kimi-k2.6 的正式版本的实测! 本次为了考验它的长程Agentic Coding能力, 我用 kimi-k2.6-code-preview 写了个 harness 游戏自动生成框架, 它可以根据给到的人设/场景/数值设计等规则, 自动生成关卡, 背景图片, 甚至配音! 其中框架驱动和草稿模型使用 kimi-k2.6, 文生图和生成语音由 kimi-k2.6 生成 prompt 后调用其它大模型生成. 最好玩的是, 我做了个"无头"版本的游戏cli接口, kimi-k2.6 能像玩互联网早期Mud游戏一样, 使用纯文本玩这个游戏, 每当它生成关卡之后, 他就可以直接进入游戏游玩一下, 来验证关卡设计得是否正确. 而内部设计又分为了对话生成skill, 脚本生成skill, 关卡生成skill, 游戏测试大师skill, 游戏资深玩家skill(由于检讨游戏性) 等等, 从而实现了让大模型自己写游戏自己玩! 每个关卡大概需要一个小时生成和验证, 如果并行验证应该还能更快一些(做多线程BFS/DFS). 另外本次依旧使用大家都熟悉的测试项目进行了前端/后端/Agent能力测试, 从测试来看, 复杂项目前端能力(建模, 空间理解, 物理模拟等)略有下降, 但后端和 Agent 能力有明显提升. 不过如果你是纯做网站的话, 可以用 kimi 网站上的的 k2.6 Agent 模式, 由于 Agent 能力足够强所以可以在这个模式下多步来提升生成的网站质量和交互体验. #kimi #kimik26 #moonshot #月之暗面 #kimicli

karminski-牙医

40,177 просмотров • 4 месяцев назад

看到 Gemini 3 Flash 发布的时候, 第一反应是:终于有人跟 OpenAI 打价格战了。 更快、更便宜、还能免费用—— 这才是独立开发者和小团队真正需要的东西。 价格到底便宜多少? 简单说:如果你之前用 GPT-4o 或 Gemini 3 Pro 跑应用,换成 Gemini 3 Flash,成本预计能直接降 50%-70%。 ZenMux 已经第一时间上线了 Gemini 3 Flash,并且每天有免费额度——你可以直接在 chat 里调用,不用单独申请 API,不用写代码集成。 我扒了推特上互动最高的几个帖子,发现大家兴奋的点主要是: 【零代码生成 3D 交互场景】 有人用简单文本提示,生成了一个 Three.js 场景:数百万粒子悬浮在屏幕上,可以用手势控制它们形成任意形状。不需要懂 Three.js,不需要懂 WebGL,甚至不需要懂 HTML。 【从截图到完整落地页】 有人从零开始做了一个完整的产品落地页。先上传参考网站截图,然后逐步添加图标、动画、效果。整个过程像在跟设计师对话,而不是在写代码。 【5 分钟做出能用的 App】 有人做了个视频录制工具,AI 实时根据你说的内容给提示词,防止你卡壳。还有人做了手语识别 app,带置信度分数、采样设置、实时提示。 现在,你可以用更低的价格重新实现一边这些! 验证想法的成本降到接近零——你可以在一个下午内做出 5 个不同方向的原型,丢给用户测试,看哪个有反馈再深入。

Cell 细胞

23,039 просмотров • 8 месяцев назад

把网站录下来给AI看, AI能照着做出来吗? 刚刚看到了个炫酷的灯具网站, 它有个功能是点击按钮直接能看到灯点亮的效果, 甚至网站的配色也会暗淡下来, 特别有氛围. 我突然想到, 这样的网站, 如果要让AI来做, 该怎么办? 把源代码拷给它? 用一个巨复杂的 prompt 来完成? 有没有可能, 我录个视频, 展示一下这个"关灯"的效果, 然后让AI来按照视频来写网站? 于是, 这个重任就交给了今天测试的模型, 百度刚出的文心-5.0-preview, 全模态大模型, 这个模型同时支持文本, 图片, 音频, 视频作为输入, 然后可以生成文本和图片, 所以我们这个测试可以最大化的利用它的能力. 我先录制了网站的效果, 然后写了prompt作为补充, 告诉它这个效果是怎样的, 以及准备的图片材料在哪里. 值得一提的是, 网站所展示的图片也是我用文心-5.0-preview生成的. 大家可以看视频中我生成的效果. 直接说测试结论: 目前每个模态都是可用的, 而且模态之间关联性非常好, 我测试了视频+文本, 图片+文本, 图片+语音, 都可以完成任务. 当然测试也发现了一些问题, 比如 token 输出速度不是特别快, 以及偶尔会有超时问题(已反馈给百度的同学). 我的使用建议是, 多利用它的多模态能力, 来完成之前不敢想象的任务, 它真的提升了使用场景的天花板. #文心大模型 #文心5 #百度 #文心一言 #ai教程

karminski-牙医

29,929 просмотров • 9 месяцев назад