HOPE DESIGN
0 %
Loading

DAILY BRIEF

HTML 成片与本机 3D

日榜仍是技能库占位,新进可装的是 HTML 写视频、本机出 3D、工程技能包和按硬件选模的推理服务。

4 min

设计 AI GitHub

来源GitHub Trending + GitHub Search API + 仓库 README + Google Blog + Workspace Blog + X

本周趋势

9 月 4 日凌晨官方日榜前排仍是近七日已写过的技能库、教室与 VoiceStudio;本期把主推荐让给 HTML 成片、本机 3D、工程 Skill 与本机推理。Gemini 3.8 Flash 为 9 月 2 日官方发布。Google Pics 为 9 月 1 日推广,观察栏回溯约 3 天。

核心推荐

06 picks

  1. HeyGen 开源的 HTML 成片框架,把 HTML/CSS、媒体和可 seek 动画渲成确定性 MP4,给编码 Agent 一条不用拖时间线的出片路。痛点是生成视频只交单段画面,字幕、动效和对齐要换软件;它用 data-start / data-duration 标时间,适配 GSAP、CSS、Lottie、Three.js、Anime.js与 WAAPI,预览走本机浏览器,渲染走无头 Chrome 加 FFmpeg。差异化是 /hyperframes 路由技能把意图分给产品发布、无脸解说等工作流,/figma 可从 Figma 帧重建动画,同输入同输出适合 CI。设计师可先用 HTML 排版再 render,而不是从提示词碰运动规律。

    主页: hyperframes.dev

  2. 本机桌面 3D 工作台,用本机 GPU 从单张图或一句话生成网格,不把稿件送上云。痛点是产品渲染和角色一致性要排队等云端 mesh,设计师拿不到可改的 glb;它把图→生成→入场景连成可视工作流,可平滑与减面,并用 GitHub URL 装 Hunyuan3D、TripoSG 等扩展。差异化是 CLI agent.py 可从图导出 .glb,编码 Agent 能把本机 3D 接进自动化。提供 Windows / Linux / Apple Silicon 安装包。适合包装、展示道具和角色草稿先出一版可带进 Blender 的 mesh。

    主页: modly3d.app

  3. Matt Pocock 把自己 .agents 目录里的工程技能公开出来,覆盖格烧需求、域建模、TDD、代码库设计、架构改进和原型。痛点是通用 Agent 一开始就改代码,交出的界面变体没共同语言也没门禁;prototype 用来出 HTML 界面变体,codebase-design 与 improve-codebase-architecture 把组件边界写清。差异化是先问清楚再动手,并用 writing-for-agents 把文档写成 Agent 可解析的规范。设计系统团队可先 /setup-matt-pocock-skills 定下文档位置和标签,再让 Agent 出原型而不是直接合入主分支。

    主页: aihero.dev/skills

  4. 开源本机推理服务,先扫芯片、内存和带宽,再推荐并下载能跑在这台机器上的模型,接进已有的编码 Agent。痛点是本机跑模型要自己猜显存和量化,换一套 Agent 又要重配;它给出预估 tok/s,调好推测解码与并发,空闲或内存满时卸载模型。差异化是直接插 Pi、OpenCode、Hermes、OpenClaw、Codex、Claude Code 和 Cline,不换 IDE。协议 Apache-2.0。设计师若已用 frontend-design 或 DESIGN.md,可把同一套技能换到本机模型上跑界面草稿。

    主页: magnitude.dev

  5. 去 AI 腔的写作技能,按维基百科「Signs of AI writing」整理出 35 条模式,改写不改事实。痛点是界面文案、设计说明和发布稿一开口就是 testament、landscape、三列并举和假深刻;它先出一稿再对照模式和原文主张,缺细节就问而不是猜。差异化是只改散文,不动代码、数据、frontmatter 和链接,也可按写作样本跟声。适合把 Agent 写出的 onboarding、组件文档和社媒文案先洗一遍,再人工定调。

    目录: skills.sh/blader/humanizer

  6. EMNLP 2025 Demo 的 PDF 双语翻译工具,用 DocLayout-YOLO 先识版式,再把公式、图表、目录和批注留在原位。痛点是设计规范、论文和品牌手册一翻译就掉栏、掉图和掉公式;它提供 CLI / Gradio / Docker / MCP / Zotero,引擎可选 Google、DeepL、Ollama、OpenAI 和 MiniMax。差异化是翻译结果仍是可排的 PDF,Agent 可通过 MCP 把布局完整的双语稿当作下游输入。读论文做可视化或要把外文手册变成中文排版参考时,先走这一层而不是整本 OCR。

    主页: pdf2zh.com

其他值得关注

06 items

  • tt-a1i/archify 持续在榜,可验证架构图 Skill 现 ★ 45.3k,周增仍是全站最快之一。
  • THU-MAIC/OpenMAIC 持续在榜,交互教室现 ★ 31.0k,幻灯与 PPTX 导出可继续跟。
  • debpalash/VoiceStudio 近七日已写过,今日仍在官方日榜且日增超 1.7k,现 ★ 15.9k。
  • Gemini 3.8 Flash 9 月 2 日官方发布。价格与 3.7 Flash 相同,为 $0.75 / $3.75 每百万 token,官方称长任务编程与工具调用更勤奋。Cyber 变体仅限 Fairwind。
  • Google Pics 9 月 1 日推广至 Workspace 与 AI Pro / Ultra。基于 Nano Banana,可对象分割、图内文字翻译与 2K/4K 放大,Docs / Slides 内直接改图。本期回溯约 3 天。
  • DietrichGebert/ponytail 持续在榜,让 Agent 先复用再写新代码,现 ★ 123.0k,今日日增仍超 2k。

热议精选

@_philschmid

The easiest way to try Gemini 3.8 Flash in an agentic environment is Managed Agents. Gemini gets a dedicated remote sandbox in a single API call, with Python, Node, Git, Bash, Search, function calling or MCP.

@JackWoth98

Given a 2 hour football match, agentic video understanding scans for yellow cards, 3.8 Flash places them on a 2D field, then you click a row and jump to that second. No manual scrubbing.

@HyperFrames_

Write HTML. Render video. Built for Agents. Try on hyperframes.dev.

总结建议

今天热榜看起来还是技能库,但没写过、又能改设计与成片工作流的,是 HTML 视频、本机 3D 和可装的工程规范。

  1. HyperFrames 把排版、动效和确定性渲染写成 Agent 可调用的 HTML;Modly 把单图变成可导出的本机 mesh。
  2. Matt Pocock 的 Skill 用 prototype 与架构门禁抑制一开始就改界面;Humanizer 用 35 条可核对规则洗文案。
  3. Magnitude 按硬件选本机模型接已有 Agent;PDFMathTranslate 把手册和论文翻成仍可排的双语 PDF。Gemini 3.8 Flash 用同档 Flash 价格养长任务,Pics 把对象级改图塞进 Docs / Slides。

要动效成片先 npx skills add heygen-com/hyperframes;有 NVIDIA 或 Apple Silicon 就下 Modly 导一版 glb。已在用 Claude Code 的人加上 Matt Pocock 的 prototype 与 Humanizer。想把界面草稿留在本机就装 Magnitude。读外文规范 PDF 走 pdf2zh。长任务编程可试 3.8 Flash;改海报和幻灯图先看 Pics 能不能直接改字。