HOPE DESIGN
0 %
Loading

DAILY BRIEF

设计契约与本机成片

日榜前排仍是已写过的教室与技能库,新进可装的是可投喂 Agent 的品牌 DESIGN.md、单墨编辑出图、对话剪视频和本机配音工坊。

4 min

设计 AI GitHub

来源GitHub Trending + GitHub Search API + 仓库 README + getdesign.md + Hugging Face + X

本周趋势

9 月 1 日官方日榜由 OpenMAIC、Archify 与科学技能库领跑,近七日已覆盖;本期把主推荐让给设计契约文件、编辑印刷出图 Skill、Agent 成片与本机声音工坊。无回溯超 48 小时。

核心推荐

06 picks

  1. 按 Google DESIGN.md 规格整理的品牌视觉契约合集,把配色、字体、间距、组件和设计理由写成 Agent 可解析的 Markdown。痛点是给编码 Agent 一张截图或一句像某某站,它拿不到 token 和层级,只能猜出一套紫蓝模板;用法是把对应品牌的 DESIGN.md 放进仓库根目录再让 Agent 按文件生成界面。配套站点 getdesign.md 收录 550+ 站点分析,覆盖 Linear、Stripe、Airbnb、Apple 到复古官网。设计师可先抄一份最接近的品牌契约,再改成自己的 token,而不是每次重写提示词。

    目录: getdesign.md

  2. 面向海报、zine 封面和播客视觉的单墨 / 双墨编辑印刷出图 Skill,默认一主一辅印版,强制留 25%–55% 纸面空白,并叠网目、Risograph 颗粒或蓝晒机理。痛点是通用文生图一开口就是全彩渐变和居中模板,印不出去也没有版式纪律;它先选版式与印版,再出光栅图、可复用生产提示词和短配方,纸色只在暖白、冷灰、浅米三档里选。差异化是身份保持(人像、产品可识别)和至少改四个结构变量,避免抄参考图。适合品牌主视觉、小红书封面和展览海报先出一版可印刷的方向。

    git clone https://github.com/yanliudesign/mono-color-skill.git ~/.claude/skills/mono-color

  3. 让编码 Agent 剪视频的技能:把素材丢进文件夹,说明要什么成片,输出 final.mp4。痛点是时间线软件切点、校色、字幕要来回拖,Agent 若按帧读视频又会撑爆上下文;它先用 ElevenLabs Scribe 做词级转写和说话人分离,把时间线压成约 12KB 的 takes_packed.md,再生成 EDL,用 ffmpeg 切段、自动校色、切点 30ms 淡化和烧字幕。差异化是按切点自检跳切、爆音和字幕问题,最多重渲三轮,叠加层可并行走 HyperFrames / Remotion / Manim。兼容 Claude Code、Codex、OpenClaw,系统依赖是 ffmpeg 和一条转写 Key。

    git clone https://github.com/browser-use/video-use && uv sync

  4. 本机 ElevenLabs 平替,把克隆、音色设计、视频配音、听写、转写和有声书收进一个桌面工坊,宣称覆盖 646 种语言。痛点是云端配音按秒计费、音色和成片留在别人服务器;它内置 16 个 TTS 与 11 个 ASR 引擎,零样本克隆最短可用约 3 秒参考音,配音链路含转写、翻译、说话人保持和导出。差异化是自带 MCP 与 OpenAI 兼容端点,编码 Agent 可直接合成或转写,声音与项目落在本机。提供 macOS / Windows / Linux 安装包和 CUDA / ROCm / CPU Docker,建议 16GB 内存;协议 AGPL-3.0,具体引擎还要看各自模型许可。

    主页: voicestudio.sh

  5. 从 Claude Code 分出来的开源编码 Agent CLI,配置写在 ~/.openclaude,不读 ~/.claude,也不绑 Anthropic。痛点是想换 DeepSeek、GLM、Ollama 或 OpenRouter 时,官方客户端把模型和工具锁在一家;它用 /provider 存多套档案,覆盖 OpenAI 兼容接口、Gemini、Codex、Ollama、Bedrock 等,工具面仍是 bash、文件、MCP、子 Agent 和流式输出。差异化还有自动注入的 /repomap、后台会话,以及按哈希钉死的技能注册,降低来路不明 Skill 被改包的风险。设计师若已用 frontend-design 或 DESIGN.md,可以同一套技能换到本地或便宜模型上跑。

    npm install -g @gitlawb/openclaude@latest

  6. 面向可执行、可度量研究的自治系统,8 月 27 日开源后本周持续涨星。痛点是调参和改方法靠人手或一次性 AutoML,上一轮学到的证据不会进入下一轮;它同时放多组研究同伴,评估器把结果写成结构化证据,规划面板再生成下一代议程,直到收敛或预算用尽。差异化是 Quality-Diversity 与可选 Deep Innovation Gate,避免全员挤进同一个局部最优,产物与原项目隔离。前提是已有可跑代码和评测指标,不是从零选题。研究可视化和实验看板的团队,可把它当证据闭环,而不是再开一轮聊天。

    pip install "praxist[agents,codex]" && praxist setup --interactive

其他值得关注

06 items

  • tt-a1i/archify 持续在榜,可验证架构图 Skill 现 ★ 41.3k,周增仍是全站最快之一。
  • THU-MAIC/OpenMAIC 持续在榜并居官方日榜前列,交互教室现 ★ 29.1k,今日日增仍超 3k。
  • K-Dense-AI/scientific-agent-skills 持续在榜,165 条已校验科研技能现 ★ 41.4k。
  • firecrawl/pdf-inspector 持续在榜,PDF 先分流再抽取现 ★ 17.8k,设计规范与手册仍建议先过这一层。
  • jingyaogong/minimind 今日重回日榜,2 小时从零训 64M 小模型现 ★ 56.9k,适合理解训练闭环而不是生产出图。
  • DeepSeek-V4-Flash-Vision-Exp 8 月 31 日补齐 MIT 权重,V4 系列首个实验多模态,读截图和图表后可走工具调用,文本 Agent 分数与纯文本 Flash 接近。

热议精选

@gakonst

paper MCP is cool! i've been going back and forth on prototyping UIs/design systems directly in code but i think design tooling is here to stay and once you nail it you encode it in DESIGN md or similar for going straight to code for new things

@AiAircle34052

video-use 把剪辑从时间线软件改成跟 Agent 对话。素材进文件夹,说明要什么成片,它按词级转写切废话、校色、切点淡化和烧字幕,再输出 final.mp4。

@NFTCPS

VoiceStudio 是本机声音克隆工坊,不要账号不要 API Key 不要订阅。646 种语言、16 个 TTS 加 11 个 ASR,声音和成品都留在自己机器上。

总结建议

今天热榜看起来还是教室和技能库,但没写过、又能改设计工作流的,是可投喂的视觉契约和本机成片链路。

  1. DESIGN.md 把品牌 token 写成 Agent 可读文件,截图不再是唯一输入。
  2. mono-color-skill 用单墨纪律对抗全彩模板;video-use 用转写而不是逐帧读视频来剪片子。
  3. VoiceStudio 把配音留在本机并露出 MCP;OpenClaude 让同一套技能换模型跑;PRAXIST 则给可度量实验一条跨代证据环。

先从 getdesign.md 拖一份最接近的 DESIGN.md 放进仓库根目录;要印感海报就装 mono-color;有口播素材就试 video-use,配音改走 VoiceStudio。已经用 Claude Code 技能的人,可用 OpenClaude 把同一套流程接到本地或便宜模型上。