AI 驱动的自组织 设计领导力的进化。
探索快速迭代环境下的设计团队管理新范式。
在AI迭代速度的推动下,设计领导力迎来重塑。从Swarm到Flock模型,我们正在逃离传统对齐流程的“地狱”,寻找更加自组织和动态的管理框架。
NVIDIA Switchyard:打通 Claude Code 与开源模型的 Rust 代理
NVIDIA-NeMo/Switchyard
Switchyard 是 NVIDIA 开源的 Rust LLM 代理,可在 OpenAI、Anthropic 及自托管端点(如 vLLM、Ollama)之间自动转换 API 格式。设计工程师可将 Claude Code 或 Codex CLI 指向本地或开源模型,无需修改工作流即可降低调用成本,并支持多模型 A/B 路由与指标监控。
Needle:14MB 端侧模型,支持手机与可穿戴设备本地 AI
cactus-compute/needle
Needle 2 是一个仅 14MB 的 4500 万参数基础模型,可在约 28MB RAM 中完成推理,支持工具调用与结构化数据提取。通过 pip 即可安装部署,它为硬件和软件产品团队提供了完全本地化、无需联网的 AI 能力,意味着交互设计可以彻底摆脱网络依赖。
Modly 开源:本地 AI 图片转 3D 模型工具
lightningpixel/modly
Modly 是一款开源桌面应用,可在本地 GPU 上通过开源 AI 模型将图片转为 3D 网格。支持 Windows、Linux 与 Apple Silicon macOS,提供网格平滑、简化及扩展系统。设计师与设计工程师可即刻下载或从源码构建,实现完全离线的 image-to-3D 工作流。
别再让 Agent '小心点'
Why I stopped asking my agent to be careful
作者发现对 AI coding agent 说'小心点'只会降低速度却照样出错,因为'谨慎'是情绪而非规则。真正有效的是给出可执行清单:类型检查、写测试、禁用 any、禁止静默 catch。用工程约束代替模糊警告,才能让 agent 稳定输出高质量代码。
holaOS:开源一体化 AI Agent 工作空间
holaboss-ai/holaOS
holaOS 是一个开源、本地优先的 AI Agent 统一工作空间。它支持在同一界面运行 Claude Code、Codex 及内置 Agent,共享上下文记忆与 100 多个工具集成(含 MCP),项目历史以本地文件持久化存储,解决多 Agent 切换时的上下文碎片与重复配置问题。
MiniMax H3 发布:别测氛围,测隐藏回归
When a New Model Like MiniMax H3 Drops, Don't Measure Vibes—Measure Regressions
文章提出了一套模型无关的代码评估 harness:向新模型投递已知 bug 代码与修复提示,收集补丁后在隐藏测试集上跑 pytest,以 pass/fail 和 stderr 量化真实能力。它把 vibe 测评翻译成可直接用于模型选型的工程信号,避免让未经验证的模型进入真实代码库。
MiniMax H3 走红:切换前先做成本感知影子测试
MiniMax H3 Is Trending: Run a Cost-Aware Shadow Test Before You Switch
与其迷信公开排行榜,不如在真实业务提示上跑 shadow test:让候选模型并行处理同一批请求,保留原始输出,从输出质量、token 成本、延迟等维度做对比。文章提供了供应商中立的测试框架思路,并提到可用 MonkeyCode 免费额度降低对比成本。
AI 聊天机器人客户端防护盾:零成本开源实战
How I Built a Client-Side Shield for AI Chatbots (Open Source)
作者开源了 Shield by Vouch,一个纯客户端 LLM 查询过滤器,可在请求发出前拦截离题提问、品牌泄露和提示注入,并支持多厂商 API 自动切换。对正在集成 AI 聊天功能的设计师和工程师而言,这是零延迟、零额外成本的防御层,可直接嵌入项目,避免为无效查询浪费 token。
给 AI Agent 写职位描述,别只起名字和头衔
Your AI Agent Needs A Position Description, Not A Name and a Title
HBR 新研究指出,将 AI Agent 拟人化为员工(赋予名字和头衔)会降低评审质量并模糊问责边界。文章建议用明确的职位描述(Position Description)取代花名,让 Agent 的职责范围、决策权限和交付标准一目了然,这对构建可信赖的 AI 工作流至关重要。
Spring 创始人发布 JVM Agent 框架 Embabel
embabel/embabel-agent
Spring 框架创始人推出名为 Embabel 的 JVM Agent 框架,用 Kotlin 编写并兼容 Java,通过动态规划将 LLM 提示与代码、领域模型混合编排,核心采用 OODA 循环实现目标导向的智能路径查找。
用 Swarm 与 Flock 模型重塑设计领导力
Rethinking design leadership with swarms and flocks
文章借椋鸟群与加拿大雁的生物学隐喻,批判设计管理中僵化的“机械思维”与长期系统规划,提出“结构化涌现(Structured Emergence)”模型——通过简单局部规则实现团队自组织,以应对AI突变、人员流失等突发压力,解决管理者倦怠与系统性设计债务。
AI 置信度再高,也不能自动关单
I Wouldn’t Let an AI Confidence Score Close a Document Request
作者以一张被AI以98%置信度识别为$1,284.90、实则为-$1,284.90信用凭证的发票为例,指出置信度仅反映模型对自身输出的确信,不保证原始文件真实无误。因此高置信度只应用来排定人工审核优先级,绝不能替代源文件审查或直接触发审批。
AI API 的隐性成本:没人告诉你的账单陷阱
The Silent Costs of AI APIs Nobody Warns You About
作者以首个 AI 项目账单从 12 美元暴涨至 47 美元的经历,揭示 API 定价陷阱:token 因代码块与空格膨胀、系统提示词重复计费、上下文缓存等。提醒原型阶段估算成本时,不能只看官网标价,务必理解 tokenizer 计数方式与长对话的累积开销。
星战对 AI 的想象错在哪
What Star Wars got wrong about AI (so far)
文章对比了《星球大战》中不可复制、拥有连续记忆的金属个体 AI,与现实里可拷贝、分叉、回滚的软件模型,指出科幻塑造的“唯一灵魂”心智模型阻碍大众理解真实 AI。作者提醒设计师:机器智能不是独一的躯体,而是一组可复制的权重。
语音AI在电话里变声?问题出在这
Why Your Voice AI Sounds Different on a Phone Call
文章揭示多数团队在浏览器与高端耳机中调试语音代理后,上线电话通道却音质骤降的普遍盲区。核心矛盾在于开发环境的声学条件与真实电信网络的编解码压缩、采样率转换存在本质差异,提示语音产品设计必须跨越实验室走向真实通话场景。
LocalSend 登 GitHub 热榜:开源版 AirDrop
localsend/localsend
LocalSend 是一款无需互联网的开源跨平台文件传输工具,支持 Windows、macOS、Linux、Android 和 iOS 设备通过本地网络经 HTTPS 加密安全共享文件与消息。对需要在多设备间传输大体积设计稿或原型文件的设计师而言,它是 AirDrop 的可靠跨平台备选方案。
GPT‑5.6 构建者指南:agent 开发与 API 新能力
The builder’s guide to GPT‑5.6
OpenAI 发布面向开发者的 GPT‑5.6 构建指南,展示初创公司如何利用更智能的模型路由、新的 Responses API 以及成本优化策略,更快搭建 AI agent。对设计工程师和产品设计师而言,这意味着能直接参考官方最佳实践,把 agent 交互和推理成本压到更低。
OpenAI 预览 Ultrafast 模式:GPT-5.6 Sol 提速 14 倍
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
OpenAI 联合 Cerebras 推出全新 API 服务层 Ultrafast,将 GPT-5.6 Sol 的输出速度推至最高 750 tokens/秒,较前代提升约 14 倍。这意味着基于该模型的实时交互应用、设计原型工具及 AI 辅助编程工作流有望获得接近即时的响应体验,但当前仅为预览阶段,尚未公布定价与全面开放细节。
Obsidian Agent Skills 发布,Claude Code 可直接操作笔记
kepano/obsidian-skills
Obsidian CEO kepano 发布了一套 Agent Skills,让 AI Agent 能通过 CLI 和开放格式直接读写 Obsidian 笔记库。它兼容 Claude Code、Codex 等主流编码 Agent,意味着设计师和知识工作者终于可以让 AI 直接管理笔记、画布和数据库,无需在 IDE 与笔记软件之间来回切换。
欧盟AI标签新规:深度伪造与AI内容必须明示
New EU Guidelines For AI Labelling
欧盟AI法案第50(4)条要求,自8月起面向欧盟用户的深度伪造、聊天机器人、未经人工审核的AI公共利益文本及情感识别工具必须明确标注。文章澄清了外界对“天价罚款”的过度恐慌,指出规则其实更具针对性,为全球产品设计团队的合规界面与披露文案提供了清晰边界。
Unsloth 桌面版发布:本地运行并训练 FLUX 等模型
unslothai/unsloth
Unsloth 推出首个桌面端应用,支持在本地运行和微调 LLM、FLUX 等扩散模型及多模态模型,兼容主流硬件。设计师可本地部署图像生成与 AI 工作流,无需依赖云端 API,同时支持 Claude Code 与 MCP 工具链集成。
Macro:all-in-one 团队工作空间
macro-inc/macro
Macro 是一款试图整合 Slack、Notion、Linear 等工具的一体化团队工作空间,基于 SolidJS 与 Rust 构建,强调模块化 block 设计与共享 AI 记忆。项目近日登上 GitHub Trending,但当前内容仅为产品介绍且后半截缺失,未披露具体技术架构或设计系统细节,对专业设计师的可迁移经验有限。
Claude Code 图表 Skill:29 种编辑级 SVG,60 秒适配品牌
cathrynlavery/diagram-design
开源了一个 Claude Code Skill,内置 29 种编辑级图表模板,输出纯 HTML+SVG。它能自动抓取品牌网站的配色与字体,60 秒内统一图表风格,让 AI 直接画出可用在文章或演示中的高质量架构图与流程图,彻底告别 Mermaid 的粗糙圆角框。
Semantica 上架 GitHub:给 AI Agent 建可审计的知识图谱
semantica-agi/semantica
Semantica 是一款面向企业级 AI Agent 的开源基础设施,主打无需 LLM 即可构建上下文图谱与知识图谱,并提供因果推理与全链路决策溯源。它瞄准金融、信贷等强监管场景,强调可解释性与零厂商锁定,但对设计师而言属于底层数据工程工具。
Anthropic 开源 Claude Skills 仓库,含文档处理核心技能
anthropics/skills
Anthropic 在 GitHub 公开 Claude Skills 官方仓库,涵盖文档处理、MCP 生成与企业工作流示例。每个技能通过 SKILL.md 定义指令与资源,让 Claude 动态加载并执行品牌规范等定制任务。设计师与工程师可直接复用这些模式,将通用助手改造为懂内部规范的专业代理。
Needle:14MB 端侧模型,支持手机与可穿戴设备本地 AI
cactus-compute/needle
Needle 2 是一个仅 14MB 的 4500 万参数基础模型,可在约 28MB RAM 中完成推理,支持工具调用与结构化数据提取。通过 pip 即可安装部署,它为硬件和软件产品团队提供了完全本地化、无需联网的 AI 能力,意味着交互设计可以彻底摆脱网络依赖。
FluidVoice 1.6:零延迟 macOS 本地 AI 听写
altic-dev/FluidVoice
FluidVoice 1.6.0 上线,主打完全本地运行的 macOS 语音转文字,新引入 Fluid Intelligence 实现零延迟听写与智能格式化,无需联网或 API 密钥。项目开源且支持 Homebrew 一键安装,数据不出本机,对注重隐私的创作者是即装即用的语音输入替代方案。
Unsloth 桌面版发布:本地运行并训练 FLUX 等模型
unslothai/unsloth
Unsloth 推出首个桌面端应用,支持在本地运行和微调 LLM、FLUX 等扩散模型及多模态模型,兼容主流硬件。设计师可本地部署图像生成与 AI 工作流,无需依赖云端 API,同时支持 Claude Code 与 MCP 工具链集成。
Macro:all-in-one 团队工作空间
macro-inc/macro
Macro 是一款试图整合 Slack、Notion、Linear 等工具的一体化团队工作空间,基于 SolidJS 与 Rust 构建,强调模块化 block 设计与共享 AI 记忆。项目近日登上 GitHub Trending,但当前内容仅为产品介绍且后半截缺失,未披露具体技术架构或设计系统细节,对专业设计师的可迁移经验有限。
holehe:通过邮箱反查社交媒体注册的 OSINT 工具
megadose/holehe
holehe 是一款 Python OSINT 工具,可通过各平台「忘记密码」接口静默检查某邮箱是否已在 Twitter、Instagram 等 120 余网站注册。虽登上 GitHub Trending,但它属于安全取证领域的爬虫工具,与产品设计师、AI 设计师或设计工程师的日常工具链和工作流毫无关联,无法提供任何可直接用于设计或工程实践的资产或方法。
smicallef/spiderfoot
SpiderFoot automates OSINT for threat intelligence and mapping your attack surface. SpiderFoot is an open source intelligence (OSINT) automation tool. It integrates with just about every data source available and utilises a range of methods for data analysis, making that data easy to navigate. SpiderFoot has an embedded web-server for providing a clean and intuitive web-based interface but can also be used completely via the command-line. It's written in Python 3 and MIT-licensed. FEATURES Web based UI or CLI Over 200 modules (see below) Python 3.7+ YAML-configurable correlation engine with 37 pre-defined rules CSV/JSON/GEXF export API key export/import SQLite back-end for custom querying Highly configurable Fully documented Visualisations TOR integration for dark web searching Dockerfile for Docker-based deployments Can call other tools like DNSTwist, Whatweb, Nmap and CMSeeK Actively developed since 2012! WANT MORE? Need more from SpiderFoot? Check out SpiderFoot HX for: 100% Cloud-based and managed for you Attack Surface Monitoring with change notifications by email, REST and Slack Multiple targets per scan Multi-user collaboration Authenticated and 2FA Investigations Customer support Third party tools pre-installed & configured Drive it with a fully RESTful API TOR integration built-in Screenshotting Bring your own Python SpiderFoot modules Feed scan data to Splunk, ElasticSearch and REST endpoints See the full set of differences between SpiderFoot HX and the open source version here. USES SpiderFoot can be used offensively (e.g. in a red team exercise or penetration test) for reconnaissance of your target or defensively to gather information about what you or your organisation might have exposed over the Internet. You can target the following entities in a SpiderFoot scan: IP address Domain/sub-domain name…[truncated]
NVIDIA Switchyard:打通 Claude Code 与开源模型的 Rust 代理
NVIDIA-NeMo/Switchyard
Switchyard 是 NVIDIA 开源的 Rust LLM 代理,可在 OpenAI、Anthropic 及自托管端点(如 vLLM、Ollama)之间自动转换 API 格式。设计工程师可将 Claude Code 或 Codex CLI 指向本地或开源模型,无需修改工作流即可降低调用成本,并支持多模型 A/B 路由与指标监控。
holaOS:开源一体化 AI Agent 工作空间
holaboss-ai/holaOS
holaOS 是一个开源、本地优先的 AI Agent 统一工作空间。它支持在同一界面运行 Claude Code、Codex 及内置 Agent,共享上下文记忆与 100 多个工具集成(含 MCP),项目历史以本地文件持久化存储,解决多 Agent 切换时的上下文碎片与重复配置问题。
Obsidian Agent Skills 发布,Claude Code 可直接操作笔记
kepano/obsidian-skills
Obsidian CEO kepano 发布了一套 Agent Skills,让 AI Agent 能通过 CLI 和开放格式直接读写 Obsidian 笔记库。它兼容 Claude Code、Codex 等主流编码 Agent,意味着设计师和知识工作者终于可以让 AI 直接管理笔记、画布和数据库,无需在 IDE 与笔记软件之间来回切换。
3b1b/Manim 数学动画引擎登 GitHub 热榜
3b1b/manim
3Blue1Brown 的数学动画引擎 Manim 近日登上 GitHub Trending。它支持用 Python 代码生成精确的程序化动画,原本用于数学科普视频,但同样适合算法可视化和技术概念演示。用户可直接通过 pip 安装 manimgl 版本试用,对追求像素级精确控制的设计工程师是一个小众但强大的备选工具。
msitarzewski/agency-agents
A complete AI agency at your fingertips - From frontend wizards to Reddit community ninjas, from whimsy injectors to reality checkers. Each agent is a specialized expert with personality, processes, and proven deliverables. 🎭 The Agency: AI Specialists Ready to Transform Your Workflow A complete AI agency at your fingertips - From frontend wizards to Reddit community ninjas, from whimsy injectors to reality checkers. Each agent is a specialized expert with personality, processes, and proven deliverables. 🚀 What Is This? Born from a Reddit thread and months of iteration, The Agency is a growing collection of meticulously crafted AI agent personalities. Each agent is: 🎯 Specialized: Deep expertise in their domain (not generic prompt templates) 🧠 Personality-Driven: Unique voice, communication style, and approach 📋 Deliverable-Focused: Real code, processes, and measurable outcomes ✅ Production-Ready: Battle-tested workflows and success metrics Think of it as: Assembling your dream team, except they're AI specialists who never sleep, never complain, and always deliver. ⚡ Quick Start Option 1: Use with Claude Code (Recommended) # Install all agents to your Claude Code directory ./scripts/install.sh --tool claude-code # Or manually copy a category if you only want one division cp engineering/*.md ~/.claude/agents/ # Then activate any agent in your Claude Code sessions: # "Hey Claude, activate Frontend Developer mode and help me build a React component" Option 2: Use as Reference Each agent file contains: Identity & personality traits Core mission & workflows Technical deliverables with code examples Success metrics & communication style Browse the agents below and copy/adapt the ones you need! Option 3: Use with Other Tools (GitHub Copilot, Antigravity, Gemini CLI, OpenCode, OpenClaw, Cursor, Aider, Windsurf, Kimi Code) # Step 1 -- generate integration files for all supported tools ./scrip…[truncated]
LTX-2 开源:首个 DiT 音视频生成模型上架 GitHub
Lightricks/LTX-2
Lightricks 在 GitHub 开源了 LTX-2 的官方推理与 LoRA 训练代码。作为首个 DiT 架构的音频-视频基础模型,它支持音画同步生成、22B 参数、空间/时间超分及多种 LoRA 控制,意味着设计师可本地搭建生产级视频生成管线,不再完全依赖封闭 API。
Modly 开源:本地 AI 图片转 3D 模型工具
lightningpixel/modly
Modly 是一款开源桌面应用,可在本地 GPU 上通过开源 AI 模型将图片转为 3D 网格。支持 Windows、Linux 与 Apple Silicon macOS,提供网格平滑、简化及扩展系统。设计师与设计工程师可即刻下载或从源码构建,实现完全离线的 image-to-3D 工作流。
RAGFlow 开源 RAG 引擎登 GitHub Trending
infiniflow/ragflow
RAGFlow 是一款融合 Agent 能力的开源 RAG 引擎,支持从 Confluence、Notion 等多源同步数据,并接入飞书、Discord 等聊天渠道。虽然近期登上 GitHub Trending,但它属于典型的后端 AI 基础设施,对产品经理、设计师及设计工程师的日常工作流几乎无直接实操价值。