AI Design News
No. 023No. 025
Thursday, June 11, 2026·Issue 024

Today's brief

GitHub Trending · Daily·96 days ago

Addy Osmani 开源 Agent Skills:AI 编码 Agent 的产级工程规范

addyosmani/agent-skills

Addy Osmani 发布了一套面向 AI 编码 Agent 的生产级工程技能包,通过 7 个 slash 命令覆盖从需求定义到上线的完整开发周期。它将资深工程师的工作流、质量门禁和最佳实践编码为 Agent 可自动执行的技能,并支持 Claude Code 即装即用。

✎ Author's take
Addy Osmani 提供的 AI 编码 Agent 生产级技能包,通过 slash 命令覆盖完整开发周期,对资深工程师来说,可以将工作流程自动化,提升效率。
Continue at github.com
Vercel·99 days ago

DeepSeek 抢占 17% token 份额,Anthropic 仍主导支出

DeepSeek enters the fight for token volume, Anthropic continues to dominate spend

Vercel AI Gateway 5 月指数显示,DeepSeek V4 上线首月即拿下平台 17% 的 token 量,超越 OpenAI 成为第三大提供商;但其支出占比仍不到 1%,因 Flash 定价低至每百万 token $0.14/$0.28。与此同时,企业生产场景的 AI 总支出仍在上升,Anthropic 继续主导收入端,市场呈现“量增价跌”的极端分化。

✎ Author's take
对设计工程师而言,这不是单纯价格战——DeepSeek Flash 让 AI 原型和 A/B 测试的成本趋近于零,但高价值推理仍被 Anthropic 垄断。别只看 benchmark,token 经济学正在重塑技术选型:用 DeepSeek 铺量、Claude 保质量,这是接下来半年的主流架构。
Continue at vercel.com
Simon Willison·96 days ago

Google 开源 DiffusionGemma,文本生成速度超 500 tokens/s

DiffusionGemma

Google 将去年短暂亮相的 Gemini Diffusion 模型正式开源为 DiffusionGemma(Apache 2),26B 参数。它采用扩散架构替代传统自回归,实测生成速度超 500 tokens/s,NVIDIA 已提供免费 NIM API,对需要实时产出代码、SVG 或文案的设计工程流是重磅升级。

✎ Author's take
扩散语言模型终于从实验品变成了可摸的开源权重。对设计工程师来说,500+ tokens/s 意味着实时生成 SVG、组件代码或文案不再是演示视频里的噱头,而是今天就能接进工作流的 API。自回归模型统治了三年,DiffusionGemma 可能是第一条真正的裂缝。
Continue at simonwillison.net
GitHub Trending · Daily·96 days ago

OpenMed:本地优先医疗 AI,一行代码跑千模型

maziyarpanahi/openmed

OpenMed 整合超 1000 个医疗专科模型与 247 个 PII 检查点,借 Apple MLX 实现全设备端推理。无论是 Python 脚本还是原生 Swift 应用,它都让临床文本的结构化提取与隐私脱敏彻底脱离云端,并以 Apache-2.0 协议完全开源。

✎ Author's take
医疗 AI 的设计死结一直是云端合规与隐私弹窗。OpenMed 把千级模型压到端侧,用一行 Python 或 Swift 接口就能调用,等于给设计师发了'免审金牌'——再也不用为数据出境写冗长声明,也不用替云延迟背锅。本地优先的医疗交互范式,可能从此开始。
Continue at github.com
Vercel·98 days ago

Vercel AI Gateway API key 支持预算熔断

Budgets for API keys on AI Gateway

Vercel AI Gateway 上线 API key 级消费配额:可为任意 key 设置美元上限及日/周/月刷新周期,超支后自动拒绝请求。该能力覆盖所有接入模型与供应商,让团队在部署编码代理或分享 demo 时,不用再担心 token 费用半夜跑飞。

✎ Author's take
这是设计工程师把 AI 工作流推进生产环境的必备保险:此前 agent 循环或原型泄露最怕账单失控,现在用 key 级硬封顶就能安心做实验。Vercel 把云原生「预算熔断」思路搬进了 AI 基础设施,其他网关应该赶紧跟进。
Continue at vercel.com
Sidebar·97 days ago

AI 迄今创造的四种设计新岗位

The four design jobs AI created (so far)

NN/g 将当下笼统的「AI 设计」拆分为四种具体的新兴工作类型。这不仅是头衔的更迭,更预示着设计从业者技能栈与职业路径的深层重构。文章为身处生成式 AI 变革中的设计师提供了一份角色转型的分类地图。

✎ Author's take
别再笼统焦虑「AI 会不会取代设计师」。NN/g 把模糊的「AI 设计」拆成了可落地的职业坐标——你需要立刻对号入座,看清自己的技能树更接近哪一种新岗位,然后针对性补缺口。它不给现成工具,但给了避免被淘汰的藏宝图。
Continue at nngroup.com
Smashing Magazine·97 days ago

认知包容性 UX 研究的实战价值

The Benefits Of Cognitive Inclusion In UX Research

Fable 创新 VP 分享主导专家工作组的一手经验:针对美国 13.9% 的认知障碍人群,团队从招募筛选、访谈指南到量化问卷,系统验证了包容性可用性测试的完整流程。这不仅是道德正确,更是 UX 研究员扩大产品覆盖面的切实路径。

✎ Author's take
认知障碍用户占美国人口近14%,却几乎是可用性测试里的“隐形人”。多数团队喊着包容,招募的却是清一色“典型用户”,本质上在系统性忽视最大残疾群体。Fable 这篇把招募、访谈、量化全落到了地上——如果你做用户研究却不考虑认知多样性,你的洞察从一开始就是残缺的。
Continue at smashingmagazine.com
Vercel·98 days ago

Claude Fable 5 上架 AI Gateway

Claude Fable 5 now available on AI Gateway

Anthropic 的 Mythos 级模型 Claude Fable 5 正式接入 Vercel AI Gateway,支持多日连续运行与并行子代理调度,在代码审查、漏洞挖掘等长周期复杂任务上首过正确率显著提升。不过模型默认开启安全分类器,且因反滥用需求不支持零数据保留,提示词与补全内容将被保留 30 天。

✎ Author's take
对设计工程师来说,Fable 5 的多日自主运行意味着复杂原型验证可以真正「无人值守」;但 Anthropic 因反滥用风险关闭 ZDR、强制保留数据 30 天,给处理敏感资产的企业泼了冷水。在 Vercel 无加价接入前,先算清合规账。
Continue at vercel.com
Simon Willison·96 days ago

datasette-agent 0.2a0:AI 工具可中途打断请求人工确认

datasette-agent 0.2a0

datasette-agent 0.2a0 让 AI 工具能在执行中主动中断,通过 context.ask_user() 向用户发起 yes/no、多选或自由文本提问,未答复前对话挂起并持久化,支持服务重启后恢复。新增 save_query 工具,保存 SQL 前必须人工确认。这给 AI agent 引入了关键的人机协作安全闸。

✎ Author's take
做 AI 工具的产品设计师别再把 agent 设计成黑箱。datasette-agent 这套「执行中挂起+人工确认+状态持久化」的机制,直接把「人在回路」从口号变成了可落地的交互模式——特别是在数据写入等高风险场景强制加闸,既保了自动化效率,又守住了用户信任底线。这套设计值得直接抄。
Continue at simonwillison.net
GitHub Trending · Daily·96 days ago

GitHub 热榜:30+ AI 工具系统提示词与模型大合集

x1xhlol/system-prompts-and-models-of-ai-tools

GitHub Trending 仓库汇总了 v0、Cursor、Claude Code、Perplexity、Manus、Devin 等 30 余款主流 AI 工具的系统提示词及内部模型配置。设计师可直接翻阅这些“出厂设置”,理解顶尖 AI 产品的角色定义、工具调用逻辑与约束策略,为自身 AI 功能设计提供一手参考。

✎ Author's take
读系统提示词是研究 AI 产品最高效的方式,没有之一。这份合集把 v0、Cursor 等顶级产品的“底层代码”直接摊开,做 AI 功能的设计师应该逐字阅读——你会看到它们如何定义角色、调度工具、防越狱,比看一百篇设计方法论都管用。
Continue at github.com
GitHub Trending · Daily·96 days ago

ESPectre:€10 ESP32 做 Wi-Fi 无感运动检测,新增端侧 ML

francescopace/espectre

ESPectre 是一个基于 Wi-Fi CSI(信道状态信息)的开源运动检测方案,仅需约 10 欧元的 ESP32 设备即可实现无需摄像头的人体感应。项目原生支持 Home Assistant,并新增了无需校准的端侧神经网络检测器,为智能家居和隐私敏感场景提供了极低成本的传感基础设施。

✎ Author's take
这是将空间感知压缩成 €10 开源方案的标志性事件。无摄像头、端侧 ML、原生 Home Assistant 支持,让隐私友好的环境感知变得极低门槛。它比毫米波雷达更“设计民主化”,建议设计工程师直接 fork 改交互逻辑。
Continue at github.com
GitHub Trending · Daily·97 days ago

Career-Ops:用 Claude Code 打造的 AI 求职代理系统

santifer/career-ops

开发者将 Claude Code 扩展为求职指挥中心,通过 Playwright 自动扫描 Greenhouse 等招聘门户,以 10 维度加权评分批量筛选职位,并生成 ATS 优化的定制 PDF 简历。它不是海投工具,而是帮求职者从数百条信息中快速定位高匹配机会的过滤系统。

✎ Author's take
开发者将 Claude Code 扩展为求职指挥中心,自动扫描招聘门户,筛选职位并生成定制简历,帮助求职者快速定位高匹配机会。
Continue at github.com
Sidebar·97 days ago

Performative UI:炫耀融资超额认购的讽刺组件

performative-ui

这是一个讽刺性项目,提供专门用来炫耀融资轮次超额认购程度的UI组件。它精准戳中了当下初创公司将融资消息当作产品功能展示的浮夸风气,对设计师而言是一面审视'设计是否在为虚荣服务'的镜子。

✎ Author's take
设计师们该集体脸红:我们确实帮客户做过太多'表演性设计'——把A轮B轮当成勋章贴在首屏,用跑马灯滚动投资人logo。这个项目用戏谑方式提醒我们,当界面沦为融资PR工具,用户体验就成了牺牲品。值得收藏这面镜子,下次提案前照一照。
Continue at vorpus.github.io
GitHub Trending · Daily·97 days ago

CopilotKit 登顶:Agent 时代的全栈前端框架

CopilotKit/CopilotKit

CopilotKit 是一个全栈 Agent SDK,支持 React、Angular、Vue 及 React Native,内置生成式 UI、共享状态和人机协同工作流。其发起的 AG-UI 协议已被 Google、LangChain、AWS 等采纳,意味着前端开发者终于拥有了构建 Agent 原生应用的标准化基础设施。

✎ Author's take
CopilotKit 不止是个 React 组件库,它在定义 Agent 与 UI 的通信标准。AG-UI 被 Google、AWS、LangChain 采纳,说明‘Agent 原生前端’已成行业共识。对设计师和产品工程师而言,这意味着交互范式正从‘用户点击’转向‘Agent 编排’——再不把生成式 UI 纳入设计系统,就要被甩在后面了。
Continue at github.com
Simon Willison·97 days ago

llm 0.32a3 发布:几乎完全由 Claude Fable 5 自主编写

llm 0.32a3

Simon Willison 发布其开源命令行工具 llm 的 0.32a3 版本,并透露该版本几乎完全由 Claude Fable 5 自主编写完成。这一发布不仅展示了下一代 AI 模型在真实工程场景中的独立编码能力,也为设计工程师提供了可直接上手的 AI 原生开发样本。

✎ Author's take
顶级独立开发者 Simon Willison 已经让 AI 接管自己的招牌工具迭代,这说明 AI 编程不是未来时,而是现在进行时。对设计工程师而言,这意味着你必须尽快把 AI 从'顾问'重新定位为'执行者',否则工作流效率将直接落后一个代际。
Continue at simonwillison.net
GitHub Trending · Daily·97 days ago

whichllm:自动检测硬件并推荐最佳本地 LLM

Andyyyy64/whichllm

whichllm 是一款 CLI 工具,自动检测你的 GPU/CPU/RAM,结合最新基准测试推荐能在本地流畅运行的 LLM。它把“这个模型能不能跑”的猜谜游戏变成数据驱动的一行命令,还支持模拟硬件升级和直接启动模型。

✎ Author's take
本地跑模型最怕下完 70B 才发现显存爆炸。whichllm 把硬件检测和真实 benchmark 直接挂钩,让 LLM 选型从玄学变成一行命令。对需要本地原型或隐私推理的设计工程师,这是比大厂发布会更解渴的实用工具。
Continue at github.com