Today's brief
Addy Osmani 开源 Agent Skills:AI 编码 Agent 的产级工程规范
addyosmani/agent-skills
Addy Osmani 发布了一套面向 AI 编码 Agent 的生产级工程技能包,通过 7 个 slash 命令覆盖从需求定义到上线的完整开发周期。它将资深工程师的工作流、质量门禁和最佳实践编码为 Agent 可自动执行的技能,并支持 Claude Code 即装即用。
DeepSeek 抢占 17% token 份额,Anthropic 仍主导支出
DeepSeek enters the fight for token volume, Anthropic continues to dominate spend
Vercel AI Gateway 5 月指数显示,DeepSeek V4 上线首月即拿下平台 17% 的 token 量,超越 OpenAI 成为第三大提供商;但其支出占比仍不到 1%,因 Flash 定价低至每百万 token $0.14/$0.28。与此同时,企业生产场景的 AI 总支出仍在上升,Anthropic 继续主导收入端,市场呈现“量增价跌”的极端分化。
Google 开源 DiffusionGemma,文本生成速度超 500 tokens/s
DiffusionGemma
Google 将去年短暂亮相的 Gemini Diffusion 模型正式开源为 DiffusionGemma(Apache 2),26B 参数。它采用扩散架构替代传统自回归,实测生成速度超 500 tokens/s,NVIDIA 已提供免费 NIM API,对需要实时产出代码、SVG 或文案的设计工程流是重磅升级。
OpenMed:本地优先医疗 AI,一行代码跑千模型
maziyarpanahi/openmed
OpenMed 整合超 1000 个医疗专科模型与 247 个 PII 检查点,借 Apple MLX 实现全设备端推理。无论是 Python 脚本还是原生 Swift 应用,它都让临床文本的结构化提取与隐私脱敏彻底脱离云端,并以 Apache-2.0 协议完全开源。
Vercel AI Gateway API key 支持预算熔断
Budgets for API keys on AI Gateway
Vercel AI Gateway 上线 API key 级消费配额:可为任意 key 设置美元上限及日/周/月刷新周期,超支后自动拒绝请求。该能力覆盖所有接入模型与供应商,让团队在部署编码代理或分享 demo 时,不用再担心 token 费用半夜跑飞。
AI 迄今创造的四种设计新岗位
The four design jobs AI created (so far)
NN/g 将当下笼统的「AI 设计」拆分为四种具体的新兴工作类型。这不仅是头衔的更迭,更预示着设计从业者技能栈与职业路径的深层重构。文章为身处生成式 AI 变革中的设计师提供了一份角色转型的分类地图。
认知包容性 UX 研究的实战价值
The Benefits Of Cognitive Inclusion In UX Research
Fable 创新 VP 分享主导专家工作组的一手经验:针对美国 13.9% 的认知障碍人群,团队从招募筛选、访谈指南到量化问卷,系统验证了包容性可用性测试的完整流程。这不仅是道德正确,更是 UX 研究员扩大产品覆盖面的切实路径。
Claude Fable 5 上架 AI Gateway
Claude Fable 5 now available on AI Gateway
Anthropic 的 Mythos 级模型 Claude Fable 5 正式接入 Vercel AI Gateway,支持多日连续运行与并行子代理调度,在代码审查、漏洞挖掘等长周期复杂任务上首过正确率显著提升。不过模型默认开启安全分类器,且因反滥用需求不支持零数据保留,提示词与补全内容将被保留 30 天。
datasette-agent 0.2a0:AI 工具可中途打断请求人工确认
datasette-agent 0.2a0
datasette-agent 0.2a0 让 AI 工具能在执行中主动中断,通过 context.ask_user() 向用户发起 yes/no、多选或自由文本提问,未答复前对话挂起并持久化,支持服务重启后恢复。新增 save_query 工具,保存 SQL 前必须人工确认。这给 AI agent 引入了关键的人机协作安全闸。
GitHub 热榜:30+ AI 工具系统提示词与模型大合集
x1xhlol/system-prompts-and-models-of-ai-tools
GitHub Trending 仓库汇总了 v0、Cursor、Claude Code、Perplexity、Manus、Devin 等 30 余款主流 AI 工具的系统提示词及内部模型配置。设计师可直接翻阅这些“出厂设置”,理解顶尖 AI 产品的角色定义、工具调用逻辑与约束策略,为自身 AI 功能设计提供一手参考。
ESPectre:€10 ESP32 做 Wi-Fi 无感运动检测,新增端侧 ML
francescopace/espectre
ESPectre 是一个基于 Wi-Fi CSI(信道状态信息)的开源运动检测方案,仅需约 10 欧元的 ESP32 设备即可实现无需摄像头的人体感应。项目原生支持 Home Assistant,并新增了无需校准的端侧神经网络检测器,为智能家居和隐私敏感场景提供了极低成本的传感基础设施。
Career-Ops:用 Claude Code 打造的 AI 求职代理系统
santifer/career-ops
开发者将 Claude Code 扩展为求职指挥中心,通过 Playwright 自动扫描 Greenhouse 等招聘门户,以 10 维度加权评分批量筛选职位,并生成 ATS 优化的定制 PDF 简历。它不是海投工具,而是帮求职者从数百条信息中快速定位高匹配机会的过滤系统。
Performative UI:炫耀融资超额认购的讽刺组件
performative-ui
这是一个讽刺性项目,提供专门用来炫耀融资轮次超额认购程度的UI组件。它精准戳中了当下初创公司将融资消息当作产品功能展示的浮夸风气,对设计师而言是一面审视'设计是否在为虚荣服务'的镜子。
CopilotKit 登顶:Agent 时代的全栈前端框架
CopilotKit/CopilotKit
CopilotKit 是一个全栈 Agent SDK,支持 React、Angular、Vue 及 React Native,内置生成式 UI、共享状态和人机协同工作流。其发起的 AG-UI 协议已被 Google、LangChain、AWS 等采纳,意味着前端开发者终于拥有了构建 Agent 原生应用的标准化基础设施。
llm 0.32a3 发布:几乎完全由 Claude Fable 5 自主编写
llm 0.32a3
Simon Willison 发布其开源命令行工具 llm 的 0.32a3 版本,并透露该版本几乎完全由 Claude Fable 5 自主编写完成。这一发布不仅展示了下一代 AI 模型在真实工程场景中的独立编码能力,也为设计工程师提供了可直接上手的 AI 原生开发样本。
whichllm:自动检测硬件并推荐最佳本地 LLM
Andyyyy64/whichllm
whichllm 是一款 CLI 工具,自动检测你的 GPU/CPU/RAM,结合最新基准测试推荐能在本地流畅运行的 LLM。它把“这个模型能不能跑”的猜谜游戏变成数据驱动的一行命令,还支持模拟硬件升级和直接启动模型。