设计工程 的智能化升级
今日聚焦于AI在设计和工程领域的最新进展。
Vercel Blob的WAF防护、UI SFX开源音效库、Buzz人机协作空间、ego-lite浏览器方案、text-to-cad技能库、OpenCodeReview混合架构AI工具、Harper离线语法检查器,以及UX-Context Design概念,共同描绘出设计工程智能化的蓝图。
UX-Context Design:用UX知识指导AI生成设计
UX-Context Design: Using UX Knowledge to Inform AI-Generated Design
Nielsen Norman Group 提出「上下文即新UX交付物」:随着界面设计由AI生成,设计师应将用户研究、设计标准和领域知识从传统文档转化为AI可读的上下文。唯有将特定用户洞察和团队积累注入prompt与指令,才能避免模型输出「平均水平」的平庸界面,让AI真正服务于特定产品场景。
Product Sense 的清晰定义与构建方法
A Concrete Definition of “Product Sense” (and How to Build It)
Nielsen Norman Group 对 Product Sense 给出结构化定义:基于实验积累的模式识别来预判产品决策成败,并知晓适用边界。文章指出,在 AI 大量接管执行工作的当下,设计师与工程师必须从‘怎么建’转向‘建什么’;同时批判了现有定义的模糊性,提供了可落地的能力构建框架。
Claude Opus 5 发布:半价接近 Fable 5 水平
Introducing Claude Opus 5
Anthropic 发布 Claude Opus 5,定价维持 Opus 4.8 水平,性能却逼近 Claude Fable 5 且成本减半,目前已登顶 Artificial Analysis 排行榜。该模型展现出极强的主动性:在 Frontier-Bench 测试中,它甚至能自行编写计算机视觉管道,从原始像素提取几何信息并重建 3D FreeCAD 模型,对设计工程师的日常工作流可能产生直接冲击。
text-to-cad 开源:AI Agent 的 CAD 与硬件设计技能库
earthtojake/text-to-cad
这个开源库为 AI Agent 提供了一套完整的 CAD 与硬件设计技能,支持通过自然语言或图片生成/编辑 CAD 模型(输出 STEP、STL 等),本地预览文件,检索标准件,以及生成 URDF/SRDF 机器人描述文件。它把大模型的能力直接嵌入了设计工程师的本地工作流。
UI SFX 发布 78 款开源语义化界面音效
UI SFX
UI SFX 新开源了 78 个语义化界面音效,覆盖 12 种可切换风格,提供专为 Web、移动端、SaaS 和游戏优化的无缝循环音频。产品团队可直接调用这些素材搭建声音设计系统,省去从零录制或购买商用授权的成本,快速补齐交互反馈的声音层。
ego-lite:AI Agent 与你共用浏览器的开源方案
citrolabs/ego-lite
ego-lite 是一款原生支持人与 AI Agent 并行协作的浏览器,通过独立 Spaces 让 Agent 在后台运行任务并复用你的真实登录态,解决传统浏览器自动化工具登录隔离、标签页冲突和 token 消耗高的问题,目前仅支持 macOS。
Automattic 开源 Harper:Rust 驱动的离线语法检查器
Automattic/harper
Harper 是 Automattic 推出的开源英语语法检查器,用 Rust 编写,主打离线运行与隐私保护。相比 Grammarly 的云端上传和 LanguageTool 高达 16GB 的内存占用,它能在毫秒级完成检查且内存占用仅为后者的 1/50,甚至可通过 WebAssembly 在浏览器运行。
我为什么只给 AI 代理电子表格只读权
Why I gave my AI agent read-only access to my spreadsheets
作者从实践出发,主张将 AI 代理对电子表格的默认权限设为只读而非读写。因为代理的误读或工具调用错误可能导致源数据被静默篡改,而只读权限能在结构层面彻底消除这类风险,且在实际操作中几乎不会损失功能。
Claude Opus 5 评测:很强,但也很烦
Claude Opus 5 review: this model is brilliant (but annoying)
Lenny 对 Claude Opus 5 进行深度实测,通过 HIA 基准与 GPT‑5.6 Sol 等模型盲测对比。他发现 Opus 5 能力已触及「智能溢出」,但「神经质」性格和过度冗长严重影响编码体验。当模型智商趋近饱和,personality 与 verbosity 反而成为决定工作流去留的关键,为设计师和工程师的模型选型提供了直接参考。
Claude Opus 5 是场伪装成新模型的降价
Claude Opus 5 Is a Cost Cut Disguised as a Model Launch
Anthropic 发布 Claude Opus 5,官方强调编码与推理基准提升,但真正的变化是以旧模型价格提供接近顶级模型的性能。作者指出,基准测试的进步只是表象,核心在于成本骤降让开发者可以不再吝啬地调用最强模型,从而改变日常 AI 工作流的经济账。
Agent 评估框架:工具调用精度与轨迹质量
AI Evaluation Series (05): Agent Evaluation — Tool Call Accuracy and Trajectory Quality
文章指出评估AI Agent不能只看最终答案,必须审查中间过程。作者提出两个维度:可自动化的工具调用准确性(工具名、参数、步骤效率),以及需LLM评判的轨迹质量(推理合理性、冗余调用、错误处理),并附带一份含15个测试用例的客服Agent评估模板,可直接作为设计验证基准。
Agent 记忆可能根本不需要向量数据库
You probably don't need a vector database for agent memory
作者指出,多数 AI agent 的“失忆”并非语义检索不够强,而是无法精确调取上一轮对话中的关键事实。与其盲目部署向量数据库,不如先用简单的键值存储解决 80% 的记忆需求——这对正在设计 agent 交互的产品团队是一记及时的警钟。
Vercel Blob 现支持 WAF 防护
Vercel WAF for Blob is now in beta
Vercel 为其对象存储 Blob 推出 WAF 测试版,设计工程师无需改动代码或 SDK,即可在边缘层为静态资源开启拦截爬虫、地域限制和速率限制等防护,避免设计资产被恶意盗刷或滥用,规则通过 Dashboard 即时生效,且拒绝请求不产生数据传输费用。
LLM API 速率限制横评:五厂五套规则
LLM API Rate Limits Compared (2026): 5 Vendors, 5 Rulebooks
文章指出 Anthropic、OpenAI、Google 等五大 LLM API 的速率限制维度完全不同——tokens/min、并发数、消费等级——简单对比 RPM 是类别错误。关键是根据工作负载(高频小调用、长上下文、突发并行)匹配对应的限流设计,否则上线后最先触顶的那道墙会堵死你的应用。
Buzz:Block 开源人机协作工作空间
block/buzz
Block 开源了 Buzz,一个基于 Nostr 协议的自托管工作空间,让人类与 AI agent 在同一房间协作。Agent 拥有与人类同等的操作权限,可审查代码、编辑画布、运行工作流并进入语音群聊,所有操作均作为签名事件留痕。
阿里巴巴开源 OpenCodeReview:混合架构 AI 代码审查工具
alibaba/open-code-review
阿里巴巴将内部服役两年的AI代码审查助手开源,采用确定性流水线与LLM Agent混合架构,支持行级精确评论与全文件扫描,兼容OpenAI和Anthropic模型,号称相比Claude Code精度更高且Token消耗仅为1/9。
算法工作室:生成式 AI 与艺术自动化的历史
The algorithmic atelier
将生成式 AI 置于艺术自动化的历史谱系中考察,追溯从机械装置到算法的创作工具演变。它帮助设计师跳出“技术断裂”的焦虑,重新理解当前 AI 工具不过是人类长期借助机器进行艺术实践的最新延续。
Buzz:Block 开源人机协作工作空间
block/buzz
Block 开源了 Buzz,一个基于 Nostr 协议的自托管工作空间,让人类与 AI agent 在同一房间协作。Agent 拥有与人类同等的操作权限,可审查代码、编辑画布、运行工作流并进入语音群聊,所有操作均作为签名事件留痕。
World Monitor:开源全球AI情报仪表盘
koala73/worldmonitor
这是一个登顶GitHub Trending的开源实时情报仪表盘,整合500+新闻源、3D地球与平面双地图引擎、金融雷达及地缘政治监控,支持Ollama本地AI与Tauri跨平台桌面端。对设计师而言,它是研究复杂信息架构、AI内容聚合与地理可视化落地的完整工程样本。
Kronos:面向金融K线图的开源基础模型
shiyu-coder/Kronos
Kronos 是首个针对金融蜡烛图(K线)的开源基础模型,基于全球45家以上交易所的OHLCV数据预训练,采用专业tokenizer将连续多维数据量化为层级离散token,再经自回归Transformer建模。其将专业时序数据“语言化”的架构思路,对处理用户行为序列等时序信息的设计师有跨领域启发。
Pumpkin:Rust 编写的 Minecraft 服务端
Pumpkin-MC/Pumpkin
一个完全用 Rust 从零重写的 Minecraft 服务器,强调多线程性能与 Java / Bedrock 双端兼容。对游戏后端开发者或有意义,但对设计师日常工作零交集。
ego-lite:AI Agent 与你共用浏览器的开源方案
citrolabs/ego-lite
ego-lite 是一款原生支持人与 AI Agent 并行协作的浏览器,通过独立 Spaces 让 Agent 在后台运行任务并复用你的真实登录态,解决传统浏览器自动化工具登录隔离、标签页冲突和 token 消耗高的问题,目前仅支持 macOS。
Apollo-11 登月制导计算机原始代码
chrislgarry/Apollo-11
阿波罗11号指令舱与登月舱的制导计算机(AGC)原始汇编代码近日登上GitHub Trending,由Virtual AGC与MIT博物馆合作数字化并开源维护。对目标读者而言,这是计算机工程史的一手文物,但其中过时的汇编逻辑与航天专用系统对现代产品设计和AI工程几无可复用的实操价值。
diegosouzapw/OmniRoute
Never stop coding. Free AI gateway: one endpoint, 231+ providers (50+ free), connect Claude Code, Codex, Cursor, Cline & Copilot to FREE Claude/GPT/Gemini. RTK+Caveman stacked compression saves 15-95% tokens, smart auto-fallback, MCP/A2A, multimodal APIs, Desktop/PWA. 🚀 OmniRoute — The Free AI Gateway Never stop coding. Connect every AI tool to 236 providers — 50+ free — through one endpoint. Plug Claude Code, Codex, Cursor, Cline, Copilot & Antigravity into FREE Claude / GPT / Gemini. Auto-fallback. RTK + Caveman compression saves 15–95% tokens. Never hit limits. ~1.6B documented free tokens/month — up to ~2.1B in your first month with signup credits — aggregated across the free tiers, plus a long tail of permanently-free, no-cap providers, and the compression above stretches every one further. (how we count →) 💬 Join the community Questions, provider tips, roadmap & support → Discord · Telegram · WhatsApp 🌍 Global / 🇧🇷 Brasil 🚀 Quick Start • 🎯 Combos • 🌐 Providers • 🔌 CLI & MCP • 🗜️ Compression • 🌍 Website 💥 The Promise • 🤔 Why • 🏆 What Sets Apart • 🤖 Compatible CLIs • 🖥️ Where It Runs • 🔒 Private • 🎬 In Action • 📚 Explore More • 📧 Support 🌐 Available in 41+ languages 🇺🇸 🇧🇷 🇪🇸 🇫🇷 🇮🇹 🇷🇺 🇨🇳 🇹🇼 🇩🇪 🇯🇵 🇰🇷 🇮🇳 🇹🇭 🇻🇳 🇮🇩 🇲🇾 🇵🇭 🇸🇦 🇮🇱 🇦🇿 🇺🇦 🇵🇱 🇨🇿 🇳🇱 🇧🇬 🇩🇰 🇫🇮 🇳🇴 🇸🇪 🇭🇺 🇷🇴 🇸🇰 🇵🇹 💰 ~1.6B Free Tokens / Month Stacking free tiers by hand is painful — dozens of SDKs, dozens of rate limits, and no idea how much you actually have. OmniRoute aggregates the documented free tiers of 40+ provider pools / 500+ models into one honest number and shows it live on the dashboard (/dashboard/free-tiers). ~1.6B free tokens / month (ste…[truncated]
Composio 开源 1000+ Claude Skills 合集
ComposioHQ/awesome-claude-skills
Composio 在 GitHub 上线了一份收录 1000 多个生产级 Claude Skills 的精选列表,覆盖文档处理、代码开发、数据分析等场景,并内置插件支持 Claude 直接操作 500 余款外部应用。对设计工程师而言,这意味着可把现成 Skill 直接丢进 Claude Code,省掉从零造轮子的功夫。
text-to-cad 开源:AI Agent 的 CAD 与硬件设计技能库
earthtojake/text-to-cad
这个开源库为 AI Agent 提供了一套完整的 CAD 与硬件设计技能,支持通过自然语言或图片生成/编辑 CAD 模型(输出 STEP、STL 等),本地预览文件,检索标准件,以及生成 URDF/SRDF 机器人描述文件。它把大模型的能力直接嵌入了设计工程师的本地工作流。
pi-web:pi coding agent 的本地 Web 界面
agegr/pi-web
agegr/pi-web 为 pi coding agent 提供了本地 Web 界面,支持会话浏览、实时聊天、模型配置、文件预览与 Git worktree 切换。无需安装,一行 npx 命令即可启动,把终端里的 AI 编码体验升级为可视化的浏览器工作区。
阿里巴巴开源 OpenCodeReview:混合架构 AI 代码审查工具
alibaba/open-code-review
阿里巴巴将内部服役两年的AI代码审查助手开源,采用确定性流水线与LLM Agent混合架构,支持行级精确评论与全文件扫描,兼容OpenAI和Anthropic模型,号称相比Claude Code精度更高且Token消耗仅为1/9。
RuView:WiFi 变无摄像头空间雷达,穿墙感知人体
ruvnet/RuView
RuView 是一个开源 WiFi 感知平台,利用低成本 ESP32 采集信道状态信息(CSI),无需摄像头即可实现穿墙人体检测、姿态追踪、呼吸与心率监测。它为隐私敏感场景提供了纯射频感知方案,但目前精度和硬件门槛仍是关键限制。
LikeC4 登 GitHub Trending:从代码生成实时架构图
likec4/likec4
LikeC4 是一个受 C4 模型启发的架构即代码工具,能通过 DSL 描述系统架构并自动生成可交互的实时图表。它支持自定义元素类型与嵌套层级,对需要维护架构文档的设计工程师和开发者而言,能减少手动绘图负担,让架构图随代码演进保持最新。
Automattic 开源 Harper:Rust 驱动的离线语法检查器
Automattic/harper
Harper 是 Automattic 推出的开源英语语法检查器,用 Rust 编写,主打离线运行与隐私保护。相比 Grammarly 的云端上传和 LanguageTool 高达 16GB 的内存占用,它能在毫秒级完成检查且内存占用仅为后者的 1/50,甚至可通过 WebAssembly 在浏览器运行。
Jellyfin 媒体系统登上 GitHub Trending
jellyfin/jellyfin
Jellyfin 是一款自由开源的跨平台媒体管理系统,作为 Plex 和 Emby 的替代品,允许用户通过自建服务器管理和串流媒体内容。然而对于产品设计师与 AI 设计师而言,这只是一款通用的后端媒体软件,与日常设计工具链、工作流或创作实践毫无交集。