AI Design News
No. 099No. 101
Thursday, August 27, 2026·Issue 100
Today's brief from the data-driven decision making

决策驱动的 数据可视化革命

从数据展示到决策引擎的转变

本文探讨了如何将数据可视化从简单的信息展示转变为驱动决策的引擎,UX 方法的引入使得仪表盘不再是数据的墓地,而是激活行动的触发器。

Smashing Magazine·20 days ago

重新思考数据可视化:用 UX 方法让仪表盘驱动决策

Rethinking Data Visualisation: A UX Approach To Dashboards That Actually Drives Decisions

文章直击企业仪表盘“有数据无决策”的通病,指出根源不在数据精度而在设计逻辑——图表常基于“有什么数据”而非“要回答什么问题”构建。作者主张将 UX 与数据可视化视为互补学科,通过理解受众与定义行动目标,让仪表盘从被动图表集合真正变为推动业务决策的工具。

✎ Author's take
多数仪表盘只是数据坟场——漂亮但无人行动。文章戳破“再加一个图表就能说清楚”的幻觉,把 UX 受众思维注入数据可视化。对天天接“做个看板”需求的设计师,这是把被动画图变为主动决策链路的武器;别再做数据搬运工,去定义“看到数字后该干什么”。
Continue at smashingmagazine.com
GitHub Trending · Daily·19 days ago

Ponytail:让 AI Agent 像最懒资深开发一样写代码

DietrichGebert/ponytail

Ponytail 是一套可复用的 AI Agent 提示框架,通过注入“极简主义资深开发者”人格,迫使 Claude Code 等工具用最少代码解决问题。作者在真实 FastAPI + React 仓库上实测,平均减少 54% 代码量、20% 成本并提升 27% 速度,同时保留了完整的安全护栏。

✎ Author's take
Ponytail 是一套 AI Agent 提示框架,通过注入特定人格,迫使工具用最少代码解决问题,对于追求代码简洁和效率的开发者来说具有参考价值。
Continue at github.com
Simon Willison·19 days ago

Qwen3.8-Flash-Next 实测:125B MoE 可本地运行

Qwen3.8-Flash-Next

Qwen 发布开源多模态 MoE 模型 Qwen3.8-Flash-Next,总参数 125B 但仅 6B 活跃,Simon Willison 已在 DGX Spark 上完成本地量化部署并分享生成效果。对设计师而言,这意味着可在本地运行的强大多模态 AI 工具正在成熟。

✎ Author's take
Simon Willison 验证了 DGX Spark 本地跑 125B MoE 多模态模型完全可行,这对设计工程师是关键信号:无需云端依赖即可完成高质量 AI 图像生成。作为 Qwen4 架构预览,开源权重加本地部署的组合正在快速抹平与闭源模型的体验鸿沟。
Continue at simonwillison.net
Latent Space·20 days ago

Lovable CTO:SaaS 的未来是 Agent 可用应用

Lovable CTO: The Future of SaaS Is Apps That Agents Can Use

Lovable 提出 SaaS 的下一步演进:应用不再只供人类点击,而是通过 MCP 服务器将核心功能暴露为 Agent 可调用的"能力"。这意味着同一款应用将同时具备传统 UI 与 Agent 接口,设计师必须重新思考交互架构的底层逻辑。

✎ Author's take
Lovable 的"双界面"构想打响了 Agent 原生设计的第一枪。当 ChatGPT 和 Claude 开始直接调用你的产品功能,传统的页面流转、按钮排布将变得次要——设计师的核心任务会从"降低人类认知负荷"转向"降低 Agent 调用成本"。如果你还在只画给人看的界面,未来十八个月会被甩开。
Continue at latent.space
GitHub Trending · Daily·19 days ago

Hister:支持 MCP 的私有全文搜索引擎

asciimoo/hister

Hister 是一款开源的私有搜索引擎,能在本地全文索引网页和文件,并通过 MCP 协议与 AI 助手联动。对于需要管理大量设计参考、文档和本地素材的创作者,它提供了可立即部署的隐私优先方案,无需依赖云端服务即可实现语义检索和 AI 问答。

✎ Author's take
一款开源的私有搜索引擎,能在本地全文索引网页和文件,通过 MCP 协议与 AI 助手联动,为创作者提供隐私优先的方案。
Continue at github.com
Dev.to · AI·19 days ago

Claude Code 四开并行变团队开发:7 条防冲突经验

Running Claude Code in 4 Parallel Sessions Led to 'Team Development' — 7 Recipes to Prevent Collisions

当 4 个 Claude Code 会话同时开发同一微服务时,AI 代理之间出现了类似人类团队的沟通错位与部署冲突。作者基于一次险些导致生产环境回滚的真实事故,总结出 7 条可落地的并行防冲突 recipes,为设计工程师提供了多 Agent 协作的实操参考。

✎ Author's take
把 AI coding 从单机工具推进到多 Agent 协作治理的实战记录。当你同时开 4 个 Claude Code 窗口,它们不是背景噪音,而是会互相踩脚的队友——这篇文章给了设计工程师一套可抄作业的冲突隔离方案,比任何概念演示都值钱。
Continue at dev.to
Dev.to · AI·19 days ago

手搓多代理编码终端:Three.js 3D 办公室 UI 工程解析

How I engineered a multi-agent coding terminal with a 3D Three.js Office Floor UI published

作者开源了 Gnosis,一个本地优先的多代理编码终端,用 Three.js 将代理状态映射到 3D 办公室的五个功能区,让并发协作可感知。文章详述了空间 UI 架构、模型热切换、提示缓存成本优化及 React + Three.js 实时渲染的工程实现。

✎ Author's take
与其追‘AI Native’的空话,这种把多代理状态‘扔’进 3D 办公室的做法才是设计工程师该偷师的——空间隐喻让并发代理立刻可读。Three.js 实时渲染虽然重,但在高并发 AI 工具里,这种可视化比纯文本流更贴近认知。做 AI 工具界面的设计师应扒走这套空间交互范式,而不是代码。
Continue at dev.to
Sidebar·20 days ago

软件的终极目的:50 年数据回溯

What is the purpose of software

文章援引横跨 50 年的经济数据,试图量化软件对人类社会生产力的真实贡献。在 AI 工具爆发式增长的当下,这一宏观视角促使设计师与工程师重新追问:我们日夜构建的数字产品,究竟是在真正解决问题,还是仅仅制造了更多冗余的界面与流程?

✎ Author's take
在 AI 提效神话泛滥的当下,这篇文章用 50 年经济数据戳破幻觉:软件的“生产力革命”可能从未真正成立。若连所构建之物是否创造价值都无法确认,再精密的交互也只是数字垃圾。读它,是为了在需求评审会上拥有说“不”的底气。
Continue at uxdesign.cc
UX Collective·19 days ago

AI 有个 hospitality 难题,砸钱治不好

AI has a hospitality problem money can’t fix

文章指出,当各大科技公司豪掷数千亿美元让AI更聪明时,模型本身正迅速商品化——用户甚至分不清ChatGPT、Claude和Gemini的回答差异。真正的差异化不在底层智能,而在“服务设计”。作者借酒店业和高端餐饮的经验指出,AI产品的未来竞争力取决于用户体验中的温度、细节与仪式感,而非算力堆砌。

✎ Author's take
设计师们该醒醒了:再卷参数没意义。当微软自己都把底层模型当 commodity 切换时,你的护城河只能是 hospitality——即围绕用户场景做服务设计。这篇文章给AI产品经理和设计师指了一条明路:别只盯着模型能力,去设计让人“感觉被好好款待”的交互细节,这才是下一个战场。
Continue at uxdesign.cc
Sidebar·20 days ago

AI Interface Museum 上线:人机交互视觉史

The AI Interface Museum

设计师 Kyle Jeong 推出 AI Interface Museum,以时间线 curated 从早期命令行到生成式 AI 的交互界面演进。对 AI 产品设计师而言,这是一份可即时翻阅的交互范式档案,帮助理解当下对话式 UI、提示工程界面等设计模式从何而来。

✎ Author's take
AI 产品设计正在陷入「聊天框暴政」,这个博物馆是一记当头棒喝。它把几十年间各种激进的 AI 交互实验摊开在眼前——做下一个 AI 功能前,先来这里看看前人是怎么试错的,别重复交学费还造得更丑。
Continue at interfaces.kylejeong.com
Dev.to · AI·19 days ago

2026 AI API 选型:工程师的诚实指南

AI APIs in 2026: The Honest Developer's Guide to Choosing One

作者基于从 GPT-3 至今的 API 实战经验,指出 2026 年 AI API 市场已从三强鼎立演变为十几家前沿实验室与无数开源模型混战的局面。对于构建 AI 功能的产品团队,核心不再是追逐排行榜上的最强模型,而是在成本、延迟、可靠性与输出质量之间找到适合业务场景的工程化权衡。

✎ Author's take
设计工程师最容易犯的错,就是把原型阶段的 SOTA 模型直接塞进生产环境。这篇从一个熬过夜、付过账的开发者嘴里掏出了选 API 的真标准:延迟和成本往往比模型智商更重要。如果你还在用 leaderboard 做技术决策,该醒醒了。
Continue at dev.to
Dev.to · AI·19 days ago

最小安全变更应是可测属性,不是行数

The Smallest Safe Change Is a Measured Property

文章指出判断重构安全不应依赖代码行数或直觉,而应通过“特征化测试”测量行为差异。作者提供五步协议:先将代码按公共函数与副作用切片,再生成测试锁定当前输出,使每次编辑成为可对比的受控实验。行数多少与风险无关,唯有测试输出的异同才能给出客观判决。

✎ Author's take
设计工程师重构时最缺安全感。此文把安全从玄学变测量:按行为切片后锁定输出,diff再小也得过测试判决。虽来源一般且内容被截断,但“行为切片+AI生成测试”的协议对维护设计系统有直接实操价值。不写代码的设计师可跳过。
Continue at dev.to
Dev.to · AI·19 days ago

50次克隆零收入实录:SellerLedger 账本构建日志

50 clone runs, €0 verified — shameless SellerLedger clone ledger (build log #1)

作者公开记录克隆已盈利SellerLedger的全过程,复刻其定价、Gumroad渠道与GitHub Pages着陆页。不同于“AI月入过万”的卖课叙事,这篇罕见亮出Stripe实时收款€0的诚实账本,呈现了一套可复制的最小产品克隆方法论与冷启动真相。

✎ Author's take
对想独立变现的设计工程师,这篇撕掉了AI暴富滤镜。它摊开从landing page到Stripe的完整克隆路径,并诚实亮出€0收款。比起卖课神话,这种零收入账本才是实战教材——抄作业是最快学习方式,但换个logo不会自动印钞。
Continue at dev.to
Medium · AI Agents·19 days ago

AI 为何在 50 轮对话后彻底遗忘你

Why AI Remembers Your Name for Fifty Messages Then Forgets You Completely, And What That Reveals…

文章指出大模型能记住早期系统指令(如用户名),却容易丢失长文档中段信息,并在新会话中完全归零。这种「伪记忆」暴露了当前 Transformer 架构在上下文定位与跨会话状态保持上的结构性缺陷。

✎ Author's take
对设计 AI 对话产品的读者,这篇文章的价值不在新知,而在警钟:别把关键配置藏在长上下文中间,也别假设模型真「记得」用户。它没给解决方案,但提醒你为何必须显式设计外部记忆层——可惜内容被截断,Medium 预览文不值得浪费时间。
Continue at pub.towardsai.net
Sidebar·20 days ago

Tegaki:任意字体转手写动画

Tegaki

Tegaki 是一款能将任意字体转换为动画手写效果的在线工具。用户输入文字后即可生成笔触逐字呈现的动态效果,无需手动绘制矢量路径。对需要手写动画的 UI 设计师和前端开发者而言,它能显著简化制作流程,省去在 After Effects 中逐帧调整的繁琐工作。

✎ Author's take
正文只有一句话,信息密度近乎为零,但工具本身精准切中了手写动画的痛点。如果实际输出支持 SVG 或视频导出,它完全可能比 After Effects 插件更高效。与其读这篇空洞简报,不如直接打开链接试玩。
Continue at gkurt.com
Medium · AI Agents·19 days ago

用 Spring AI 和 Java 构建语音 AI Agent

Build a Voice AI Agent in Java with Spring AI: Speech-to-Text, Tool Calling, and Text-to-Speech

这是一份端到端 Spring Boot 实战教程,涵盖语音转文本、LLM 工具调用与文本转语音全流程,教你如何用 Java 构建一个能听懂指令、调用本地函数并语音回复的 AI Agent。对 Java 后端开发者有参考性,但技术栈与主流设计工程链路脱节。

✎ Author's take
典型的后端 Java 教程,技术栈与设计师/设计工程师的日常工具链完全错位。除非你碰巧在维护 Java 后端,否则这里的 STT/TTS 实现对你毫无迁移价值,直接跳过。
Continue at medium.com
产品更新 · Product Updates
§Product Updates产品功能迭代
Claude Blog·21 days ago

Warp 如何用 Claude 构建自改进 Agent

How Warp builds self-improving agents on Claude

Warp 在其终端产品中基于 Claude 搭建了具备自我进化能力的 AI Agent,文章详细拆解了从评估框架到反馈闭环的完整工程架构。这套方法论不仅适用于终端工具,也为设计工程师在产品中植入持续优化的 Agent 提供了可直接复用的范式。

✎ Author's take
这不是普通的集成案例,而是把 Agent 从“调用一次”升级为“越用越准”的系统工程。对设计工程师和产品设计师而言,最有价值的是 Warp 如何把评估指标和失败案例自动回流到改进 pipeline——这套思路可以直接搬到设计系统、原型生成或代码转换的任何 AI 工作流里,别再只调 prompt 了。
Continue at claude.com
Claude Blog·21 days ago

Claude Cowork 新增内置浏览器

Claude gets its own browser in Cowork

Anthropic 官方博客宣布 Claude 在 Cowork 中集成内置浏览器,使 AI 可在对话过程中直接浏览网页。然而目前仅有一行功能预告,缺乏交互细节、支持场景或上线时间,设计团队尚无法判断其对日常研究、原型验证等工作流的具体影响。

✎ Author's take
一句标题式的功能预告,没有截图、没有演示、没有 API 细节,对设计工程师而言信息量为零。在官方放出实际文档前,这条消息只够在社交媒体上被转发一次,完全不值得一读。
Continue at claude.com
Stratechery·20 days ago

Apple 更新 Mini 与 Studio、AI 电脑及 OpenAI Jalapeño

Apple Updates Mini and Studio, AI Computers, OpenAI Jalapeño

Apple 与 OpenAI 同日抛出硬件新动作:Apple 更新 Mac mini 与 Mac Studio 并强调 AI PC 属性,OpenAI 则公布 Jalapeño 项目。两者路线截然不同,却形成对 Nvidia 的合围。对创作者而言,本地 AI 算力与云端推理的角力将直接影响设备选型与工作流配置。

✎ Author's take
通篇只有一句导语,信息密度趋近于零,大概率是 RSS 摘要或付费墙截断。没有芯片参数、没有性能实测、没有 Jalapeño 的具体产品形态,设计工程师读完后拿不到任何可指导采购或工作流调整的干货,直接跳过即可。
Continue at stratechery.com
Claude Blog·21 days ago

Claude Chrome 扩展正式上线

Claude in Chrome is generally available

Anthropic 宣布 Claude Chrome 扩展结束测试、全面上线,但官方公告极为简短,未透露具体功能细节、与网页交互方式或对工作流的实际影响,目前仅相当于一条产品可用性通知。

✎ Author's take
一句话公告,读完等于没读。零功能细节、零交互逻辑、零工作流场景,对设计工程师毫无实操价值。与其浪费时间,不如等第三方深度测评或上手教程。这种「宣告式」发布不配占用头条。
Continue at claude.com
Anthropic · via HN·21 days ago

Claude Code skill 恢复被禁导出的 Kindle 高亮

A Claude Code skill that recovers export-blocked Kindle highlights

开发者发布了一个 Claude Code skill,通过解析 Kindle 本地文件绕过导出限制,帮用户找回被锁在设备里的高亮与笔记。该项目展示了 Claude Code skills 在私有化数据提取中的用法,但 HN 热度与讨论度均偏低。

✎ Author's take
对设计工程师而言,这个 skill 的功能本身几乎零吸引力——除非你刚好被困在 Kindle 的封闭生态里。它唯一勉强可参考的是如何给 Claude Code 写一个私有化数据提取脚本,但仓库文档和讨论都过于单薄,不值得专门花时间阅读。
Continue at github.com
创作工具 · AI Creation
§AI Creation创作工具动态
Sidebar·20 days ago

教会 AI 你的工作方式

On teaching AI how you work

作者提出将多年写作积累转化为可加载的 AI 判断力,通过「个人技能」封装工作流,告别反复解释,实现一句指令运行全部任务。这暗示设计师与 AI 的协作正从一次性提示转向可复用的个人化能力资产。

✎ Author's take
别再沉迷写长 prompt 了。文章戳破了当前 AI 协作的幻觉——真正值钱的是你多年沉淀的设计判断,而非每次从零开始的对话。虽然原文给出的信息密度不足,但「可加载的个人技能」这个概念本身,就是设计工程师接下来必须啃下的工作流革命。
Continue at karlkoch.me
开源趋势 · Open Source
§GitHub Rank今日开源趋势
01GitHub Trending · Daily·21 days ago

GPT-Image 2 工业级提示词引擎与模板库开源

freestylefly/awesome-gpt-image-2

这是一个面向 GPT-Image 2 的 Prompt as Code 开源项目,聚合了 470+ 逆向工程案例与 20+ 工业级模板,配套可视化网站支持直接预览、复制提示词并在线测试。设计师可跳过从零调试,直接复用经商业验证的生成策略,快速落地高完成度的 AI 图像工作流。

✎ Author's take
awesome-gpt-image-2 是一个面向 GPT-Image 2 的 Prompt as Code 开源项目,为设计师提供了逆向工程案例和工业级模板,有助于快速落地 AI 图像工作流。
Continue at github.com
02GitHub Trending · Daily·21 days ago

Claude 社区插件市场正式开放

anthropics/claude-plugins-community

Anthropic 在 GitHub 上线了 Claude 插件社区市场,提供经安全审核的第三方插件。Claude Code 与 Claude Cowork 用户可直接安装社区插件扩展功能,相当于为 AI 编码和设计助手增加了应用商店。对依赖 Claude 工作流的设计工程师而言,这意味着工具链可定制性将大幅提升。

✎ Author's take
claude-plugins-community 是 Anthropic 提供的 Claude 插件社区市场,允许用户为 AI 编码和设计助手安装社区插件,增强工具链的可定制性。
Continue at github.com
03GitHub Trending · Daily·68 days ago

Claude Code 全自动求职框架走红 GitHub

MadsLorentzen/ai-job-search

一个基于 Claude Code 的开源求职工作流,可自动评估职位匹配度、生成定制化简历与求职信,并内置审稿代理优化输出。当前职位爬取主要针对丹麦市场,但核心架构支持替换为本地招聘网站。

✎ Author's take
MadsLorentzen/ai-job-search 是一个基于 Claude Code 的开源求职工作流,可以自动评估职位匹配度并生成定制化简历与求职信。
Continue at github.com
04GitHub Trending · Daily·23 days ago

Apache Maka 开源:本地优先的 AI Agent 工作空间

apache/maka

Apache 孵化器新项目 Maka 发布早期版本。这是一个本地优先的 AI Agent 工作空间,默认把会话与运行记录留在本地,支持桌面端、TUI 和 CLI。它将模型消息、工具调用记录为追加日志,提出「日志即运行时」的架构理念。对关注隐私与可复现 AI 工作流的设计工程师,这是值得跟踪的实验性工具。

✎ Author's take
Apache 孵化器项目 Maka,一个本地优先的 AI Agent 工作空间,强调会话与运行记录留在本地,提出「日志即运行时」的架构理念。
Continue at github.com
05GitHub Trending · Daily·105 days ago

TradingAgents 多智能体量化交易框架开源更新

TauricResearch/TradingAgents

TradingAgents 是一个基于 LLM 多智能体的开源金融交易框架,最新 v0.2.5 版新增了情感分析师、多模型覆盖(GPT-5.5 / Claude 4.6 / Qwen 等)及远程 Ollama 支持。虽然面向量化交易场景,但其角色分层的 Agent 架构与 LangGraph 状态管理实践,对设计复杂 AI 协作工作流有一定参考价值。

✎ Author's take
基于 LLM 多智能体的开源金融交易框架,新增情感分析师、多模型覆盖及远程 Ollama 支持,对设计复杂 AI 协作工作流有参考价值。
Continue at github.com
06GitHub Trending · Daily·20 days ago

claude-obsidian:自组织 AI 第二大脑开源工具

AgriciDaniel/claude-obsidian

这是一个将 Claude Code 与 Obsidian 结合的开源知识管理系统,基于 Karpathy 的 LLM Wiki 模式,能把任意来源的素材自动整理成带引用、互相关联的 Markdown 笔记。对设计师而言,它意味着竞品调研、设计参考可以被 AI 主动链接与溯源检索,且数据完全本地留存。

✎ Author's take
claude-obsidian 是一个将 Claude Code 与 Obsidian 结合的开源知识管理系统,能够帮助设计师自动化整理素材成互相关联的 Markdown 笔记。
Continue at github.com
07GitHub Trending · Daily·117 days ago

全开源AI工程课:435节从数学推导到MCP server

rohitg00/ai-engineering-from-scratch

GitHub Trending 新晋全开源AI工程课程,共435节课、20个阶段约320小时,覆盖Python/TypeScript/Rust/Julia。课程要求从线性代数和反向传播开始手写代码,逐步构建Tokenizer、Attention机制直至MCP服务器和自主智能体集群,每节课均产出可复用工程产物。

✎ Author's take
ai-engineering-from-scratch 是一个全开源的 AI 工程课程,覆盖了从基础数学到构建完整的智能体集群的全过程,适合想要深入学习 AI 工程的开发者。
Continue at github.com
08GitHub Trending · Daily·120 days ago

OpenHuman 登 GitHub Trending:开源个人 AI 助手

tinyhumansai/openhuman

OpenHuman 是一款登上 GitHub Trending 的开源桌面 AI 助手,主打隐私保护和开箱即用。它支持 118+ 第三方服务集成,能作为真实成员加入 Google Meet,并带有会互动、有记忆的桌面吉祥物,试图把 agent 从命令行拉回图形界面。

✎ Author's take
openhuman 是一款开源桌面 AI 助手,主打隐私保护和易用性,支持第三方服务集成,适合需要桌面 AI 助手的用户。
Continue at github.com
09GitHub Trending · Daily·28 days ago

Omarchy:DHH 发布标榜美观与 AI 工具链的 Linux 发行版

basecamp/omarchy

Basecamp 创始人 DHH 发布名为 Omarchy 的 Linux 发行版,主打美观桌面体验、统一主题与热键体系,并内置 Neovim、AI 开发工具链等组件,试图为厌倦 macOS 的开发者提供一套高度定制化且审美偏执的操作系统方案。目前已登上 GitHub Trending。

✎ Author's take
omarchy 是 Basecamp 创始人 DHH 发布的 Linux 发行版,主打美观桌面体验和高度定制化,适合对操作系统有特殊审美需求的开发者。
Continue at github.com
10GitHub Trending · Daily·63 days ago

Awesome LLM Apps:百大可运行 Agent 与 RAG 模板

Shubhamsaboo/awesome-llm-apps

GitHub Trending 上的 Awesome LLM Apps 收录了 100 多个可直接运行的 AI Agent 与 RAG 应用模板,涵盖 MCP、多智能体、语音代理等现代 AI 栈,支持 Claude、GPT 等主流模型一键切换。对设计工程师而言,这意味着无需从零搭建脚手架,克隆代码即可快速验证 AI 原型并落地生产。

✎ Author's take
收录了100多个可直接运行的 AI Agent 与 RAG 应用模板的开源项目,支持主流模型一键切换,方便快速验证 AI 原型。
Continue at github.com
11GitHub Trending · Daily·117 days ago

multica-ai/andrej-karpathy-skills

A single CLAUDE.md file to improve Claude Code behavior, derived from Andrej Karpathy's observations on LLM coding pitfalls. Karpathy-Inspired Claude Code Guidelines Check out my new project Multica — an open-source platform for running and managing coding agents with reusable skills. Follow me on X: https://x.com/jiayuan_jy A single CLAUDE.md file to improve Claude Code behavior, derived from Andrej Karpathy's observations on LLM coding pitfalls. English | 简体中文 The Problems From Andrej's post: "The models make wrong assumptions on your behalf and just run along with them without checking. They don't manage their confusion, don't seek clarifications, don't surface inconsistencies, don't present tradeoffs, don't push back when they should." "They really like to overcomplicate code and APIs, bloat abstractions, don't clean up dead code... implement a bloated construction over 1000 lines when 100 would do." "They still sometimes change/remove comments and code they don't sufficiently understand as side effects, even if orthogonal to the task." The Solution Four principles in one file that directly address these issues: Principle Addresses Think Before Coding Wrong assumptions, hidden confusion, missing tradeoffs Simplicity First Overcomplication, bloated abstractions Surgical Changes Orthogonal edits, touching code you shouldn't Goal-Driven Execution Leverage through tests-first, verifiable success criteria The Four Principles in Detail 1. Think Before Coding Don't assume. Don't hide confusion. Surface tradeoffs. LLMs often pick an interpretation silently and run with it. This principle forces explicit reasoning: State assumptions explicitly — If uncertain, ask rather than guess Present multiple interpretations — Don't pick silently when ambiguity exists Push back when warranted — If a simpler a…[truncated]

✎ Author's take
一个专注于改善 Claude Code 行为的指南文件,基于 Andrej Karpathy 对 LLM 编码陷阱的观察。
Continue at github.com
12GitHub Trending · Daily·22 days ago

OpenAI Codex CLI 发布:轻量终端编码代理

openai/codex

OpenAI 正式发布 Codex CLI,一款可在终端本地运行的轻量级编码代理。用户通过自然语言即可执行代码生成、文件操作等任务,同时支持接入 VS Code、Cursor 等主流 IDE,对设计工程师而言,这意味着原型到代码的闭环可以进一步在命令行中完成。

✎ Author's take
OpenAI 发布的 Codex CLI,一款可在终端本地运行的轻量级编码代理,支持代码生成、文件操作等任务。
Continue at github.com
13GitHub Trending · Daily·19 days ago

Marin 开源基础模型训练框架

marin-community/marin

Marin 是一个聚焦大语言模型训练全流程的开源框架,涵盖数据筛选、预训练、后训练及评估,并强调实验过程的完全公开。虽然登上 GitHub 热榜,但它属于底层科研基础设施,对设计师日常工作流几乎没有可直接落地的价值。

✎ Author's take
Marin 是一个开源框架,专注于大语言模型训练的全流程,包括数据筛选、预训练、后训练及评估,对底层科研基础设施研究者具有参考价值。
Continue at github.com
14GitHub Trending · Daily·19 days ago

Ponytail:让 AI Agent 像最懒资深开发一样写代码

DietrichGebert/ponytail

Ponytail 是一套可复用的 AI Agent 提示框架,通过注入“极简主义资深开发者”人格,迫使 Claude Code 等工具用最少代码解决问题。作者在真实 FastAPI + React 仓库上实测,平均减少 54% 代码量、20% 成本并提升 27% 速度,同时保留了完整的安全护栏。

✎ Author's take
Ponytail 是一套 AI Agent 提示框架,通过注入特定人格,迫使工具用最少代码解决问题,对于追求代码简洁和效率的开发者来说具有参考价值。
Continue at github.com
15GitHub Trending · Daily·117 days ago

anthropics/claude-plugins-official

Official, Anthropic-managed directory of high quality Claude Code Plugins. Claude Code Plugins Directory A curated directory of high-quality plugins for Claude Code. ⚠️ Important: Make sure you trust a plugin before installing, updating, or using it. Anthropic does not control what MCP servers, files, or other software are included in plugins and cannot verify that they will work as intended or that they won't change. See each plugin's homepage for more information. Structure /plugins - Internal plugins developed and maintained by Anthropic /external_plugins - Third-party plugins from partners and the community Installation Plugins can be installed directly from this marketplace via Claude Code's plugin system. To install, run /plugin install {plugin-name}@claude-plugins-official or browse for the plugin in /plugin > Discover Contributing Internal Plugins Internal plugins are developed by Anthropic team members. See /plugins/example-plugin for a reference implementation. External Plugins Third-party partners can submit plugins for inclusion in the marketplace. External plugins must meet quality and security standards for approval. To submit a new plugin, use the plugin directory submission form. Plugin Structure Each plugin follows a standard structure: plugin-name/ ├── .claude-plugin/ │ └── plugin.json # Plugin metadata (required) ├── .mcp.json # MCP server configuration (optional) ├── commands/ # Slash commands (optional) ├── agents/ # Agent definitions (optional) ├── skills/ # Skill definitions (optional) └── README.md # Documentation License Please see each linked plugin for the relevant LICENSE file. Documentation For more information on developing Claude Code plugins, see the official documentation.

✎ Author's take
Anthropic 提供了一个官方目录,收录了高质量的 Claude Code 插件,供开发者和用户选择和使用。
Continue at github.com
16GitHub Trending · Daily·19 days ago

Hister:支持 MCP 的私有全文搜索引擎

asciimoo/hister

Hister 是一款开源的私有搜索引擎,能在本地全文索引网页和文件,并通过 MCP 协议与 AI 助手联动。对于需要管理大量设计参考、文档和本地素材的创作者,它提供了可立即部署的隐私优先方案,无需依赖云端服务即可实现语义检索和 AI 问答。

✎ Author's take
一款开源的私有搜索引擎,能在本地全文索引网页和文件,通过 MCP 协议与 AI 助手联动,为创作者提供隐私优先的方案。
Continue at github.com