AI 时代,品味为什么不能被单元测试
一个跑步 app 写不下去的 bug Karl Tryggvason 写了一个叫 In the Long Run 的 app,让跑者把 Strava 上的累计里程投射到虚拟世界地图上。他想把地图变得有意思:路过的城市、景点、历史遗址,能讲出一段小故事。 ...
一个跑步 app 写不下去的 bug Karl Tryggvason 写了一个叫 In the Long Run 的 app,让跑者把 Strava 上的累计里程投射到虚拟世界地图上。他想把地图变得有意思:路过的城市、景点、历史遗址,能讲出一段小故事。 ...
昨天(6 月 23 日)Anthropic 在 Newsroom 发了一篇 Introducing Claude Tag。文章不长,但中间藏了一句话,我自己读到的时候停下来看了两遍: Today, 65% of our product team’s code is created by our internal version of Claude Tag. ...
很多人跟我一样,最近被 LLM 的 API 账单吓到过一次。 不是训练侧的成本,是 Agent / RAG 这类"每次调用都要拼一大坨上下文"的场景。一个典型的 Claude Code 会话,过去一个月我把日志翻出来看,工具输出和日志回显占进去的 token 是真问题里最容易被忽略的那块。 ...
如果你只看产品对比表,Codex 和 Claude Code 的差异能列三十条:用哪个模型、支不支持浏览器、限额给多少、能不能在手机上续上。但这些都不是今天我想写的。 ...
早上九点,on-call 工程师一边啃吐司一边盯 PagerDuty。Slack 上有人问「昨晚那次事故到底怎么回事」,PR 评论里有人在 diff 上吵,定向消息的截图已经传了三个群。 ...
6 月 18 日晚,Anthropic 旗下的 Model Context Protocol 官方博客 登了一篇题为《Enterprise-Managed Authorization: Zero-touch OAuth for MCP》的文章。Core Maintainer Paul Carleton 写得克制,但消息不小:EMA(Enterprise-Managed Authorization)扩展正式从草案转 stable,Hacker News 一小时内冲到 226 分。同一天,Anthropic、Microsoft、Okta 三家站台背书,Asana、Atlassian、Canva、Figma、Granola、Linear、Supabase 七家 SaaS 同步支持,连 Visual Studio Code 都在 IDE 层面接好了。 ...
昨天 HN 首页第一条挂着《GLM-5.2 is the new leading open weights model on Artificial Analysis》,858 分、417 条评论。发帖人 himata4119,点进去是个新人,但来源不是谁都能上的:Artificial Analysis Intelligence Index v4.1,整个 AI 圈拿来给 frontier 模型排座次的那个第三方评测。 ...
6 月 16 日,Vicki Boykis 那篇《Running local models is good now》冲上 Hacker News 第四,1044 分、437 条评论。她自己用的设备是一台 2022 年的 M2 Mac、64GB 内存、1TB 存储——不是什么 M3 Ultra 工作站,就是普通开发者的常规配置。 ...
6 月 11 日,Show HN: Fata – Spaced repetition to fight skill rot from AI coding 上了 Hacker News 首版,75 分、44 条评论。Fata 本身是一个编程版的 Duolingo:每天 5–10 分钟间隔重复(spaced repetition)练 Rust / CSS / React / Python / TypeScript / Architecture,浏览器里就能用、不用注册。 ...
6 月 12 日晚上 11 点(美东),WSJ 登了一条 独家。第二天早上我醒来,HN 首页上三个故事、The Verge 跟进一条、Times of India 跟进一条。这不是又一次"AI 公司与监管博弈"的远景推演。三件事挤在同一个 48 小时里,分别打在美国两家头部 AI 公司的不同层。 ...