Agent 工程化实战手册:5 个团队在 7 月初撞到同一面墙
我 7 月 2 日到 3 日这两天,在 Hacker News、X、博客、公众号上读到的 5 条工程化 tip,读完后脑子里自己串成了一条线。这条线以前散在不同信源里没被点过,但 24 小时内集中爆出来,让我很难再忽略。 ...
我 7 月 2 日到 3 日这两天,在 Hacker News、X、博客、公众号上读到的 5 条工程化 tip,读完后脑子里自己串成了一条线。这条线以前散在不同信源里没被点过,但 24 小时内集中爆出来,让我很难再忽略。 ...
如果你只看产品对比表,Codex 和 Claude Code 的差异能列三十条:用哪个模型、支不支持浏览器、限额给多少、能不能在手机上续上。但这些都不是今天我想写的。 ...
早上九点,on-call 工程师一边啃吐司一边盯 PagerDuty。Slack 上有人问「昨晚那次事故到底怎么回事」,PR 评论里有人在 diff 上吵,定向消息的截图已经传了三个群。 ...
6 月 16 日,Vicki Boykis 那篇《Running local models is good now》冲上 Hacker News 第四,1044 分、437 条评论。她自己用的设备是一台 2022 年的 M2 Mac、64GB 内存、1TB 存储——不是什么 M3 Ultra 工作站,就是普通开发者的常规配置。 ...
今天 GitHub 热榜有一个很扎眼的信号:Agent Skills 集体冒头。 日榜里,obra/superpowers 排到第 2,主打 agentic skills framework 和软件开发方法论;K-Dense-AI/scientific-agent-skills 排到第 3,给科研、工程、分析、金融、写作准备了一组可直接使用的 Agent Skills。月榜更夸张,mattpocock/skills、multica-ai/andrej-karpathy-skills、ComposioHQ/awesome-codex-skills、addyosmani/agent-skills、NousResearch/hermes-agent、zilliztech/claude-context、rohitg00/agentmemory 一起出现。 ...
OpenAI 最近把 Codex 带进了 ChatGPT 的 iPhone、iPad 和 Android 应用。乍一看,这只是“手机上也能用 Codex”这么简单。 但我觉得重点不在“移动端写代码”。老实讲,谁真想在手机上盯着 diff 改半小时代码?这事听起来就很折磨。 ...
我最近越来越强烈地觉得,AI 圈最容易被高估的一件事,就是“新模型发布”本身。 以前大家一看到新版本上线,第一反应都是:强了多少,聪明了多少,榜单涨了多少。现在这个套路已经有点疲了。不是模型不重要,而是用户,尤其是开发者,已经被教育得很现实了。你说你升级了,可以。但我更想问一句:然后呢? ...