1. 每日精选/

每日精选 — 2026年7月3日

今日概览 #

今天的主线不是模型又多强,而是 AI 正在把软件、网站和团队流程改造成会替人做选择的系统。Latent Space 连续讨论 Vercel 的 agentic software 和 Adobe 的自组装网站,Program-as-Weights 把函数变成小权重,V2EX 的 vibe coding 失控帖则提醒我们:生成能力越强,可审计性越不能缺席。


🐦 来自时间线 (X/Twitter) #

今日没有可用的时间线条目,本栏目不补录。


🎙️ 来自播客 #

Vercel:Agent 是一种新软件,不是聊天框外挂 #

Latent Space · 今日发布

Vercel Chief of Software Andrew Qu 解释了公司内部 agent framework eve 的来由,也把“agentic software”的边界讲得更清楚:Agent 不是把聊天框塞进现有产品,而是需要 skills、sandbox、权限、日志和 agent-readable websites 共同组成执行环境。对开发者来说,这期的价值在于把 Agent 从“会生成内容”拉回到工程问题:它如何读网页、如何调用工具、如何在失败时留下证据。未来 SaaS 的竞争可能不只是 UI 好不好用,而是谁能让人和机器都稳定理解同一个工作系统。

-> 收听


Adobe 的 agentic sites:网站从页面变成临时生成的销售代理 #

Latent Space · 今日发布

这期从 Adobe 对“agentic sites”的实验切入:网站不再固定展示同一组页面,而是围绕访客意图临时组装内容。Carlos Sanchez 讨论的不是传统个性化推荐,而是网页本身可能变成一个会判断、取舍和解释的代理。它对品牌和产品团队的冲击很大:过去我们优化首页、定价页、案例页;以后可能要优化一套生成约束,规定哪些承诺不能被改写、哪些证据必须出现、哪些转化话术不允许越界。网站会从静态资产变成可审计的销售系统。

-> 收听


🤖 来自 AI 对话 #

如果未来的网站是临时组装的,品牌还剩下什么? #

与 Claude Opus 的对话

最容易的回答是:品牌会更重要。内容无限、页面无限,可信符号当然更稀缺。这个回答没有错,但它仍然站在旧网站世界里,因为它默认品牌主要附着在固定界面上。

真正的变化是,网站可能从页面集合变成一组可执行约束。Latent Space 今天连续讨论 Vercel 的 agentic software 和 Adobe 的自组装网站,刺痛人的地方不是网页更个性化,而是网页可能不再是主要资产。资产会变成一套生成宪法:哪些说法不能变,哪些证据必须出现,哪些价格逻辑不能为了转化率被代理扭曲。过去品牌手册管颜色、字体和语气;未来品牌手册要管模型上下文、检索优先级、UI 生成边界和反事实测试。

新的看法是:最会讲故事的公司,可能输给最会写生成规则的公司。因为代理不只是展示品牌,它会替品牌做微型谈判。未来的设计评审也许不问“这一屏好不好看”,而问“这个代理在不同压力下会不会背叛公司真正的承诺”。


Program-as-Weights 是软件工程的进步,还是把代码审查变成考古? #

与 Claude Opus 的对话

表面答案是:当然是进步。一个函数可以从自然语言编译成小型权重,就像 C 语言编译成机器码,只是多了一个编译目标。

但这个类比太舒服了。传统编译器的核心承诺是可追踪:源码、类型、汇编和运行结果之间有相对清晰的解释链。Program-as-Weights 的诱惑在于,它把“难以规则化”的任务变成可本地运行、便宜、可复用的小模型。论文里最抓人的数字不是 4B 编译器,也不是 0.6B Qwen3 解释器,而是用约五十分之一推理内存接近直接调用大模型。真正的问题也在这里:它把组织最讨厌的成本从推理费转移到验证费。

过去代码审查问:这段逻辑是不是错了?未来可能问:这个权重函数在哪些输入分布上会温柔地错?你无法像读 if/else 那样读一个 adapter;你只能构造测试、边界、回归集和行为合同。PAW 不是让软件消失,而是让软件从文本工艺转向实验工艺。


V2EX 的 vibe coding 焦虑,真正怕的是 AI 写错,还是团队失去共同语言? #

与 Claude Opus 的对话

常见答案是:AI 写了太多烂代码,技术债爆炸,所以要加强 review、测试和架构治理。这当然必要,但它只描述了症状。

V2EX 今天的热帖更像一个组织学信号:AI 编码把软件团队的隐性契约拆开了。以前工程师即使写得慢,也共享一套中间物:需求文档、接口草图、PR diff、模块命名、架构会议。现在一个人可以和模型在私密对话里迅速生成几千行代码,很多关键判断发生在对话上下文里,而不是团队可见的工件里。失控不是因为代码突然变多,而是因为“为什么这么写”的证据链被埋进了聊天记录。

这像软件团队的 Excel 时刻:局部生产率提升,组织可理解性下降。最危险的不是初级工程师生成 bug,而是资深工程师用 AI 快速绕过团队讨论,把个人直觉固化成系统结构。AI 编码治理不该只管生成质量,还要管解释资产。


中国 AI 讨论里反复出现“零英伟达”,这是技术胜利还是叙事压力? #

与 Claude Opus 的对话

很多人会说,这是技术胜利。它证明在外部限制下,中国团队能用国产芯片和工程优化跑出大模型,摆脱单点供应链依赖。

这个答案有一半正确,但容易把工程成就误读成线性替代。36kr 和量子位今天都把“零英伟达”放在醒目位置,说明它已经不只是技术指标,而是产业叙事。问题是,供应链叙事和模型能力叙事并不总是同一件事。一个系统完全不用英伟达,可能意味着主权和韧性提升,也可能意味着训练效率、生态适配和工具链成熟度需要付出额外成本。

新的看法是:“零英伟达”的真正价值不在于证明 GPU 不重要,而在于迫使产业回答一个更难的问题:当主流算力不可假设时,模型、编译器、推理框架、数据库和客户场景能不能形成自己的闭环。它不是终点,而是把 AI 竞争从单点性能推进到系统适配。


📚 来自书架 #

过度优化系统为什么害怕波动 #

Nassim Nicholas Taleb · 2012

Taleb 在《反脆弱》里强调,很多系统不是被一次巨大冲击击垮,而是在长期消灭波动后变得无法承受冲击。真正反脆弱的系统会从小错误、小压力和频繁反馈中获益。

与今天的连接: V2EX 的 vibe coding 失控帖正好说明,团队如果只追求 AI 生成速度,短期看是在减少摩擦,长期却可能删除代码评审、架构争论和失败原型这些“小波动”。这些摩擦本来能暴露坏味道,现在被模型产能掩盖,直到一次集成或交接变成大事故。Vercel 对 sandbox、skills 和 agent-readable websites 的强调,也是在把小反馈重新接回系统。AI 团队要问的不是怎样消灭摩擦,而是哪种摩擦能让系统变强。


机器的流畅回答为什么会放大系统一 #

Daniel Kahneman · 2011

Kahneman 提醒我们,人会把“容易处理”误认为“更真实、更好、更可信”。顺滑的表达、熟悉的格式和快速反馈,会让系统一抢在系统二之前给出判断。

与今天的连接: Program-as-Weights 和 Product Hunt 上的 scritty、Context.dev 都在把 AI 能力包装得更轻、更快、更自然,这是好事,也很危险。一个本地小权重函数、一个共享记忆工具、一个自动抽取互联网的 API,都可能因为交互太流畅而逃过深度审查。36kr 关于 Anthropic 删除隐藏代码的报道也提醒我们:工具链越无感,用户越需要知道背后发生了什么。流畅不是可信,低摩擦也不是低风险。


垄断不是规模,而是不可替代的坐标 #

Peter Thiel · 2014

Thiel 在《零到一》中说,真正有价值的公司不是在完全竞争里多赢一点,而是建立某种独特性,让自己不必永远卷在同一条效率曲线上。规模本身不是护城河,不可替代的坐标才是。

与今天的连接: 量子位的“零英伟达”模型报道和 36kr 对国产巨头追赶 Claude Code 的观察,表面是国产替代,深层是寻找不可替代坐标。若一家模型公司只证明“我也能跑大模型”,它仍在别人的坐标系里竞争;但如果它围绕国产芯片、编译器、推理框架、数据库和客户场景形成闭环,差异化就来自系统适配。Thiel 会提醒我们看入口和控制点,而不是只看单次榜单表现。


为什么更多产能会制造更多沟通成本 #

Frederick Brooks · 1975

Brooks 的经典洞见是,软件项目不是简单劳动力相加;新增人手会增加沟通路径、培训成本和集成复杂度,因此可能让延期项目更晚。

与今天的连接: AI 编码代理像是给每个工程师临时加了很多“虚拟人手”。V2EX 对 vibe coding 失控的担忧,正是 Brooks 定律的新版本:不是人变多了,而是代码生产者变多了、决策痕迹变少了、集成成本变隐形了。Latent Space 讨论 Vercel 的 skill engineering,也说明未来关键不只是让代理多干活,而是让代理产出的工作可组合、可复查、可维护。如果代码产能变成十倍,沟通结构也要承担十倍的解释压力。


⚡ 快讯 #

Program-as-Weights:把模糊函数编译成小权重 #

Hugging Face Daily Papers · 18 票 · 2 评论

这篇论文把日志告警、JSON 修复、意图排序等难以规则化的函数,编译成可本地运行的小型神经权重。它的意义不只是省推理成本,而是把软件工程的一部分从“读代码”推向“验证行为”。未来代码审查会更像实验设计。

-> 原文


Vibe coding 项目失控:AI 编码开始暴露组织债 #

V2EX · 140 replies

这条中文开发者讨论的价值不在吐槽某个工具,而在指出 AI 编码把团队共同语言打散了。代码量变多、上下文留在私聊、架构决策缺少可见证据,都会让集成和交接变成后置风险。AI 编程真正需要的是解释资产。

-> 原文


“零英伟达”万亿模型:国产算力叙事进入开发者市场 #

量子位 QbitAI · 首页焦点

量子位报道“全球首个英伟达含量为 0 的万亿模型”在海外开发者中走热。这个信号不能只读成单点性能胜利,更要看它背后的系统适配:国产芯片、编译器、推理框架和开发者工具能不能组成完整闭环。

-> 原文


Virginia 禁止出售地理位置数据:隐私监管继续下沉到数据经纪层 #

Hacker News · 558 points · 97 comments

Virginia 禁止出售 geolocation data 在 HN 引发高热讨论,说明隐私治理正在从平台条款进入数据流通本身。对 AI 产品尤其重要:位置、行为和上下文数据越容易被模型使用,数据经纪和二次出售就越会成为监管重点。

-> 原文


Anthropic 删除隐藏识别代码:工具治理不能只靠“这是实验” #

36kr AI · CSDN

36kr 转述 Anthropic 删除识别“中国 AI”的隐藏代码及官方回应。无论技术细节如何,这类事件都会削弱开发者对工具链的信任:Agent 工具不是黑盒助手,而是会进入终端、仓库和生产流程的执行层,治理动作必须可解释。

-> 原文


来源内容要点
Hacker NewsSince Linux 6.9, LUKS suspend stopped wiping disk-encryption keys from memory · 416 points / 190 comments安全回归提醒我们,系统级可靠性常常毁在默认行为变化,而不是显眼漏洞。
36kr AI国产巨头追赶Claude Code,阿里/腾讯/字节都聚齐了中文 AI 编程工具竞争升温,真正分水岭会是 IDE、权限、测试和企业流程整合。
Product Huntscritty为 AI coding agent 做共享、可搜索记忆,说明多代理协作的下一步是上下文基础设施。
Product HuntContext.dev用一个 API 抓取、增强和抽取互联网内容,适合 agent 把外部网页变成结构化输入。
Hacker Newscrustc: entirety of rustc, translated to C · 161 points / 31 comments把 rustc 翻译成 C 是极端工程实验,也提醒我们语言生态的可迁移性仍有现实价值。
GitHubZsun79/ConferenceWatch · 121 stars用 Agent Skill 跟踪 AI 会议 deadline,是把个人信息流自动化成可复用技能的轻量例子。
V2EXTransOne:macOS 原生菜单栏翻译工具 · 62 replies中文独立开发者仍在打磨本地工具体验,多 provider 和视觉焦点设计比“又一个翻译壳”更关键。
36kr AI这届毕业生,忙着让论文与AI划清界限AI 检测误判把学术诚信推向流程治理,二元标签已经不够处理真实写作链条。
36kr AI扎克伯格,把AI牛市吓了一跳Meta 的 AI 投入正在挑战资本市场对算力、增长和回报周期的乐观叙事。
Hacker NewsSony Deletes 551 Movies PlayStation Owners Paid For · 611 points / 285 comments数字所有权的脆弱性再次被放大,内容、平台和许可关系会影响用户对云服务的信任。

编辑分析 #

今天最重要的张力是:AI 正在接管“选择”,但软件行业还没有准备好审计这些选择。

我们今天看到的不是一组孤立新闻。Vercel 的 Andrew Qu 说 agent 是新软件,Adobe 的 agentic sites 把网站改造成按访客意图临时生成的界面,Program-as-Weights 则进一步把模糊函数编译成小权重。它们共同指向同一件事:软件不再只是执行人写好的确定逻辑,而是在运行时替用户、团队和公司做判断。V2EX 的 vibe coding 失控帖给了反面证据:当判断藏在提示词、聊天记录和模型输出里,团队失去的不是代码质量,而是共同解释系统的能力。

第一,AI Engineering 正在从模型调用变成证据工程。 Program-as-Weights 的五十分之一推理内存很诱人,但真正成本转移到了验证;Vercel 强调 sandbox、skills 和 agent-readable websites,也是为了让代理行为可约束。读者要关注的不是哪个工具生成更快,而是谁能留下测试、日志、回滚和行为合同。

第二,网站会从品牌橱窗变成可审计销售代理。 Adobe 的自组装网站实验说明,首页、定价页、案例页会被生成规则取代。品牌不再只是视觉和文案,而是模型在不同用户压力下不能背叛的承诺。产品团队要提前写生成边界,而不是等代理为了转化率乱讲故事。

第三,国产 AI 的关键不只是替代英伟达,而是建立自己的坐标系。 量子位的“零英伟达”模型和 36kr 对阿里、腾讯、字节追赶 Claude Code 的观察,都说明中国团队在争夺系统闭环。Thiel 的问题在这里很实用:你是在证明“我也可以”,还是在形成别人难复制的芯片、框架、模型、客户流程组合?

延伸阅读建议三条:Program-as-Weights看软件范式变化,Vercel agents看 agentic software 的工程边界,V2EX vibe coding 讨论看中文团队正在遭遇的真实组织成本。


lz.wiki 每日精选 · 25 条来自 17 个源 · 2026年7月3日 13:00 CST RSS 订阅 · 所有精选