mirror of
https://github.com/wahyd4/one-knowledge.git
synced 2026-08-08 20:59:08 +10:00
Sync: 6 new posts from Links App (2026-06-06 06:30)
This commit is contained in:
+1
-1
@@ -1 +1 @@
|
||||
2026-06-04T17:01:18.420906+10:00
|
||||
2026-06-05T20:35:25.927560+10:00
|
||||
@@ -0,0 +1,26 @@
|
||||
---
|
||||
title: "2026-06-05-technology"
|
||||
created: 2026-06-05
|
||||
updated: 2026-06-05
|
||||
type: summary
|
||||
tags: [newsletter, technology]
|
||||
external: http://go/ui/posts/2711/
|
||||
---
|
||||
|
||||
**Tech news**
|
||||
- [软银CEO孙正义因AI投资重回巅峰,宣布至少520亿美元投资法国数据中心](https://www.wsj.com/tech/ai/softbank-ceos-bad-bets-left-him-in-despair-an-ai-spree-has-him-back-on-top-e3f9ca06?mod=rss_Technology)
|
||||
孙正义此前因糟糕押注陷入绝望,如今AI热潮让他重回巅峰,并计划大规模投资法国数据中心。
|
||||
- [日本可能隐藏“最佳AI价值”,巴克莱称](https://www.cnbc.com/2026/06/04/japan-may-be-hiding-the-best-ai-value-barclays-says.html)
|
||||
巴克莱建议投资者关注日本市场,认为其AI潜力被低估。
|
||||
- [顶级AI CEO呼吁制定法律防止生物武器](https://www.wsj.com/politics/policy/top-ai-ceos-call-for-law-protecting-against-biological-weapons-88f2f99f?mod=rss_Technology)
|
||||
人工智能加剧了犯罪分子释放新型病原体的担忧,CEO们要求立法保护。
|
||||
- [Meta多次推迟向开发者发布新AI模型](https://www.wsj.com/tech/ai/meta-keeps-delaying-the-release-of-its-new-ai-model-to-developers-f8569c8c?mod=rss_Technology)
|
||||
时间表的反复推迟削弱了Meta将AI投资变现的能力。
|
||||
- [比特币高信念持有者开始抛售,价格创年内新低](https://www.cnbc.com/2026/06/03/bitcoins-high-conviction-holders-are-selling-as-price-hits-new-lows.html)
|
||||
过去两天,比特币最坚定的持有者已抛售约24亿美元。
|
||||
- [欧洲推出技术主权计划,减少对美国科技依赖](https://www.cnbc.com/2026/06/03/europe-tech-sovereignty-us-tech-reliance.html)
|
||||
提案包括加强先进芯片制造和本土云计算,确保“无人拥有杀毒开关”。
|
||||
- [富士康与英特尔合作开发AI基础设施](https://www.wsj.com/tech/foxconn-intel-team-up-to-develop-ai-infrastructure-d9a7bed3?mod=rss_Technology)
|
||||
双方联手解决现代数据中心的关键瓶颈问题。
|
||||
- [博通股价暴跌因软件销售疲软,AI芯片预测未变](https://www.cnbc.com/2026/06/03/broadcom-avgo-earnings-report-q2-2026.html)
|
||||
博通第二财季收入不及预期,软件业务拖累股价大幅下跌。
|
||||
@@ -0,0 +1,68 @@
|
||||
---
|
||||
title: "📰 每日新闻简报 | 2026-06-05"
|
||||
created: 2026-06-05
|
||||
updated: 2026-06-05
|
||||
type: summary
|
||||
tags: [2026, hackernews, international, news, stocks, tech]
|
||||
external: http://go/ui/posts/2712/
|
||||
---
|
||||
|
||||
# 📰 每日新闻简报 | 2026-06-05
|
||||
|
||||
## 🌍 国际要闻
|
||||
|
||||
**BBC World**
|
||||
- [泽连斯基在致普京的公开信中提议面对面会谈](https://www.bbc.com/news/articles/cwy2ypyp4x4o?at_medium=RSS&at_campaign=rss)
|
||||
- [真主党拒绝接受以色列与黎巴嫩达成的停火协议](https://www.bbc.com/news/articles/c052343r812o?at_medium=RSS&at_campaign=rss)
|
||||
- [众议院就伊朗问题批评特朗普后,特朗普回击称其"不爱国"](https://www.bbc.com/news/articles/cn0pl0wvvz0o?at_medium=RSS&at_campaign=rss)
|
||||
- [检方称迪拜统治者侄子的前妻被拘留](https://www.bbc.com/news/articles/cx2124zylxno?at_medium=RSS&at_campaign=rss)
|
||||
- [荷兰警方调查多名女性疑似被下药及性侵案件](https://www.bbc.com/news/articles/cp8p8e1gnx7o?at_medium=RSS&at_campaign=rss)
|
||||
|
||||
## 💻 科技资讯
|
||||
|
||||
**TechCrunch**
|
||||
- [Anthropic 总裁 Daniela Amodei 在IPO前夕对AI回报的质疑不以为意](https://techcrunch.com/2026/06/04/ahead-of-its-ipo-anthropics-daniela-amodei-shrugs-off-doubts-about-ais-returns/)
|
||||
- [Airbnb CEO Brian Chesky 计划成立新AI实验室](https://techcrunch.com/2026/06/04/airbnbs-brian-chesky-plans-to-launch-a-new-ai-lab/)
|
||||
- [Filtr:一款新的隐私工具,可在几乎所有iPhone和Mac应用中屏蔽广告](https://techcrunch.com/2026/06/04/filtr-is-a-new-privacy-tool-that-blocks-ads-in-almost-every-iphone-and-mac-app/)
|
||||
- [国防科技、AI与募资将成为6月18日StrictlyVC洛杉矶大会的焦点](https://techcrunch.com/2026/06/04/defense-tech-ai-and-fundraising-take-center-stage-at-strictlyvc-los-angeles-on-june-18/)
|
||||
- [Startup Battlefield重返澳大利亚——上次悉尼之行回顾](https://techcrunch.com/2026/06/04/startup-battlefield-is-returning-to-australia-heres-what-happened-the-last-time-we-came-to-sydney/)
|
||||
|
||||
## 📈 美股行情(2026-06-04 收盘)
|
||||
|
||||
### 主要指数
|
||||
| 指数 | 收盘价 | 涨跌 |
|
||||
|------|--------|------|
|
||||
| Nasdaq Composite | 26,830.96 | -23.02 (-0.09%) |
|
||||
| Nasdaq-100 (NDX) | 30,407.81 | -163.43 (-0.53%) |
|
||||
| Dow Jones | 51,561.93 | +874.86 (+1.73%) |
|
||||
|
||||
### Nasdaq 科技股
|
||||
| 股票 | 价格 | 涨跌 |
|
||||
|------|------|------|
|
||||
| NVDA | $216.96 | -1.70 (-0.78%) |
|
||||
| AAPL | $311.30 | +0.07 (+0.02%) |
|
||||
| MSFT | $427.95 | -0.10 (-0.02%) |
|
||||
| GOOGL | $371.70 | -0.49 (-0.13%) |
|
||||
| META | $624.85 | -2.72 (-0.43%) |
|
||||
| AMZN | $253.70 | -0.09 (-0.04%) |
|
||||
| TSLA | $417.08 | -1.37 (-0.33%) |
|
||||
| AMD | $517.24 | -5.96 (-1.14%) |
|
||||
| INTC | $110.22 | -1.56 (-1.40%) |
|
||||
|
||||
> 市场简析:纳斯达克与科技股整体小幅回调,纳指微跌0.09%,纳指100跌0.53%。然而道琼斯指数大涨1.73%,显示资金轮动至传统蓝筹板块。科技股方面,NVDA延续回调跌0.78%,AMD跌1.14%领跌,INTC跌1.40%跌幅最大。AAPL微涨0.02%基本持平。整体市场情绪偏谨慎,AI板块面临IPO前的不确定性压力。
|
||||
|
||||
## 🏄 Hacker News Top 10
|
||||
|
||||
1. [VoidZero 加入 Cloudflare](https://blog.cloudflare.com/voidzero-joins-cloudflare/) — 535 points, 242 comments
|
||||
2. [Ian的安全鞋带系法](https://www.fieggen.com/shoelace/secureknot.htm) — 461 points, 179 comments
|
||||
3. [AI自我构建时:我们迈向递归自我改进的进展](https://www.anthropic.com/institute/recursive-self-improvement) — 243 points, 324 comments
|
||||
4. [复古科技育儿](https://havenweb.org/2026/05/28/retro-tech.html) — 217 points, 151 comments
|
||||
5. [Anthropic的开源AI漏洞发现框架](https://github.com/anthropics/defending-code-reference-harness) — 178 points, 61 comments
|
||||
6. [KVarN:华为开发的KV缓存量化原生vLLM后端](https://github.com/huawei-csl/KVarN) — 107 points, 10 comments
|
||||
7. [Castor:CERN高级存储管理器](https://castor.web.cern.ch/content/home.html) — 37 points, 15 comments
|
||||
8. [URL中的IPv6区域标记是个错误](https://xeiaso.net/notes/2026/ipv6-zones-go-url/) — 32 points, 15 comments
|
||||
9. [Branchless Quicksort 比 std::sort 和 pdqsort 更快,支持C和C++ API](https://tiki.li/blog/blqsort) — 31 points, 6 comments
|
||||
10. [我对颠覆学校教育持怀疑态度](https://www.scottyoung.com/blog/2026/05/27/revolutionize-schooling/) — 14 points, 6 comments
|
||||
|
||||
---
|
||||
*新闻来源:BBC / TechCrunch / HN | 股市数据:Yahoo Finance | 抓取时间:2026-06-05 09:00 AEDT*
|
||||
@@ -0,0 +1,27 @@
|
||||
---
|
||||
title: "2026-06-05-victoria"
|
||||
created: 2026-06-05
|
||||
updated: 2026-06-05
|
||||
type: summary
|
||||
tags: [local_news, newsletter]
|
||||
external: http://go/ui/posts/2713/
|
||||
---
|
||||
|
||||
# Big news
|
||||
|
||||
- [墨尔本成为全国汽车盗窃之都](https://www.theage.com.au/national/victoria/more-cars-stolen-in-melbourne-than-in-all-other-capital-cities-combined-20260602-p6038i.html?ref=rss&utm_medium=rss&utm_source=rss_national_victoria)
|
||||
去年维州汽车被盗保险赔付总额达2.43亿澳元,超过澳大利亚其他所有首府城市总和。
|
||||
- [澳大利亚回击特朗普关税威胁,美方谴责“不可接受”的失败](https://www.sbs.com.au/news/article/australia-trump-tariff-threat-forced-labour/9q7aa3uhh)
|
||||
总理阿尔巴尼斯表示,澳大利亚与美国在关税问题上存在“意识形态分歧”。专家指出,美国总统的威胁可能是机会主义的,但其担忧并非完全没有根据。
|
||||
- [继MIFF售票平台被攻击后,ACMI也遭遇数据泄露](https://www.theage.com.au/national/victoria/acmi-hit-with-data-breach-days-after-miff-s-ticketing-platform-hacked-20260604-p603yj.html?ref=rss&utm_medium=rss&utm_source=rss_national_victoria)
|
||||
澳大利亚动态影像中心(ACMI)成为一周内第二家遭遇数据泄露的墨尔本艺术机构。
|
||||
- [警方指控ISIS新娘在家人购买未成年奴隶后,充当虐待父亲的“副手”](https://www.theage.com.au/national/victoria/isis-bride-acted-like-deputy-to-abusive-father-after-family-bought-teen-slave-police-claim-20260603-p603nt.html?ref=rss&utm_medium=rss&utm_source=rss_national_victoria)
|
||||
法庭获悉,一名被伊斯兰国俘虏的奴隶被卖给居住在叙利亚的一个墨尔本家庭,用于性服务和家务劳动。
|
||||
- [超市巨头Woolworths起诉郊区铁路环线项目,索赔7000万澳元](https://www.theage.com.au/national/victoria/fresh-feud-people-woolworths-sues-suburban-rail-loop-for-70-million-20260604-p603zf.html?ref=rss&utm_medium=rss&utm_source=rss_national_victoria)
|
||||
这家零售巨头因其认为过低的土地强制征用赔偿报价而采取法律行动。
|
||||
- [“太平洋烟灰缸”:斐济拒绝澳洲亿万富翁的废物运输和焚烧计划](https://www.sbs.com.au/news/article/fiji-rejects-australian-billionaires-plan-to-ship-and-burn-waste/affqugsxg)
|
||||
一项将该地区不可回收垃圾运往斐济焚烧的提议被称为“废物殖民主义”,遭到斐济拒绝。
|
||||
- [黄英贤就船队活动家涉嫌性侵调查被严厉质询](https://www.sbs.com.au/news/article/penny-wong-grilled-on-investigation-into-alleged-sexual-assault-of-flotilla-activist/bn8xpbdnq)
|
||||
在参议院估算听证会上,外交部长还被问及澳大利亚帮助多少人离开了加沙。
|
||||
- [“全力以赴”:维州“大型建设”清理工作的核心人物卸任](https://www.theage.com.au/national/victoria/had-an-absolute-crack-top-player-in-big-build-clean-up-steps-down-20260604-p603yg.html?ref=rss&utm_medium=rss&utm_source=rss_national_victoria)
|
||||
高级官员Steve Dargavel被认为是解决维州丑闻缠身的建筑行业中最有效的参与者之一。
|
||||
@@ -0,0 +1,10 @@
|
||||
---
|
||||
title: "4.83489 for AUD to CNY on 6/5/2026"
|
||||
created: 2026-06-05
|
||||
updated: 2026-06-05
|
||||
type: summary
|
||||
tags: [aud, bot, cny, rate]
|
||||
external: http://go/ui/posts/2714/
|
||||
---
|
||||
|
||||
Current rate from 1 AUD to CNY is ¥4.83489 at time 2026-06-04T00:00:00+0000, more info please check <https://www.tradingview.com/chart/MozVMfOY/?symbol=BITSTAMP%3ABTCUSD>
|
||||
@@ -0,0 +1,27 @@
|
||||
---
|
||||
title: "2026-06-05-world_news"
|
||||
created: 2026-06-05
|
||||
updated: 2026-06-05
|
||||
type: summary
|
||||
tags: [newsletter, world_news]
|
||||
external: http://go/ui/posts/2715/
|
||||
---
|
||||
|
||||
# 世界头条新闻
|
||||
|
||||
- [SpaceX提前纳入标普指数受阻,S&P重申现有规则](https://www.cnbc.com/2026/06/05/spacex-blocked-from-early-us-benchmark-index-entry-as-sp-reaffirms-existing-rules.html)
|
||||
标普全球表示不会改变主要指数纳入要求,重创马斯克旗下SpaceX的IPO计划。
|
||||
- [真主党拒绝以色列与黎巴嫩达成的新停火协议](https://www.bbc.com/news/articles/c052343r812o?at_medium=RSS&at_campaign=rss)
|
||||
美国在最新一轮会谈后于周三宣布停火协议,但真主党表示拒绝,中东局势再度紧张。
|
||||
- [亚洲科技股暴跌,博通令人失望的业绩引发AI板块大轮动](https://www.cnbc.com/2026/06/05/asian-technology-stocks-sk-hynix-samsung-tsmc-advantest.html)
|
||||
因博通财报不及预期,华尔街AI概念股遭抛售,亚洲半导体股随之大跌,韩国股市重挫5%。
|
||||
- [沃伦邀请英伟达CEO黄仁勋出席参议院听证会,讨论对华AI芯片销售](https://www.cnbc.com/2026/06/04/nvidia-ceo-jensen-huang-warren-senate-hearing-china-ai-chips.html)
|
||||
参议员沃伦就出口管制、对华销售及数据中心政策向英伟达施压,国会正严审AI芯片热潮。
|
||||
- [习近平将罕见访问朝鲜,与金正恩会晤](https://www.bbc.com/news/articles/clypym3q7p1o?at_medium=RSS&at_campaign=rss)
|
||||
习近平将于6月8日至9日访问朝鲜,这是对孤立政权的罕见访问。
|
||||
- [泽连斯基致信普京,提议举行面对面和谈](https://www.bbc.com/news/articles/cwy2ypyp4x4o?at_medium=RSS&at_campaign=rss)
|
||||
乌克兰总统在公开信中告诉俄罗斯领导人,只有两国“直接接触”才能结束战争,而美国正专注于伊朗问题。
|
||||
- [韩国劳动部长呼吁科技公司向供应商和员工分享AI超额利润](https://www.cnbc.com/2026/06/05/south-korea-labor-minister-calls-on-tech-firms-to-share-excess-ai-profits-with-suppliers-staff.html)
|
||||
警告不平等风险加剧,要求主要科技公司分享利润成果。
|
||||
- [印度央行维持利率在5.25%不变,下调增长预期并上调通胀预测](https://www.cnbc.com/2026/06/05/india-rbi-rate-gdp-inflation.html)
|
||||
印度央行将截至2027年3月的年度通胀预测上调50个基点至5.1%,同时将增长预期从6.9%下调至6.6%。
|
||||
@@ -0,0 +1,317 @@
|
||||
---
|
||||
title: "Anthropic Institute分析指出AI正加速进入研发流程递归自我改进趋势可能使人类从执行者变为监督者需提前建立治理机制"
|
||||
created: 2026-06-05
|
||||
updated: 2026-06-05
|
||||
type: summary
|
||||
tags: [AI, notes, policy, safety, telegram]
|
||||
external: http://go/ui/posts/2716/
|
||||
---
|
||||
|
||||
大哥,这篇 Anthropic Institute 的文章核心不是在说“AI 已经会完全自我进化了”,而是在说:**AI 参与 AI 研发的比例正在快速上升,如果这条趋势继续,AI 可能从“辅助人类研发 AI”走向“自主研发下一代 AI”,这就是 recursive self-improvement(递归自我改进)带来的机会和风险。**
|
||||
|
||||
## 1. 这篇文章的主线:AI 研发闭环正在逐步合上
|
||||
|
||||
Anthropic 把 AI 研发的演化分成几个阶段:
|
||||
|
||||
| 阶段 | 人类角色 | AI 角色 |
|
||||
| --------- | ------------- | ----------------------------- |
|
||||
| 2021–2023 | 人类写代码、写文档、做实验 | 基本没有参与 |
|
||||
| 2023–2025 | 人类主导 | AI 聊天机器人辅助写代码片段 |
|
||||
| 2025–2026 | 人类给任务、审查结果 | Coding agent 可以改文件、跑代码 |
|
||||
| 当前 | 人类设目标、监督、判断 | AI agent 可以执行数小时任务、调用其他 agent |
|
||||
| 未来可能 | 人类主要负责监督/验证 | AI 自己设计、训练、改进下一代模型 |
|
||||
|
||||
Anthropic 的说法是:**现在还没有达到完整递归自我改进,但 AI 已经在显著加速 AI 研发本身。** 他们特别强调,如果 AI 有一天能“完整自主设计和开发自己的继任者”,那就是完整的 recursive self-improvement。([Anthropic][1])
|
||||
|
||||
这篇文章真正想表达的是:**AI 不只是一个被动工具,它正在进入“生产 AI 的生产流程”本身。** 这比“AI 会写代码”更重要,因为一旦研发 AI 的过程被 AI 加速,能力提升就可能出现复利效应。
|
||||
|
||||
---
|
||||
|
||||
## 2. Anthropic 给出的关键证据
|
||||
|
||||
### 证据一:AI 可独立完成任务的时间跨度在变长
|
||||
|
||||
文章引用了 METR 的任务时间跨度指标,说 AI 能可靠独立完成的任务长度大约每 4 个月翻倍,而此前趋势约为每 7 个月翻倍。Anthropic 给出的例子是:2024 年 3 月 Claude Opus 3 能完成大约人类 4 分钟的软件任务;一年后 Claude Sonnet 3.7 能完成约 1.5 小时任务;再一年后 Claude Opus 4.6 能完成 12 小时任务。([Anthropic][1])
|
||||
|
||||
这个指标很重要,因为 agent 真正有用,不只是“单步回答很聪明”,而是能不能在长时间、多步骤、有反馈、有错误恢复的任务里保持方向。软件工程、科研实验、训练调参,都是长链路任务。
|
||||
|
||||
我的理解是:**这比 benchmark 分数更接近真实生产力。** 一个模型在选择题上 95% 不代表能完成真实项目;但如果它能稳定完成 8 小时、12 小时、几天的人类任务,那组织形态就会变。
|
||||
|
||||
---
|
||||
|
||||
### 证据二:Anthropic 内部代码生产方式已经变了
|
||||
|
||||
文章称,截至 2026 年 5 月,Anthropic 合并进代码库的代码中,超过 80% 由 Claude 编写;在 2025 年 2 月 Claude Code research preview 之前,这个比例还只是低个位数。文章还称,2026 年第二季度,典型工程师每天合并的代码量约为 2024 年的 8 倍。([Anthropic][1])
|
||||
|
||||
但他们也承认,**代码行数不是完美生产力指标**,因为代码量多不等于质量高;所以 8 倍代码量很可能高估了真实生产力提升。([Anthropic][1])
|
||||
|
||||
这里我觉得要分两层看:
|
||||
|
||||
第一层,**“AI 写了很多代码”是真的很重要**。这说明 AI 已经不是 autocomplete,而是在生产系统里承担实际工程劳动。
|
||||
|
||||
第二层,**“代码量提升 8 倍”不能直接等同于工程效率提升 8 倍**。因为更多代码也可能带来更多 review、测试、架构债务和维护成本。真正关键的是:缺陷率、上线周期、incident 数量、长期可维护性是否也同比改善。
|
||||
|
||||
---
|
||||
|
||||
### 证据三:AI 在明确目标下做实验已经很强
|
||||
|
||||
Anthropic 说,他们每次发布模型都会做一个固定测试:给 Claude 一段训练小模型的代码,让它在保持正确性的前提下尽可能加速。2025 年 5 月 Claude Opus 4 平均能做到约 3 倍加速;到 2026 年 4 月 Claude Mythos Preview 做到约 52 倍。作为对照,熟练人类研究员需要 4 到 8 小时才能做到约 4 倍。([Anthropic][1])
|
||||
|
||||
这说明 AI 在一种任务上已经非常强:**目标明确、指标明确、可以反复试错、可以自动验证。**
|
||||
|
||||
这类任务包括:
|
||||
|
||||
* 优化代码性能
|
||||
* 写测试、修 bug
|
||||
* 跑实验、读结果、改参数
|
||||
* 分析训练失败原因
|
||||
* 做大量工程性探索
|
||||
|
||||
这也是为什么文章说,AI 进步不一定需要很多“天才灵感”。很多 frontier AI 进步其实是:scale up → 发现问题 → 修问题 → 再试一次。Anthropic 认为 Claude 正在擅长的,正是这种“99% perspiration”的工作。([Anthropic][1])
|
||||
|
||||
---
|
||||
|
||||
### 证据四:AI 开始接近“研究判断”,但还没完全取代人类
|
||||
|
||||
文章最关键的分界线在这里。
|
||||
|
||||
Anthropic 承认,Claude 现在和完整自我改进系统之间的差距,主要不是“能不能执行任务”,而是:**能不能自己判断什么目标值得做、什么实验值得跑、什么结果值得相信、什么时候该放弃一个方向。**([Anthropic][1])
|
||||
|
||||
文章中提到一个内部分析:他们选取 2026 年 1 月到 3 月真实 Claude Code 研究 session 中人类研究员走偏的时刻,把走偏前的上下文给不同模型,让模型建议下一步。然后由另一个能看到完整结果的 Claude 判断谁的下一步更好。结果是,2025 年 11 月的 Opus 4.5 有 51% 情况比人类选择更好;2026 年 4 月 Mythos Preview 提升到 64%。([Anthropic][1])
|
||||
|
||||
这个结果有意义,但也要谨慎。Anthropic 自己说,这不是严格的人类 vs AI 公平比较,因为他们故意挑了人类“有改进空间”的片段。([Anthropic][1])
|
||||
|
||||
所以我的判断是:
|
||||
|
||||
**AI 在局部研究判断上正在变强,但还不能证明它已经具备顶级研究员级别的“research taste”。**
|
||||
|
||||
不过 Anthropic 的更激进观点是:research taste 可能也只是另一个普通能力。就像以前大家觉得 AI 不会写长代码、不会解释笑话、不会理论推理,后来都被逐步突破一样,研究判断也可能被突破。([Anthropic][1])
|
||||
|
||||
---
|
||||
|
||||
## 3. 文章里的核心概念:recursive self-improvement 到底是什么?
|
||||
|
||||
Recursive self-improvement 可以翻译成:
|
||||
|
||||
**递归自我改进 / 自我增强循环 / AI 自己改进 AI。**
|
||||
|
||||
普通 AI 研发流程是:
|
||||
|
||||
> 人类研究员 → 设计模型/训练方法/数据/评估 → 训练出更强模型
|
||||
|
||||
递归自我改进是:
|
||||
|
||||
> AI 系统 → 设计更强 AI → 新 AI 更擅长设计下一代 AI → 下一代再继续改进
|
||||
|
||||
关键在“递归”二字:
|
||||
不是 AI 改进一次,而是**改进出来的新系统又继续参与下一轮改进**。
|
||||
|
||||
这可能带来一个正反馈循环:
|
||||
|
||||
> 更强 AI → 更快研发 → 更强 AI → 更快研发 → …
|
||||
|
||||
Anthropic 担心的是,一旦这个循环足够自动化,人类可能从“研发者”变成“旁观者/审核者”,而且审核速度可能远远跟不上 AI 生成方案、代码、实验、模型的速度。
|
||||
|
||||
---
|
||||
|
||||
## 4. Anthropic 提出的三种未来
|
||||
|
||||
文章设想了三个可能场景。
|
||||
|
||||
### 场景一:趋势放缓,当前能力广泛扩散
|
||||
|
||||
也就是现在看起来像指数增长,但最后变成 S 曲线。可能原因包括:
|
||||
|
||||
* Transformer 或现有架构遇到瓶颈;
|
||||
* 高质量数据不够;
|
||||
* 算力、电力、芯片、网络带宽成为约束;
|
||||
* 研究判断无法靠简单 scaling 获得;
|
||||
* 外部冲击导致 AI 投资或训练放缓。
|
||||
|
||||
Anthropic 认为这个场景可能性相对较低,但如果发生,社会会有更多时间适应。([Anthropic][1])
|
||||
|
||||
我觉得这是很多 AI 怀疑派会支持的观点:**现在的增长未必能无限外推。** 很多技术都会经历早期爆发,然后遇到现实世界约束。
|
||||
|
||||
---
|
||||
|
||||
### 场景二:AI lab 继续获得复合效率提升,但人类仍负责方向
|
||||
|
||||
这个场景我认为是最现实、最接近当下趋势的。
|
||||
|
||||
也就是:
|
||||
|
||||
* AI 大量写代码;
|
||||
* AI 大量跑实验;
|
||||
* AI 大量提出候选方案;
|
||||
* 人类负责目标选择、审查、验证、伦理和战略判断;
|
||||
* 组织效率极大提升。
|
||||
|
||||
Anthropic 说,在这个场景里,100 人公司可能做出过去 1 万人甚至 10 万人组织的工作。([Anthropic][1])
|
||||
|
||||
但这里会出现 Amdahl’s Law 式瓶颈:你把写代码速度提升 10 倍,review 可能变成瓶颈;你把实验生成速度提升 100 倍,判断哪些实验值得做可能变成瓶颈;你把漏洞发现速度提升 1000 倍,patch 和部署会变成瓶颈。Anthropic 已经观察到,人类 code review 正在成为新的瓶颈。([Anthropic][1])
|
||||
|
||||
这对工程组织特别重要。未来竞争力不只是“有没有 AI 工具”,而是:
|
||||
|
||||
> 组织能否快速识别并重构瓶颈。
|
||||
|
||||
例如 review、测试、CI、security gate、observability、incident response、product decision、compliance 都可能需要重新设计。
|
||||
|
||||
---
|
||||
|
||||
### 场景三:完整递归自我改进
|
||||
|
||||
这是文章最担心的场景。
|
||||
|
||||
在这个世界里,AI 不只是帮助人类研发 AI,而是自己构建、训练、评估、优化后继模型。AI 研发速度主要由算力、算法效率、推理成本和实验基础设施决定,人类更多转向 oversight、validation、verification。([Anthropic][1])
|
||||
|
||||
这个场景的风险是:
|
||||
|
||||
* AI 能力进步太快,人类制度跟不上;
|
||||
* 对齐问题还没解决,系统已经开始自我迭代;
|
||||
* 小的 misalignment 可能在迭代中被放大;
|
||||
* 人类越来越难理解模型为什么变强、怎么变强、是否可靠;
|
||||
* 经济中人类劳动竞争力可能快速下降。
|
||||
|
||||
但文章也说,即使 AI 实验室以“算力速度”进步,现实世界仍有很多慢变量:药物长期安全性、工业生产、法律制度、选举周期、人际关系、社会信任,都不会因为 AI 更聪明就立刻加速。([Anthropic][1])
|
||||
|
||||
这点我觉得非常重要。**智能进步可以很快,但现实世界的吸收速度未必同样快。** 所以未来可能不是“所有东西一夜之间变化”,而是“上游研发剧烈加速,下游社会制度和物理世界慢慢消化”,中间产生巨大张力。
|
||||
|
||||
---
|
||||
|
||||
## 5. 这篇文章的真实意图:不只是技术分析,也是政策倡议
|
||||
|
||||
文章最后提出,如果可以有效放慢 frontier AI 发展,让社会制度和 alignment research 跟上,Anthropic 认为这大概率是好事。但他们也承认,单个公司单方面暂停意义有限,因为这可能只是让更不谨慎的竞争者追上甚至领先。([Anthropic][1])
|
||||
|
||||
所以他们主张的是:
|
||||
|
||||
> 多个国家、多个 frontier lab 之间,有可验证的协调减速或暂停机制。
|
||||
|
||||
但这非常难,因为 AI 训练不像导弹发射井那样容易监控。训练 run 可以隐藏,算力和数据又是通用资源,而且偷偷违反暂停协议的激励非常强。Anthropic 也承认,这类机制需要定义触发条件、解除条件、裁决机构和验证方式。([Anthropic][1])
|
||||
|
||||
Reuters 对这篇文章的报道也抓住了这个重点:Anthropic 正在呼吁 frontier AI 开发者建立协调、可验证的机制,在风险上升时能够放慢或暂停先进 AI 研发。([Reuters][2])
|
||||
|
||||
这说明这篇文章不只是“技术博客”,更像是一份政策信号:
|
||||
|
||||
**Anthropic 想把 recursive self-improvement 变成一个政府、企业、公众都必须讨论的治理问题。**
|
||||
|
||||
---
|
||||
|
||||
## 6. 我对这篇文章的判断:有价值,但要带着怀疑读
|
||||
|
||||
我认为这篇文章有几个非常有价值的地方。
|
||||
|
||||
第一,它给了外界一些 frontier lab 内部数据。比如 >80% 生产代码由 Claude 编写、工程师代码产出大幅提升、AI agent 在内部研究任务中的表现等。这些信息比普通 benchmark 更接近真实 AI 研发流程。([Anthropic][1])
|
||||
|
||||
第二,它准确指出了从“AI 会写代码”到“AI 会研发 AI”之间的连续谱。很多人讨论 AI 时太二元化:要么 AGI,要么没用。但现实更可能是逐步过渡:先写函数,再修 bug,再跑实验,再做局部研究判断,最后才可能做整体研究方向选择。
|
||||
|
||||
第三,它把瓶颈分析讲得很清楚。AI 加速一个环节后,瓶颈会转移。未来组织效率取决于能否不断发现和解除新瓶颈,而不是单纯买更强模型。
|
||||
|
||||
但这篇文章也有明显局限。
|
||||
|
||||
### 局限一:数据来自 Anthropic 自己,存在选择性展示风险
|
||||
|
||||
这些内部数据很有价值,但也无法完全独立验证。Anthropic 是模型开发者,也是文章受益方。它一方面展示 Claude 很强,另一方面呼吁行业监管和协调减速。这可能同时是真诚安全关切,也可能带有战略叙事效果。
|
||||
|
||||
这不代表文章不可信,但读的时候要注意:**它不是中立第三方审计报告。**
|
||||
|
||||
### 局限二:代码量和 productivity uplift 容易高估
|
||||
|
||||
文章自己也承认,代码行数不是质量指标。员工主观估计“生产力 4 倍”也可能受偏差影响。Anthropic 脚注中提到,开发者对 AI productivity uplift 的估计可能被高估。([Anthropic][1])
|
||||
|
||||
工程师很容易有这种体验:AI 让你一天写出过去一周的代码,但后面 review、debug、集成、回滚、清理 technical debt 花了很多时间。真正生产力要看端到端 cycle time 和长期维护成本。
|
||||
|
||||
### 局限三:从“执行能力强”推到“研究品味强”还差一步
|
||||
|
||||
文章最核心的 leap 是:AI 已经能自动化大量实验执行,所以可能进一步获得 research taste。
|
||||
|
||||
这不是不可能,但还没有被证明。研究判断包括:
|
||||
|
||||
* 识别真正重要的问题;
|
||||
* 避免 benchmark gaming;
|
||||
* 判断结果是否有外推价值;
|
||||
* 在不确定性下选择方向;
|
||||
* 理解哪些问题暂时不值得做;
|
||||
* 建立新范式,而不是局部优化旧范式。
|
||||
|
||||
这些能力比“跑更多实验”更抽象。Anthropic 的证据显示 AI 在局部判断上进步很快,但还不能证明完整科研领导能力已经到来。
|
||||
|
||||
### 局限四:完整 recursive self-improvement 需要的不只是模型聪明
|
||||
|
||||
要实现真正闭环,还需要:
|
||||
|
||||
* 自动化训练基础设施;
|
||||
* 高质量数据与评估;
|
||||
* 安全的实验隔离环境;
|
||||
* 自动化 interpretability / alignment 检查;
|
||||
* 可靠的长期规划;
|
||||
* 成本可控的算力;
|
||||
* 防止模型 reward hacking 或自欺式优化;
|
||||
* 人类无法实时理解时的验证体系。
|
||||
|
||||
所以我会把“完整 RSI”看成一个严肃风险场景,而不是已经发生的事实。
|
||||
|
||||
---
|
||||
|
||||
## 7. 对软件工程和 DevOps 的现实影响
|
||||
|
||||
从你的背景看,这篇文章对工程组织的含义很直接。
|
||||
|
||||
未来软件团队可能从:
|
||||
|
||||
> PM / Tech Lead 定需求 → Engineer 写代码 → Reviewer review → CI/CD → 上线
|
||||
|
||||
变成:
|
||||
|
||||
> 人类定义目标和约束 → 多个 agent 生成实现方案 → agent 自测/修复/重构 → AI reviewer + 人类抽检 → 自动部署与监控 → agent 处理回归和 incident
|
||||
|
||||
工程师价值会更偏向:
|
||||
|
||||
* 系统设计;
|
||||
* 需求澄清;
|
||||
* 约束定义;
|
||||
* 代码审查策略;
|
||||
* 测试与验证体系;
|
||||
* 安全边界;
|
||||
* observability;
|
||||
* 生产事故判断;
|
||||
* agent workflow 设计;
|
||||
* 对 AI 输出做有效验收。
|
||||
|
||||
换句话说,**写代码本身的价值下降,但定义正确问题、搭建正确反馈系统、判断 AI 输出是否可信的价值上升。**
|
||||
|
||||
对 Staff Engineer 来说,这反而是机会。因为 Staff 的核心本来就不是“比别人多写代码”,而是把复杂系统拆解、设定技术方向、减少组织摩擦、提升整体交付质量。AI 会放大这种杠杆。
|
||||
|
||||
---
|
||||
|
||||
## 8. 对投资和产业的影响
|
||||
|
||||
这篇文章如果方向正确,会强化几个长期趋势。
|
||||
|
||||
第一,**算力、电力、数据中心、先进封装、网络互连会持续成为战略资源。** 如果 AI 研发速度越来越受 compute 约束,那么 NVIDIA、AMD、Broadcom、Marvell、台积电、先进封装、光通信、数据中心电力基础设施都会继续处在核心位置。
|
||||
|
||||
第二,**软件公司的规模经济可能变化。** 如果 100 人团队能做过去 1000 人甚至 10000 人团队的事,那么 SaaS 公司的成本结构、竞争壁垒、产品迭代速度都会改变。大公司未必天然占优,小团队也可能因为 agent 杠杆变强。
|
||||
|
||||
第三,**网络安全会进入“发现漏洞很便宜,修复漏洞很贵”的时代。** Anthropic 提到 Project Glasswing 中 Mythos Preview 在早期发现了大量高危和关键漏洞,并指出瓶颈可能从发现漏洞转向快速修补。([Anthropic][1])
|
||||
|
||||
第四,**AI governance 可能从软伦理变成硬约束。** 如果 frontier lab 真的接近 AI 自我改进,政府对算力、模型训练、数据中心、电力、出口管制、安全评估的监管会更强。
|
||||
|
||||
---
|
||||
|
||||
## 9. 我的总结判断
|
||||
|
||||
我会把这篇文章概括成一句话:
|
||||
|
||||
**Anthropic 在告诉世界:AI 正在进入 AI 研发流程本身,虽然还没有完整自我改进,但已经足以改变工程组织、科研速度和 AI 治理问题;如果继续发展,社会需要提前准备可验证的减速/暂停机制。**
|
||||
|
||||
我的可信度判断:
|
||||
|
||||
* **AI 显著提升软件工程和研究执行效率:可信度高。**
|
||||
* **AI 正在让 frontier lab 内部研发速度复合加速:可信度中高。**
|
||||
* **AI 很快能完整自主设计下一代 frontier model:可信度中等,仍有关键不确定性。**
|
||||
* **完整 recursive self-improvement 会带来严肃安全和治理风险:可信度中高,值得提前准备。**
|
||||
* **Anthropic 的所有量化数据都能按字面理解:可信度中等,需要第三方验证。**
|
||||
|
||||
最重要的不是“AI 明年是否突然失控”,而是这个趋势已经足够明显:**人类正在从执行者变成监督者,而监督体系本身还没有准备好。**
|
||||
|
||||
[1]: https://www.anthropic.com/institute/recursive-self-improvement "When AI builds itself \ Anthropic"
|
||||
[2]: https://www.reuters.com/business/anthropic-says-ai-labs-need-coordinated-plan-halt-development-if-risks-rise-2026-06-04/?utm_source=chatgpt.com "Anthropic says AI labs need coordinated plan to halt development if risks rise"
|
||||
Reference in New Issue
Block a user