每周文摘 032126
又是一周了,今天(周六)看着天气不错,要出去走走,还有就是做完该做的,比如写这个文章和加油,以及考虑骑车。
本周观影
- 还没看完《哈姆奈特 Hamnet (2025)》
本周阅读
- 《House of Huawei: The Secret History of China's Most Powerful Company》:这周没读,在 Boox 上。
- 《安东尼·波顿的成功投资》:重新在 Kindle 上读。
本周播客
记了点如下的笔记:
- TPU 对于 HBM 的需求,以芯片的生产,但 HBM capacity 被 Nvidia 垄断了。
- TPU 需要不断定制化,基于大模型训练方法,如果范式调整,对于 TPU 是有影响的,但核心都是解决矩阵计算,但方向是更加通用,同时也有稀疏矩阵计算这样的专用单元。 软件层,XLA 和 CUDA 比较,Anthropic 可以对于 TPU 整个软硬件生态的使用,因为团队从 Google 出来非常熟悉 TPU 的软硬件生态,Meta 用 PyTorch 生态 TPU 支持方面就差一些了,XLA 在支持 PyTorch 方面做了很多不少支持。
- TPU 推理成本比 GPU 高,Nvidia 搭建数据中心主要成本是交换机(NVLink 和 NVSwitch),液冷/Surgres? (芯片和芯片之间的通讯)。
- Google 和 Broadcom/Marvel 合作;Broadcom 主要做 Inter-Chip Interconnect (ICI),技术壁垒非常高。
- TPU 挑战 GPU 限定条件是大规模部署,必须有非常大的用户在用,不适合本地部署,云上部署,成本分摊给用户;TPU 推理延迟还是做的不错的。
搜索 TPU deep dive,发现了这篇 TPU Deep Dive还有之前收藏的这篇 Touching the Elephant - TPUs,我觉得听完这个播客和读完这些文章,加上自己的理解可以写篇 TPU 方面的文章;17 号上午花时间看了这两篇文章,信息很密集,我也没相关背景,看着非常吃力,继续努力。
No.192 🇮🇷 伊朗往事:苹果树下的表演性承诺,与石油帝国的通胀迷航
还在听,刘飞和潇磊总是讲的那么好。
https://x.com/lifesinger/status/2032696862566969574 by Frank 玉伯
说的是上面这期播客,还在听中。
非常推荐这期播客。印象很深的一个收获:
生产力的提升,不解决工作繁忙和焦虑等问题。比如 AI 提升生产力后,人只会越来越忙。因为有了更好的工具后,能做的事情会更多。老板的欲望是无止境的,因此工具生产力的提升,只会让工作越来越多,让做工作的工人越来越累。
真正能让从业者不繁忙、轻松下来的方式,不是提升生产力,最关键的是改变生产关系。比如 8 小时工作制,靠的是工会抵制、大众觉醒等生产关系的运动促成。资本家恨不得是 16 小时工作制,但出现抵制运动后,为了长期利益,不得不开始提倡 8 小时工作制。
生产力和生产关系,各有其用。对资本家来说,会各种鼓吹生产力会带来美好社会。对工薪阶层来说,千万要小心资本家的倡导。因为生产力的提升,永远带不来身心解放。只有生产关系的提升,才能真正通往工薪阶层的美好世界。
问题来了:很多工薪阶层,比如我,也会变成老板,变成资本家,会天天想着生产力。
不忘初心的真正含义是:不要忘记自己是打工者,是 nobody。当自己成为 somebody 时,还能心心念念为 nobody 谋福利,那就是革命家。
细问内心,方得知:我不想成为创业者,我想成革命家。在这个层面上,我比马斯克还富有。
本周胡思乱想
- (某天早上)一早起来就看刷了 telegram/x/feedly,快速浏览了想看的,选定了还需要耐心读的,这种感觉很喜欢。
- 请团队的人吃了个中饭,花点钱和大家简单交流下,也不错,不过君子小人要分清。
- (和某人聊天的一个想法)无论如何,努力总归要的,我现在也有点躺平了,但是有机会我肯定还是想再折腾折腾。
- 未来企业内部组织架构怎么调或重塑 是个大课题,人的 skills 需要重新考虑定位;企业还是遗留问题太多,而且要考虑人的就业和各方面公司平衡,船小了好掉头,大了改革是很难的。
本周文章
写在世界口腔健康日:正确的刷牙方法以及刷牙的 10 个迷思 - 少数派 好好看看,包括里面提到的 App 和视频,每天好好用好早晚的 2 个 2 分钟,可以解决大问题。
Harness Engineering — Agent 不好用,也许不是模型的问题 这篇解惑 harness engineering,这个定义其实也没事实标准,还是各自定义啥就是啥,不过这文章写的挺好,还得仔细看,解释了我过去很多不明白的内容,而且提到了一些其他相关的引用,好好读读再输出一些我个人的认知;
- (The Anatomy of an Agent Harness)[https://www.vtrivedy.com/posts/the-anatomy-of-an-agent-harness]
- (My AI Adoption Journey)[https://mitchellh.com/writing/my-ai-adoption-journey] 这篇之前我也看过,那时候没啥体会
Java 26 is boring, and that’s a good thing
Java 26 虽然常见的都是 AI/LLM 相关的话题,但是 Java 26 在企业应用开发还是最能打的,这里说的 boring 不是差而是说的是常青树/老登,关心的人少了,但是 Java 还是继续在演进,虽然不是革命性(也不会革命性的,企业要的是稳定可以预测)。
我是希望我自己能更早的开始写作了,即使写的没有章法和思路,也比什么都不写和不思考好,写作不是让人读,更多是给自己自己的一种锻炼和存档,无论是思维还是生活的痕迹,有人看固然是好事,但是大部分时候注定会是默默无闻但自己内心感觉满足。
看到几个人提了这个文章,下面这段写的很好,能做出对得起自己选择的,前提是自己要有足够的判断力,不然也只是个“错判”。
这件轶事最让我感慨的地方在于:我们这些身处其中的人,其实一直都被未来的迷雾包围着。所谓“看对了方向”或者“看错了方向”,很多时候并不足以决定你最后会走到哪里。你也许看见了未来,却没有资源;你也许拥有资源,却走向了别的方向;你也许参与了最关键的基础工作,却仍然不知道它会在几年后如何改变世界。
未来并不是线性展开的。
所以,焦虑并不能真正帮助我们接近未来。更重要的是,在你当下所能看到的边界之内,做一个对得起自己的选择;至于剩下的部分,就交给时间。
一个非常棒的交互式 MicroGPT 演示
https://growingswe.com/blog/microgpt
这个是基于 Andrej Karpathy 用大约 200 行 Python 代码实现的 GPT,并以可视化的方式解释了语言模型的工作原理的学习网站,值得看看。
了解类 Claude Code 的原理的学习
https://learn.shareai.run/en/
会一步步引导你从零开始构建一个极简的类似 Claude Code 的 Agent,并详细解释每个机制,值得一看。
评论已关闭