Bayt 经典文章专栏

Mason

本专栏精选海外优质博客、文章,并生成音频。

  1. Jun 19

    走进 Anthropic CEO 达里奥·阿莫代的思想世界

    这档彭博社(Bloomberg Originals)的独家专访视频《Inside the Mind of Anthropic CEO Dario Amodei》深入探讨了人工智能公司 Anthropic 首席执行官 Dario Amodei 对 AI 飞速发展的看法、行业竞争内幕以及未来的生存风险。 以下是该视频的核心内容总结: 面对 AI 指数级增长的理智:Dario 将身处 AI 行业比作坐在一艘以相对论速度加速驶离地球的宇宙飞船上,每天醒来世界都已发生巨变。但他强调,面对这种前所未有的高压环境,决策者必须像外科医生或军事指挥官一样保持绝对的冷静与理智,而不是在“盲目恐慌”和“沾沾自喜”之间来回摇摆 [00:26]。 揭秘离开 OpenAI 的真正原因:关于当年为何离开 OpenAI,Dario 坦言不仅仅是因为在 AI 安全问题上存在分歧。更深层的原因是信任破裂,他看到了令人不安的“不诚实”行为模式和价值观背离。因此,他选择与志同道合的人分道扬镳,以自己认为负责任的方式来发展和部署 AI 技术 [06:03]。 坚持企业级商业模式:与专注于社交媒体和消费者成瘾模式的科技公司不同,Anthropic 选择重注企业级应用。Dario 认为,将 AI 用于医疗治愈、生物科技研发、能源优化和教育领域,不仅能产生巨大的正向价值,且与 Anthropic 追求安全和长远利益的价值观高度契合 [11:50]。 AI 对软件行业与白领就业的冲击:Dario 预测,传统的软件护城河(如编写复杂代码的能力)将迅速消失,AI 极有可能会在未来几年内对入门级白领工作造成严重冲击。但他同时也指出,拥有独特领域知识和客户关系的公司将更具优势。尽管短期内会有巨大的就业颠覆,但他相信整体经济的“蛋糕”最终会被做大 [15:07]。 与美国军方合作及安全“红线”:尽管 Dario 个人长期抱有反战立场,但 Anthropic 依然选择与美国国防部合作。他表示,这是为了防止威权国家(如俄罗斯)在 AI 领域占据主导地位。但 Anthropic 对此设定了极其严格的红线:绝不参与大规模监控,绝不开发全自动致命武器。他强调,在军事打击中必须始终由人类来做出最终决定 [37:16]。 被称为“超级武器”的 Mythos 模型:Anthropic 研发了一款名为“Mythos”的强大模型,它在发现和利用软件级漏洞方面表现出了惊人的能力。早期测试公司甚至建议必须拥有“枪支许可证”才能使用它。为了防止其沦为黑客的攻击工具,Anthropic 牺牲了巨大的商业利益,拒绝将其公开发布,而是先交由网络防御者来修补全球系统的漏洞 [48:36]。 人类文明崩溃的风险与乐观展望:Dario 曾表示 AI 导致人类文明崩溃的概率在 10% 到 25% 之间,他在此次访谈中重申了这一担忧,并表示这个概率仍然太高。Anthropic 的核心使命就是尽最大努力降低这一风险 [01:05:51]。不过,他同时也非常乐观地预测,如果人类能成功掌控 AI 并平稳度过这个阶段,AI 将为人类带来长达一个世纪的医疗和科学突破,极大地改善人类的生存体验 [25:37]。 相关视频链接:https://www.youtube.com/watch?v=x2VHFgyawPE 前往小宇宙评论区与主播互动

  2. Jun 6

    中国 AI 大厂访问记

    今年5月上旬,一个美国访问团来到中国,访问了14家 AI 和机器人公司。 访问对象包括 DeepSeek、月之暗面、MiniMax、智谱、字节跳动、阿里、蚂蚁、小米、零一万物、宇树、魔搭社区等。 所有成员都是科技分析师,回到美国后,每个人都写了访问观感:Kevin Xu、afra Wang、Florian Brand、Nathan Lambert、 Azeem Azhar、Lily Ottinger and Kai Williams、Jasmine Sun、Lingua Sinica、Caithrin。 这些文章有很多有意思的内容,阮一峰的网络周刊做了一些摘录。 1、算力的差距我们在每一家公司都听到一个共同的抱怨:算力不足。这使得实验次数减少,模型规模缩小。 中国的算力不足,主要是美国的芯片出口管制政策造成的。我们感兴趣的是亲眼目睹本土公司如何应对。 虽然供应并非完全短缺,中国公司仍然能够拿到英伟达的 H100、B200 和 B300 显卡,但是数量至少比美国竞争对手少一个数量级。 英伟达最新款的 GB300 NVL72 系统(72颗英伟达最新 GPU 组成一个系统)的实时推理速度比三年前的 H100 集群快30倍,每颗芯片的内存容量高出3.6倍,每次推理的能耗降低了25倍。美国公司正在大量订购这些系统,而中国公司却无法做到。 中国科技公司,尤其是华为,在研发 AI 芯片方面取得了长足进步。但即使是华为今年3月发布的最新芯片 Ascend 950PR,其性能也仅与2022年发布的 H100 大致相当。而且,这些芯片的出货量远低于 H100。据估计,英伟达仅在2025年10月之前就已出货了700万颗 Hopper 和 Blackwell GPU,而且出货速度还在不断增长。华为计划今年出货75万颗 Ascend 950PR 芯片,这仍然只有英伟达去年出货量的十分之一左右。 结果就是,美国在算力方面拥有巨大的领先优势。我们估计,2025年底美国 AI 行业的算力大约是中国的8倍。中国 AI 公司目前总的算力,大致相当于美国2023年的规模。 我们向中国研究人员分享了 OpenAI 内部每位研究人员拥有的 GPU 数量。他们听到这个数字时,简直惊呆了。然而,我们都知道,OpenAI 的研究人员,或者说西方所有 AI 公司的研究人员,仍然会抱怨他们的算力太少。 2、算力的分配美国的大部分算力都用于模型训练,而非服务客户。但是,中国的情况不同,算力既要用来训练模型,又要服务于数亿消费者和快速增长的企业用户。 如果拿出一半的算力用于服务客户,那么可用于模型训练的算力就会减少。 还有另一个需要考虑的因素。美国的算力主要由五家公司主导:OpenAI、Anthropic、Google、Meta 和 xAI。而在中国,各大科技公司都在积极研发自己的前沿模型,算力池被进一步分割。 3、计算效率如果按照这种逻辑,既然中国的算力规模比美国落少两年,那么中国模型也应该至少比美国落后两年。但是,情况并非如此。 许多分析都认为,中国模型只比美国模型落后几个月。事实上,在某些方面,两国模型似乎是并驾齐驱的。 原因是芯片管制反而促使中国公司提高计算效率。我们发现,中国公司的单位算力支持的 AI 智能是简单扩展下的 4-7 倍,这弥补了算力的不足。 4、开源的分歧目前,最好的 AI 开源模型是中国公司发布的。但是,对于是否开源自己的模型,中国公司内部有分歧。 公司的财务状况和收入压力,会影响到开源意愿。目前,对于是否开源,有一条界限正变得越来越清晰:模型参数规模达到一万亿。 一些公司认为,开源一万亿或以上参数的模型是一种资源浪费,因为没人能在本地机器上运行如此庞大的模型,而开源模型的典型应用场景正是本地机器。发布一万亿参数模型的更好方式是将其托管在公司自身的云基础设施上,只发布它的 API,方便用户使用。 但是对于另一些公司,开源模型近乎一种信仰,而构建万亿参数级别的模型则是开源事业的入场券。 5、西方化还是中国化有些中国 AI 公司呈现出典型的"西方"风格,处处洋溢着硅谷式的酷炫氛围,甚至连赠送的周边产品都体现了这一点。 另一些公司变得越来越"中国化",把打造一个光鲜亮丽的展厅视为头等大事。这些展厅用来接待参观者,通常是国有企业 CEO 和地方干部。参观之后,还会举行晚宴招待。 我认为,这既是一种选择,也是一种无奈之举,源于创始人的背景以及公司选择的业务类型。 6、对其他公司的看法我们发现,所有中国 AI 公司都敬畏字节跳动的 Seed 部门。那是中国唯一的闭源 AI 前沿团队。它就像房间里的大象,却在翩翩起舞。它的豆包几乎垄断了 AI 的用户流量,他们的模型都可以快速推广到海量用户,其他公司无法匹敌这一点。 DeepSeek 则是业内最受尊敬的公司,越来越多地承担基础层的工作:架构、效率、推理优化,以及华为协议栈适配。 7、实习生中国 AI 公司的员工,很多是才华横溢的"实习生",平均年龄二十五六岁,大多数仍然是博士生,能够用英语轻松交流技术话题。他们大多毕业于中国高校,没有海外留学经历。 他们实习期一年到两年,享有全职员工的待遇和完整权限,可以自由地提出想法和开展工作实验。这跟西方顶尖 AI 公司形成鲜明对比,OpenAI、Anthropic、Cursor 等公司根本不提供实习,其他公司(比如谷歌)名义上提供 Gemini 的实习,但不会提供重要的任务。 中国公司更看重"新鲜人",他们能够带来新想法和充足的脑力。为了改进最终模型,实习生更愿意做一些不那么引人注目的工作。而且,刚接触 AI 开发的人可以免受以前模式的影响。 从中国大学的角度来看,学校的计算资源根本不足以让优秀学生的才华得到充分发挥,不如把他们派往计算资源更丰富的业界公司,双方合作发表论文,实现双赢。 8、对待 AI 安全问题的态度我问了一些年轻的中国研究人员,如何看待 AGI(通用人工智能),他们竟然给出了完全相同的答案:"AGI 就是人工智能可以取代我!" 我发现,他们没有流露出任何担忧,非但不害怕被取代,反而对机器是否真的能够超越其制造者充满好奇。如果真的实现了这一点,他们会欣然去做其他事情。 这跟西方同行形成了鲜明对比,他们许多人非常关注 AI 的安全问题及其社会影响。中国研究人员也重视安全,每个人都认为 AI 不应该做坏事。但如何确保这一点,大家都觉得这应该交给政府来决定,政府应该能够解决。 9、中国企业的 AI 需求中国企业是否愿意付费购买本国 AI 服务? 一种广为流传的看法是,中国 AI 市场规模较小,因为中国企业通常不愿为软件付费,因此无法支撑本国的 AI 公司。 这种看法仅适用于 SaaS 模式的软件支出,这种模式在中国历来规模很小。但是,中国显然拥有庞大的云计算市场。 中国 AI 公司正在争论,中国企业把 AI 服务,到底看成是 SaaS 产品(规模较小)还是云计算(规模较大)?目前,AI 的发展趋势似乎更倾向于云计算。 10、数据产业不如美国我们听说,像 Anthropic 或 OpenAI 这样的美国 AI 公司,每年购买训练数据(或者强化学习环境)就会投入超过1000万美元,累计投入更是高达数亿美元。我们很想知道,中国 AI 公司是否也是如此。 得到的答案是中国几乎没有数据产业,因为很多 AI 公司觉得,中国的数据产品质量较差,因此自行准备数据往往更为理想。 研究人员会花费大量时间来构建强化学习训练环境,而像字节跳动和阿里巴巴这样的大公司则拥有内部数据标注团队来支持这项工作。 11、政府的作用谁才是中国 AI 领域真正的幕后推动者?相当于硅谷的红杉资本和 a16。 我的一个朋友的答案是:上海、北京和杭州的市政府。这些勤奋却又精疲力竭的政府官员,完全被"害怕错过"和竞争焦虑所驱使,正在拼命推动本地 AI 产业。 信息来源:https://www.ruanyifeng.com/blog/2026/06/weekly-issue-399.html 版权声明:自由转载-非商用-非衍生-保持署名(创意共享3.0许可证) 前往小宇宙评论区与主播互动

    中国 AI 大厂访问记
  3. Jan 6

    我如何重启社交生活

    在物质条件舒适、生活高度便利的现代环境中,一个人如何在不知不觉中失去“社区”,并最终意识到社区对心理健康与生活质量的重要性,以及如何主动重建它。 一、问题的出现:过度舒适导致的“社会性崩塌”作者几年前发现,自己虽然生活条件优渥—— 远程工作 网购、外卖解决一切生活需求 没有孩子、没有必须的外出理由 住在舒适、令人满足的家中但却几乎没有任何理由离开家,更严重的是,现实中的社交生活几乎停滞。 疫情、年龄增长(朋友有了孩子)、以及“待在家太舒服了”,共同导致了作者与他人的现实连接不断萎缩。表面上这是“理想生活”,但心理上却逐渐变得压抑、孤立,甚至接近“发疯”。 作者逐渐意识到: 自己并不是缺朋友,而是缺少一个社区(community)。二、对“社区”的矛盾态度:警惕,但又无法回避作者长期对“社区”持怀疑态度: 强社区往往形成“规范的牢笼”(cage of norms) 小社区容易产生道德监控与同侪压力 为了维持群体身份,人们可能压制真实想法 社区容易牺牲“求真”以换取“归属感”作者以政治、意识形态、网络社群和自己曾参与的“怀疑论者社群”为例,说明即便以理性和反教条为核心的社区,也不可避免地产生新的教条和排他性。 因此,作者一直自认为是独立思考者,更倾向于原子化、自由的城市生活。 但当现实社交几乎崩塌时,他发现: 即便你警惕社区,它依然在心理层面不可或缺。 三、重新理解社区的价值作者并没有重复“社区很重要”的老生常谈,而是强调一个非常具体、个人化的价值: 社区能自动创造一个“不用刻意约”的朋友网络。过去在社区中,只要去某个固定活动,就能自然遇到熟人和新朋友;而当社区解体后,相当于一次性失去了整张关系网络。 这也是现代城市中孤独感的一个核心来源: 没有默认的、低成本的、可重复的线下社交场景。 四、解决方案:自己动手,重建社区作者在 36 岁前夕,做了一件看似微小却意义重大的事: 主动组织生日聚会。 尽管内心焦虑、担心没人来,但结果出乎意料地好。这给了作者一个重要启示: 如果你没有社区,你可以自己建一个。他随后总结了社区的三个关键要素: 共同点或松散的连接(人本身即可) 一个可以轻松、非正式互动的场所 能持续吸纳新成员、防止自然流失的机制于是他开始: 每月固定组织一次聚会 建立邮件列表 持续邀请新认识的人加入 不设强主题、不强求出席本质上,是用极低组织成本解决社交的协调问题与关系衰减问题。 五、结果:心理状态与生活质量的明显改善两年后,这套“每月聚会”的机制带来了显著变化: 稳定的线下社交节律 更强的连接感与安全感 社交关系产生溢出效应(更多私下见面) 明显改善了心理状态与孤独感作者重新拥有了一个“人群”,而不只是零散的朋友。 六、作者给读者的核心建议文章最终给出一个极其朴素、但极少有人真正去做的建议: Just invite people to stuff.(就是邀请别人出来。)不要等完美时机、不要过度设计、不要等别人来组织。只要你开始,社区就可能自然生长。 如果你找不到社区,那你可以亲手建立一个。 本文翻译自:takes.jamesomalley.co.uk 前往小宇宙评论区与主播互动

  4. 12/24/2025

    Marc Andreessen 的职业规划指南:机遇

    这篇文章源自马克·安德森(Marc Andreessen)的经典博客存档,标题为《Pmarca 职业规划指南:第一部分:机会》(Pmarca Guide to Career Planning: Opportunity)。以下是对作者的介绍及本文的核心内容总结: 1. 作者介绍:马克·安德森 (Marc Andreessen)马克·安德森是硅谷最具影响力的领袖之一。 技术先驱:他是第一个被广泛使用的网络浏览器 Mosaic 的共同开发者,也是 网景(Netscape) 公司的创始人,直接推动了互联网的普及。 顶级风投:他是硅谷著名风险投资机构 Andreessen Horowitz (a16z) 的共同创始人,曾投资过 Facebook、Twitter、Airbnb、GitHub 等众多科技巨头。 思想领袖:他以“软件正在吞噬世界”等深刻见解著称。这篇文章最初发表于他 2007 年的个人博客(blog.pmarca.com),虽博客现已停更,但其内容仍被视为职业规划和商业思考的圣经。2. 文章内容总结本文的核心观点是:职业规划是一个伪命题,真正的成功来自于对“机会”的把握。 主要内容可归纳为以下几点: A. 职业规划的两大规则 规则一:不要做职业规划。世界太复杂且变化太快,你无法预知未来的行业、公司或角色。过度规划会让你变得盲目,从而错失生命中真正重要的机会。 规则二:专注于技能提升和机会追求。与其设定死板的五年计划,不如让自己保持灵活性,随时准备捕捉机遇。B. 理解“机会”安德森将机会分为两类: 不期而遇的机会:由于你处在正确的时间和地点,机会突然降临(如前上司的跳槽邀请或朋友的创业点子)。这类机会稍纵即逝,平庸与卓越的分水岭就在于是否敢于“纵身一跃”。 主动创造的机会:通过你的能量、激情和行动,迫使世界围绕你重新配置,从而创造出机会。C. “职业投资组合”理论他建议像金融专家管理资产一样管理职业: 风险与回报:每一份工作、每一个角色都是投资组合中的一项。不要孤立地看单次机会的风险,而要将其放在你未来 50 年的职业生涯背景下评估。 生命周期的风险偏好:年轻时:应最大化技能提升和经验获取,敢于承担薪水风险。有家庭后:可以适当降低风险,追求稳定。转型期:跨领域跳槽或跨城市搬迁虽然有风险,但为了长期的职业幸福和天花板,这种风险通常是值得的。D. 风险的必要性 没有风险就没有机会。许多人因为害怕潜在的失败(如创业失败、被解雇)而错失了足以改变命运的机会。 机会成本:做一件事意味着不能做其他事。安德森强调要始终关注机会成本,有时留在看似稳定的“大公司”其实是风险最高的事情,因为这可能导致技能停滞。E. 核心结论当机会出现时,特别是当大公司或大思想家向你伸出橄榄枝时,推掉手头所有的事去抓住它。机会远比你想象的要稀缺,一旦窗口开启,必须果断行动。 前往小宇宙评论区与主播互动

  5. 11/17/2025

    Andrej Karpathy:AI会取代哪些工作?

    Andrej Karpathy 是一位著名的人工智能研究员和工程师,以其在深度学习、计算机视觉和人工智能教育领域的贡献而闻名。他曾是 OpenAI 的早期成员之一,后加入特斯拉(Tesla)担任人工智能与自动驾驶视觉团队的负责人,领导 Autopilot 的神经网络开发。Karpathy 拥有斯坦福大学计算机科学博士学位,师从深度学习先驱 Fei-Fei Li(李飞飞),研究方向包括卷积神经网络和图像识别。他还以通俗易懂的 AI 教育文章与课程(如“CS231n: Convolutional Neural Networks for Visual Recognition”)著称,对推动深度学习的普及与实践产生了深远影响。 🧠 核心类比:AI = 新的计算范式(Software 2.0) 作者认为,将 AI 类比为 新的计算范式(Software 2.0)比类比为“电力”或“工业革命”更贴切。因为两者本质上都是关于 数字信息处理的自动化。 🧩 历史回顾:Software 1.0 的自动化逻辑如果回到上世纪 1980 年代,预测计算机对就业的影响,最关键的变量是: 任务的算法是否固定。也就是说: 能否用明确、可写成程序的规则描述工作。 若可以(如打字、记账、人肉计算等),那么计算机很容易替代。Software 1.0 → 自动化的是可“指定”的东西。 ⚙️ 软件进化:Software 2.0 的核心特征AI 的新范式是:我们不再手写程序逻辑,而是 通过优化目标(objective)来搜索程序空间,利用梯度下降找到表现良好的神经网络。 因此,在这个阶段中,影响自动化可能性的关键不再是“能否指定规则”,而是: 能否验证(verify)结果。✅ 可验证性:自动化潜力的核心指标AI 能够高效自动化的任务,是那些可以被反复练习和评估的: 环境可重置(可多次尝试) 反馈高效(训练能快速进行) 奖励明确(系统能自动打分)例子: 数学、编程、逻辑推理、视频识别、游戏决策等→ 都能定义明确的对错与奖励机制,因此 AI 进步迅速。 创意写作、战略规划、社会常识整合→ 难以验证,AI 的表现依然不稳定。Software 2.0 → 自动化的是可“验证”的东西。 🔀 前沿现象:AI 进展的“锯齿边界”AI 发展的不平衡性来自: 可验证任务进步飞快(甚至超越专家水平); 不可验证任务停滞较多(依赖模仿或通用化的“魔法”)。这解释了为何 LLM 在编程、推理类任务中表现卓越,而在创意与现实世界常识任务上仍显不足。 前往小宇宙评论区与主播互动

  6. 11/14/2025

    真的存在“好品味”吗?

    Paul Graham 被誉为“硅谷创业精神的思想导师”,其文字影响了一整代创业者与程序员。 他是一位英国出生的计算机科学家、企业家、散文家,也是著名创业孵化器 Y Combinator(YC) 的联合创始人之一。早期研究 Lisp 语言,并开发了知名方言 Viaweb(后被 Yahoo 收购,成为 Yahoo Store),是最早的网页应用之一。作为 YC 的核心人物,他资助并指导了包括 Airbnb、Dropbox、Stripe 在内的数百家初创公司。他也是名作《黑客与画家》的作者。 主旨 Paul 提出:“良好品味”(good taste)确实存在,而不仅仅是每个人主观喜欢不同东西。 若否定“良好品味”的存在,则会产生荒谬的结论:例如就无法谈“好艺术”(good art)或“艺术家做得好”了。关键论点1. 定义“品味” & “良好品味” 作者将“品味”分为狭义(美学判断)与广义(偏好)两种。  在狭义意义上:若你喜欢的艺术作品比我喜欢的那更好,那么你就在“品味”上比我好。 2. 若“良好品味”不存在 → 否定“好艺术” 作者用反证法指出:如果认为不存在良好品味,就得否定“好艺术”这一概念。  而若“好艺术”都不存在,那么也就谈不上“艺术家做得好或坏”了。  作者个人经验:他曾学画画,明显感受到自己与大师(如 Leonardo da Vinci、 Bellini)之间的差距。正是这种差距在他心里证实了“好艺术”“好做法”“好品味”的存在。 3. 为什么人们会怀疑“良好品味”存在?作者列出两大原因: 一、大量分歧:人们在艺术的反应上存在极大差异。很多时候,观众的反应受“艺术家是否出名”“作品在博物馆里”“是否为某书中出现”等外部因素影响,而非纯粹作品本身。  二、艺术价值似乎“在头脑里”而非“在作品中”:如果艺术作品真的“好”,这好像并不是完全在作品内部,而似乎在不同观者的头脑中。作者认为,关键在于:作品对人(观者)能够产生类似的反应,那么这种“好”就可以视为作品的一个属性。 4. 艺术作品“好坏”并非完全主观或完全客观 作者指出:人们对艺术的反应并非完全随机。既非纯主观,也不是像物理粒子那样完全客观。两个作品如果以类似方式作用于大多数具备深度艺术见解的观者,那么我们可以说其中一个“更好”。  因此,虽然品味不能达到“完美”(即所有人一致判断),但**“良好品味”**(good taste)是可能存在的。即:存在部分排序(partial order)。你可能在品味上优于某人,但未必优于所有人。 结论 良好品味存在——我们可以判断艺术作品、行为、设计等的“优劣”。 但判断并非简单地“谁最好”,而是“谁相对好”——在较多有经验的评价者面前,对作品的反应趋于一致时,我们可以更有信心地说:这是“好”。 这种好并非绝对,也非机械,但足以让“品味”这一概念有意义。原文地址:https://www.paulgraham.com/goodtaste.html 前往小宇宙评论区与主播互动

About

本专栏精选海外优质博客、文章,并生成音频。

You Might Also Like