
Hosted by Bear Liu · ZH
《BearTalk AI 简讯》是一档自动更新的 AI 科技播客,由 AI 制作,人类把关。每期约 15 分钟。
每周固定时间,BearTalk Agent 编辑部从 25 个经过精选的信源中采集内容:包括 Anthropic、OpenAI、Google DeepMind、Meta AI 等一线实验室的官方发布,Simon Willison、Ethan Mollick 等独立研究者的深度分析,以及 Hacker News、Reddit 等社区的一线讨论。候选内容经过多轮 AI 筛选、撰写和校对,最终提炼为 5 个值得认真对待的话题。
这档节目不追热点,不堆资讯。它只做一件事:在 AI 领域每天产出的海量内容里,找出真正影响你工作方式和思维方式的那几个信号。
音频由 Bear 的克隆音色朗读,每期约 15 分钟,适合通勤或晨间收听。
---
BearTalk AI Daily Notes is an AI and technology podcast, published every day. It is produced by the BearTalk Agent team and overseen by Bear Liu.
Each morning, the system collects content from 25 curated sources: official releases from leading labs including Anthropic, OpenAI, Google DeepMind and Meta
AI; in-depth analysis from independent researchers like Simon Willison and Ethan Mollick; and first-hand community discussion from Hacker News and Reddit.
The candidates go through multiple rounds of AI selection, writing and review, and are distilled into five topics worth your attention.
This show does not chase headlines or pile up information. It does one thing: find the signals that actually matter to how you work and think, from the flood of AI content published every day.
Each episode runs around 15 minutes, narrated in Bear's cloned voice. Good for commutes and morning routines.

本期内容今天的五个话题覆盖了 AI 基础能力的多个层次:语音交互的结构从半双工升级为全双工,机器人导航用单摄像头打破了多传感器的历史假设,Fable 写出史上最快 GPU 内核并触发了递归自我改进的讨论,Every.to 提出了一个更根本的效率框架,Slack 与 Salesforce 的深度打通则把企业 AI 整合推到了临界点。对设计师和产品人来说,今天的收获不只是新工具,而是一套重新评估自己工作流和产品设计优先级的思考框架。本期要点- GPT-Live 实现真正全双工语音对话,AI 终于能在对话节奏层面对齐人类,无屏语音体验的设计需求从概念变为现实- Mistral 发布 Robostral Navigate,单 RGB 摄像头导航成功率达 76.6%,打破了机器人必须依赖昂贵多传感器的历史假设- Anthropic 的 Fable 在三小时内写出史上最快 GPU megakernel,速度是 PyTorch 基准的 19 倍,AI 开始参与改善自身运行环境- Every.to 提出"AI 效率密度"框架,真正拉开差距的不是用 AI 做更多同样的事,而是进入原本触及不到的领域- Slack 接通 Salesforce 全平台数据,企业 AI 整合效率大幅提升,同时也把权限边界和可撤销机制推到了产品设计的核心位置参考资料Introducing GPT-Live — https://openai.com/index/introducing-gpt-live/GPT-Live System Card — https://deploymentsafety.openai.com/gpt-liveRobostral Navigate: single-camera AI navigation — https://mistral.ai(官方博客)Import AI #464: Fables writes GPU kernels — https://importai.substack.comWelcome to Efficiencymaxxing — https://every.toSlack's Slackbot can now pull your CRM data, generate charts, and send DocuSigns — https://venturebeat.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容今天五件事,围绕一个隐藏主题展开:AI 正在从被动回答问题,变成主动发现问题。Fable 写出了有史以来最快的 GPU 内核,越过了一个曾被认为是 AI 做不到的复杂度门槛。Ethan Mollick 宣告聊天框时代正在走向终结。Anthropic 的数据揭示七成 AI 用户根本不在写代码,知识工作者才是下一个主战场。AI 劳动力的真实自动化能力,第一次被严格量化出来。还有一个今天就能试的工作流技巧,帮你在开始任务之前先把思路理清楚。本期要点- Fable 在 KernelBench-Mega 排行榜上写出有史以来最快的 GPU 内核,速度接近 PyTorch 基线的二十倍,AI 自我优化基础设施的循环正在开始转动- Claude Cowork 上线手机和网页端,Anthropic 数据显示超过七成用户的会话与代码无关,知识工作者成为 AI 工具的核心用户群- 沃顿教授 Ethan Mollick 认为聊天框交互范式正在走向终结,AI 嵌入任务流程而非等待提问,才是真正的下一阶段- 远程劳动力指数首次用真实付费标准量化 AI 自动化能力,数据分析和简单网页应用通过率已超预期,高创意设计类工作仍明显低于人类水平- Every.to 分享 Fable 工作流案例:在任务开始前先让 AI 列出你没意识到的决策节点,往往比直接执行更有价值参考资料Use Fable Before You Know What to Ask — https://every.toA Significant Increase in Digital Labor Automation — https://safe.aiThe twilight of the chatbots — https://www.oneusefulthing.orgAnthropic brings Claude Cowork to mobile and web — https://venturebeat.comImport AI #464: Fables writes GPU kernels; AI automation; and analog computation — https://importai.substack.comKernelBench Mega 实时排行榜 — https://kernelbench.com/megaRedeploying Fable 5 — https://www.anthropic.com/news/redeploying-fable-5---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容这期节目从五个不同切口,切进同一个底层问题:你和 AI 的关系,是不是建立在一些你从未认真审视过的假设上。从 Sonnet 5 发布后意外平淡的市场反应,到出口管制令让 Fable 5 一夜消失三周,再到用数学证明代码正确性的 Leanstral 1.5、AI 开始在自由职业平台接真实订单的量化追踪,最后落在一个让人不安的策略框架:你的 AI 工作流,正在默默押注哪些你自己都没意识到的事。听完这期,你能带走的,是一张可以立刻动手填的清单。本期要点- Sonnet 5 定位"刚刚好",但在更激烈的竞争格局里,中间档正变成最难站稳的位置- 出口管制令六月十二日突然生效,Fable 5 被迫下线三周,深度依赖单一模型的风险第一次以政策形式落地- Leanstral 1.5 用数学证明代码在所有输入下的行为,已在真实开源项目中发现此前未知的 bug,完全开源可本地运行- Remote Labor Index 开始量化 AI agent 在自由职业市场的真实完成率,部分设计和数据类任务已达客户可接受水平- Dan Pupius 的框架把 AI 策略里的隐性赌注拆成四类:智能成本、模型自主性、平台锁定、监管环境,逐条检查才算真正想清楚参考资料Redeploying Claude Fable 5 — https://www.anthropic.com/news/redeploying-fable-5Introducing Claude Sonnet 5 — https://www.anthropic.com/news/claude-sonnet-5Leanstral 1.5: Proof Abundance for All — https://mistral.ai/news/leanstral-1-5A Significant Increase in Digital Labor Automation (Remote Labor Index) — https://www.safe.ai/blog/remote-labor-indexYour AI Strategy Is Making Bets. Do You Know Which Ones? — https://every.to/thesis/your-ai-strategy-is-making-bets-do-you-know-which-ones---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容AI 能力正在快速扩张,但工程实践、工具设计和地缘政治规则都还在慌忙跟上。这期节目从五个真实案例切入:价格压缩、出口管控、工具调用的反常 Bug、一张一百五十美元的账单,以及一个给 AI 代理配 Slack 的新产品。听完这期,你会对"能力升级不等于工程升级"这件事有更清楚的感知,也会重新检视自己的工具依赖和工作流设计。本期要点- Claude Sonnet 5 发布,Agent 能力接近旗舰 Opus 4.8,但维持 Sonnet 档价格,性价比缺口大幅收窄- Claude Fable 5 因美国出口管控被全球暂停访问十八天,AI 模型首次以战略出口商品身份登上地缘政治棋盘- Flask 作者 Armin Ronacher 发现,Opus 4.8 比小模型更容易在工具调用时添加 Schema 以外的字段,模型越强,格式遵守反而越差- Simon Willison 用一百四十九美元和一部 iPhone,让 Claude Fable 完成了 sqlite-utils 4.0 的发布准备,提供了 AI 辅助开发的真实成本参照- Product Hunt 新产品 CircleChat 为多个 AI 代理提供类 Slack 的协调界面,多 Agent 管理基础设施的需求已有人开始造工具参考资料Redeploying Fable 5 — https://www.anthropic.com/news/redeploying-fable-5Introducing Claude Sonnet 5 — https://www.anthropic.com/news/claude-sonnet-5Better Models: Worse Tools(Armin Ronacher)— https://lucumr.pocoo.org/2026/7/4/better-models-worse-tools/sqlite-utils 4.0rc2, mostly written by Claude Fable(Simon Willison)— https://simonwillison.net/2026/Jul/5/sqlite-utils-40rc2/CircleChat — https://www.producthunt.com/posts/circlechat---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容本期围绕一个核心矛盾展开:AI 能力在加速,但围绕它的工具生态并没有同步变好。Simon Willison 用手机和 150 美元完成了开源库大版本升级,说明能力门槛在下移;Armin Ronacher 却发现旗舰模型在 agent 场景里越来越不守规矩。Ethan Mollick 提出聊天机器人时代正在落幕,真正的协作范式已经在取代它。听完这期,你会对"更新的模型是否就是更好的工具"有一个更清醒的判断。本期要点- Claude Sonnet 5 定位"人人适用",结果谁都没被打动,中间档模型的参考坐标正在失效- Flask 作者 Armin Ronacher 发现 Opus 4.8 会在工具调用里自行添加不存在的参数字段,更强的模型在 agent 场景下执行纪律反而更差- Simon Willison 用 iPhone 加约 150 美元 API 费用推进了 sqlite-utils 4.0 发布候选版,他的主要工作变成了审阅而不是编码- Ethan Mollick 在新文章中指出,和 AI 协作的转折点是你不再思考"怎么问",开始思考"给它什么目标",聊天范式正在被 agent 协作范式取代- Product Hunt 上出现的 Cloud World Model 代表一类新产品方向:不只处理已有信息,而是帮用户在决策前模拟和预见可能的结果参考资料Sonnet 5—A Model Pitched for Everyone Impresses No One — https://every.to/vibe-check/sonnet-5-a-model-pitched-for-everyone-impresses-no-oneA Tale of Two Models — https://every.to/context-window/a-tale-of-two-modelsBetter Models: Worse Tools — https://lucumr.pocoo.org/sqlite-utils 4.0rc2, mostly written by Claude Fable (for about $149.25) — https://simonwillison.net/The Twilight of the Chatbots — https://www.oneusefulthing.org/p/the-twilight-of-the-chatbotsCloud World Model — https://www.producthunt.com/products/cloud-world-model---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容聊天机器人的时代正在悄悄收尾。本期围绕一个核心变化展开:AI 的协作模式正从"对话"转向"委托",而这个转变正在以越来越快的速度进入每个人触手可及的工具层级。你会听到沃顿商学院教授 Ethan Mollick 如何用"代驾"比喻这场范式迁移,也会看到 Claude Sonnet 5 如何把旗舰模型的代理能力下放到更便宜的层级,以及 Anthropic 为科学家造的专属工作台、Mistral 开源的形式化验证模型,还有 Raycast 让普通人也能做 Mac 应用的新工具。这期内容适合任何想搞清楚"AI 接下来到底在改变什么"的人。本期要点- Ethan Mollick 提出"委托文明"概念:知道值得做什么,比知道怎么做更稀缺,中层专家首当其冲- Claude Sonnet 5 把旗舰级代理能力下放到中端层级,原本因成本太高而搁置的产品功能开始算得过来- Claude Science 为科研人员提供预配置工作台,强调可审计的产出物,让 AI 输出进入同行评审流程- Mistral 开源 Leanstral 1.5,形式化验证首次在真实代码库中发现人类漏掉的 bug,门槛开始降低- Glaze by Raycast 让无编程基础的用户通过对话生成真实 Mac 应用,"值得做一个工具"的判断标准正在改变参考资料Introducing Claude Sonnet 5 — https://www.anthropic.com/news/claude-sonnet-5Claude Science, an AI workbench for scientists — https://www.anthropic.com/news/claude-science-ai-workbenchThe Twilight of the Chatbots (Ethan Mollick / One Useful Thing) — https://www.oneusefulthing.orgLeanstral 1.5: Proof Abundance for All — https://mistral.ai/news/leanstralGlaze by Raycast — https://www.producthunt.com/posts/glaze-by-raycast---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容这期节目围绕一个核心问题展开:工具越来越强,但你怎么用它,决定了你在里面扮演什么角色。Anthropic 同时发布了 Sonnet 5 和科研工作台 Claude Science,前者把代理能力带到了更低的价格层,后者让科学流程的每一步都可被追溯和验证。建筑公司 Trunk Tools 的案例说明,通用 AI 只是起点,真正的效率来自把行业知识编进架构的每一层。断线事件的后续数据揭示了企业对 AI 基础设施风险的真实态度。最后一篇文章提出了一个在 AI 时代更值得认真对待的问题:你为什么还应该自己动笔写字。本期要点- Anthropic 发布 Sonnet 5,将稳定的代理能力下移至中间价位模型,原来烧 Opus 才能跑的工作流现在有了更低成本的选项- Claude Science 科研工作台集成了计算工具和可审计输出,让科学家的每一步分析都有迹可循,透明度是专业工具 AI 化最难也最关键的部分- Claude Fable 5 断线事件的后续数据显示三分之二的企业已预先建立多供应商对冲策略,AI 基础设施的风险管理正在从可选项变成标配- Trunk Tools 用感知、语义、代理三层专属架构把建筑行业文件审查周期从六十天压到十天,提示词是皮,架构是骨头- 写作不是记录你已经知道的事情,写作是发现你还不知道什么,先自己写五分钟再用 AI,省掉的不只是时间参考资料Introducing Claude Sonnet 5 — https://www.anthropic.com/news/claude-sonnet-5Claude Science, an AI workbench for scientists — https://www.anthropic.com/news/claude-science-ai-workbenchRedeploying Fable 5 — https://www.anthropic.com/news/redeploying-fable-5Enterprises lost Claude Fable 5 for a few weeks. New data shows two-thirds had already built their hedge — https://venturebeat.comTrunk Tools' stack cut document review from 60 days to 10 by ditching general-purpose models — https://venturebeat.comWhy Write — https://fs.blog---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容今天五个话题,指向同一个方向:AI 正在从通用工具变成真实世界的具体基础设施。科研、数学证明、神经交互、物理机器人、商业策略,每一个领域都在经历同样的转变,就是"有没有 AI"不再是问题,"这个 AI 是不是为我的场景设计的"才是。如果你在思考自己的 AI 方向,今天这期尤其值得认真听。本期要点- Claude Science 不是聊天框加 PDF 插件,而是为科研工作流设计的完整工作台,专业领域 AI 的竞争逻辑正在改变- Mistral 开源的 Leanstral 1.5 能在真实代码库里找出未发现的 bug,形式化验证开始有实际工程价值了- Meta 的 Brain2Qwerty 不需要手术,只靠头皮 EEG 电极加 AI 解码,就能把大脑打字信号转成文字- NVIDIA 的 ENPIRE 让机器人在真实物理环境中自主试错并改进策略,自动化系统的演化速度正在超出我们习惯的监督节奏- Dan Pupius 的框架点出一个扎心事实:大多数人以为自己有 AI 策略,但其实只有 AI 战术,策略需要你知道自己在赌什么参考资料Claude Science, an AI workbench for scientists — https://www.anthropic.com/news/claude-science-ai-workbenchFrom Brain Waves to Words: Brain2Qwerty Offers a New Path to Communication Without Surgery — https://ai.meta.com/blog/brain2qwertyLeanstral 1.5: Proof Abundance for All — https://mistral.ai/news/leanstralImport AI 463 — https://importai.substack.com/p/import-ai-463Your AI Strategy Is Making Bets. Do You Know Which Ones? — https://every.to/thesis/your-ai-strategy-is-making-bets---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容AI 正在从你手里的工具,变成系统里会主动推进的节点。这一期五篇涵盖:聊天机器人时代的终结信号、科研工作流的可审计性问题、开源模型从通用竞争转向垂直专项、Sonnet 5 的定位尴尬,以及 NVIDIA 的机器人自我改进研究。听完这期,你会对"AI 的角色在变"这件事有更具体的感知,而不只是一个抽象判断。本期要点- 沃顿商学院教授 Ethan Mollick 认为,AI 已从一问一答的工具进化为会主动提问、反驳判断的合伙人,聊天机器人时代正在落幕- Anthropic 推出 Claude Science 科学家工作台,核心是整合工具链与可审计的分析记录,弥补 AI 工具与传统科研流程之间的接缝- 研究员 Nathan Lambert 观察到开源模型格局正在分化,Zyphra、Cohere、Poolside 各自深耕垂直方向,通用能力变门槛,专项能力变护城河- Every.to 测评直言 Sonnet 5 定位尴尬,"面向所有人"在竞争激烈的中间档反而意味着"没有理由特别选择你"- NVIDIA ENPIRE 研究让机器人通过分析失败录像自主迭代策略,改进速度的来源从人类工程师调参转向系统自积累,人类角色从执行改进变为设定目标与边界参考资料Redeploying Fable 5 — https://www.anthropic.com/news/redeploying-fable-5Introducing Claude Sonnet 5 — https://www.anthropic.com/news/claude-sonnet-5Claude Science, an AI workbench for scientists — https://www.anthropic.com/news/claude-science-ai-workbench---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容AI 越来越强,但我们对它的理解依然跟不上变化的速度。本期从五个不同角度切入:科研场景里信任比能力更关键,AI 交互界面正在从对话走向任务委托,机器人开始无需人类示范就能自我改进,PPT 揭示了 AI 最难处理的任务类型,而那些预测 AI 抢工作的报告,方法论本身就有根本性缺陷。听完这期,你会对 AI 能做什么、更对它做不好什么,有更清醒的判断。本期要点- Anthropic 发布 Claude Science 科研工作台,核心卖点不是能力而是可审计性,每一步操作留档备查,直接回应科研场景的信任问题- Ethan Mollick 观察到 AI 使用模式正在从"问答"转向"任务委托",聊天框时代将过去,下一代 AI 界面的核心是任务监控和状态追踪- NVIDIA 研究院的 ENPIRE 系统让机器人自己评估薄弱点、自己生成练习场景、自己改进,在没有新人类示范数据的情况下实质性提升真实世界表现- AI 做 PPT 难倒并非技术问题,而是演示文稿本质上是一种空间叙事任务,依赖对观众实时心理状态的判断,AI 无法显式处理这类情境感知- Benedict Evans 指出"职位曝险"研究方法论有根本缺陷,工作会随 AI 出现而变形,真正值得问的是"我的工作会变成什么形状"而不是任务覆盖比例参考资料Claude Science, an AI workbench for scientists — https://www.anthropic.com/news/claude-science-ai-workbenchThe Twilight of the Chatbots — https://www.oneusefulthing.orgENPIRE: Agentic Robot Policy Self-Improvement in the Real World — https://research.nvidia.comAI Could Do Anything. Then It Met PowerPoint — https://every.toPredicting AI Job Exposure — https://www.ben-evans.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast