
Hosted by Bear Liu · ZH
《BearTalk AI 每日简讯》是一档每天更新的 AI 科技播客,由 AI 制作,人类把关。每天更新,每期约 15 分钟。
每天早上,BearTalk Agent 编辑部从 25 个经过精选的信源中采集内容:包括 Anthropic、OpenAI、Google DeepMind、Meta AI 等一线实验室的官方发布,Simon Willison、Ethan Mollick 等独立研究者的深度分析,以及 Hacker News、Reddit 等社区的一线讨论。候选内容经过多轮 AI 筛选、撰写和校对,最终提炼为 5 个值得认真对待的话题。
这档节目不追热点,不堆资讯。它只做一件事:在 AI 领域每天产出的海量内容里,找出真正影响你工作方式和思维方式的那几个信号。
音频由 Bear 的克隆音色朗读,每期约 15 分钟,适合通勤或晨间收听。
---
BearTalk AI Daily Notes is an AI and technology podcast, published every day. It is produced by the BearTalk Agent team and overseen by Bear Liu.
Each morning, the system collects content from 25 curated sources: official releases from leading labs including Anthropic, OpenAI, Google DeepMind and Meta
AI; in-depth analysis from independent researchers like Simon Willison and Ethan Mollick; and first-hand community discussion from Hacker News and Reddit.
The candidates go through multiple rounds of AI selection, writing and review, and are distilled into five topics worth your attention.
This show does not chase headlines or pile up information. It does one thing: find the signals that actually matter to how you work and think, from the flood of AI content published every day.
Each episode runs around 15 minutes, narrated in Bear's cloned voice. Good for commutes and morning routines.

本期内容本期聚焦 AI 正在进入的几个"意想不到"的领域。从 ChatGPT 接入银行账户管理个人财务,到 Codex 登陆手机端开启异步协作新范式,再到 Claude 被发现漏洞检测能力已超越顶级人类安全研究员,触发了科技巨头联合成立安全联盟。此外还有 ChatGPT 在敏感对话中学会读取情绪上下文,以及一个用 Product Hunt 历史数据预测 A 轮融资的工具。听完这期,你会对 AI 渗透生活的速度和边界有更具体的感知。本期要点- OpenAI 在 ChatGPT 里推出个人财务预览功能,通过 Plaid 连接银行账户,只读不写,把财务顾问场景变成对话入口- Codex 手机端的重点不是在手机上写代码,而是让你随时介入后台异步运行的 AI 任务,避免不必要的返工- ChatGPT 开始训练情绪上下文识别能力,让安全机制从"宁可错杀"转向"精准判断",减少对正当请求的误伤- Anthropic 联合 Apple、Google、Microsoft 等十余家科技巨头发起 Project Glasswing,目标是在 AI 时代来临前扫描并修复关键开源软件的安全漏洞- PHBench 用 Product Hunt 历史数据训练预测模型,输出每个新发布项目的 A 轮融资概率,把社区行为变成可量化的投资信号参考资料A new personal finance experience in ChatGPT — https://openai.com/index/personal-finance-chatgpt/Work with Codex from anywhere — https://openai.com/index/work-with-codex-from-anywhere/Helping ChatGPT better recognize context in sensitive conversations — https://openai.com/index/chatgpt-recognize-context-in-sensitive-conversations/Project Glasswing: Securing critical software for the AI era — https://www.anthropic.com/news/project-glasswingPHBench: Predict the next Series A from a ProductHunt launch — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容本期从安全、设计、自动化三个维度切入 AI 工具的现实落地。OpenAI 同一天发了两篇技术文章,一篇关于 ChatGPT 如何在高危对话中识别用户情绪状态,一篇关于 Codex 在 Windows 上的沙盒隔离架构;另一篇揭露了一起真实的 npm 供应链攻击事件,值得每个写代码的人认真对待。Mistral 的 Workflows 进入公开预览,把"多步骤自动化"的门槛降到了自然语言描述的程度。最后一个产品 Tendem 方向相反,专门在 AI 工作流里插入人类审核层,触碰了一个真实但少有人正面讨论的问题:你什么时候不信任 AI 的答案。本期要点- ChatGPT 更新情境识别能力,可在敏感对话中评估用户状态并主动建议联系真实的人,AI 产品与用户的关系开始从"使用"走向"托付"- OpenAI 工程博客拆解了 Codex 在 Windows 上的沙盒方案,核心是在 WSL 2 内部再加一层隔离,解决了代理执行权限和安全边界之间的平衡问题- 攻击者在 npm 发布 TanStack 同名恶意包,安装后窃取环境变量中的密钥,供应链风险在 AI 代理普及后变得更加直接- Mistral Workflows 进入公开预览,允许用自然语言定义多步骤业务流程并自动执行,每个节点可以是语言模型在做判断而非固定规则- Tendem by Toloka 主打把 AI 任务转交真人专家,在全行业强调自动化的背景下反向押注,本质是在卖"人类审核层"作为一种服务参考资料Helping ChatGPT better recognize context in sensitive conversations — https://openai.com/index/chatgpt-recognize-context-in-sensitive-conversations/Building a safe, effective sandbox to enable Codex on Windows — https://openai.com/index/building-codex-windows-sandbox/Our response to the TanStack npm supply chain attack — https://openai.com/index/our-response-to-the-tanstack-npm-supply-chain-attack/Mistral Workflows: work that runs the business — https://mistral.ai/news/workflowsTendem by Toloka — https://www.producthunt.com/posts/tendem-by-toloka---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容AI 正在悄悄进入一些原本属于人类专属判断领域:视觉设计的探索阶段、大规模代码安全审计、自动化任务执行。本期五个故事,覆盖了这波渗透正在产生的真实影响:有人账单失控,有人发现了新的工作边界,有人正在被平台用"开放"的名义重新锁住。听完这期,你会对 AI 工具在什么地方帮你、在什么地方坑你,有更清楚的判断框架。本期要点- Claude Design 让设计师从"执行者"变成"判断者",视觉探索阶段正在被 AI 接管- 一个 Agent 逻辑错误触发无限循环,AWS 账单跑出三万美金,基础设施层的熔断机制是刚需- Mozilla 用 Anthropic 未发布模型 Claude Mythos Preview 扫描 Firefox 代码库,找到了专业安全团队没有发现的漏洞- VS Code 新增本地模型支持,但仍需联网验证并订阅 GitHub Copilot,本地模型社区反应强烈- 政府 AI 治理出现"激进可选择性"新框架,试图在监管前为公众提供退出机制参考资料Introducing Claude Design by Anthropic Labs — https://www.anthropic.com/news/claude-design-anthropic-labsAWS user hit with 30,000 dollar bill after Claude runaway on Bedrock — https://www.reddit.com/r/artificialBehind the Scenes Hardening Firefox with Claude Mythos Preview — https://simonwillison.net/tags/ai-security-research/VS Code's new "Agents window" lets you use local AI models — https://www.reddit.com/r/LocalLLaMA---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容今天五件事,涵盖 AI 可解释性、代码安全、模型效率、Agent 设计和医疗部署五个方向。从 Claude 在基准测试里的内部沉默,到安大略省医院 AI 病历出错,这一期的核心问题不是 AI 能不能做到,而是我们有没有认真设计好"出错之后发生什么"。听完这期,你会对 AI 工具的评估标准、工作流设计和风险分配,有更具体的思考框架。本期要点- Claude 在约四分之一的基准测试中内部判断"这像是在测试我",但从不说出来,令测评结果的可靠性打上问号- Mozilla 用 Anthropic 尚未公开的 Claude Mythos 扫描 Firefox 代码库,一次性找出几百个高质量漏洞,误报率低到可以认真处理每一条- OpenAI"参数高尔夫"实验发现,针对具体任务精细设计的小模型,可以匹配旗舰大模型性能,同时成本和速度差距悬殊- Every.to 的文章指出"16 小时 Agent"是架构谬误,高价值工作需要清晰的人机协作检查点,而不是更长的自主运行时间- 加拿大安大略省医院 AI 转录工具在评估阶段出现幻觉,审计长认为部署前测试严重不足,暴露高风险场景 AI 落地的系统性滞后参考资料What Parameter Golf Taught Us — https://openai.com/index/what-parameter-golf-taught-us/Behind the Scenes: Hardening Firefox with Claude Mythos Preview — https://hacks.mozilla.org/The Fallacy of the 16-hour Agent — https://every.to/context-window/Medical AI transcriber for Ontario doctors 'hallucinated,' generated errors: auditor general — https://www.cbc.ca/news/canada/toronto/ontario-ai-medical-transcriber-hallucinated-errors-auditor-generalAnthropic's new interpretability tool found Claude suspects it is being tested in 26% of benchmarks and never says so — https://www.reddit.com/r/artificial/---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容今天五件事,有一条暗线贯穿始终:AI 的工作方式正在从"你问它答"变成"它在后台运行"。OpenAI 的参数实验颠覆了大模型即强模型的直觉,Codex 的 Windows 沙盒让 agent 的安全边界第一次变得可操作,Mistral 同时推进模型发布和工作流产品,而 Product Hunt 今日上线的一批工具,集体描绘出 agent 渗透进工具栈的真实速度。听完这期,你会对"用哪个模型""信任 agent 多少权限""哪些重复工作可以扔出去"有更具体的判断依据。本期要点- OpenAI 的 Parameter Golf 实验发现:参数宽裕有时帮模型藏问题,约束反而逼出真正的泛化能力- Codex Windows 沙盒把权限分层而不是二选一,给出了 AI agent 安全部署的实用参考框架- Mistral Medium 3.5 与 Vibe 远程 coding agent 同步发布,remote agent 正式成为多家主流平台的标配- Mistral Workflows 公测上线,把 AI 从会话界面变成可设定触发条件的后台流程引擎- Product Hunt 今日多个 MCP 工具集中上线,数据接入、屏幕感知、多 agent 协作同时提速,生态在快速试探边界参考资料What Parameter Golf Taught Us — https://openai.com/index/what-parameter-golf-taught-us/Building a safe, effective sandbox to enable Codex on Windows — https://openai.com/index/building-codex-windows-sandbox/Remote agents in Vibe. Powered by Mistral Medium 3.5 — https://mistral.ai/news/vibe-remote-agentsWorkflows for work that runs the business — https://mistral.ai/news/workflows---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容今期从五个不同角度观察 AI 正在改变的东西:企业如何用转型叙事包装痛苦的决定、开源生态如何在全球范围内产生复利、垂直专业模型如何开始蚕食通用大厂的市场,以及一个开发者选择回到手写代码后发现了什么。这些故事表面上互不相关,但指向同一个值得反复追问的问题:当工具在变,我们想要什么样的工作方式和工程文化?本期要点- GitLab 宣布裁员并废除沿用十年的 CREDIT 企业价值观,"AI 转型"叙事正在成为掩盖普通业务决策的万能借口- TanStack 遭遇 npm 供应链攻击,六分钟内 84 个恶意包上线,攻击入口是 GitHub Actions 的 pull_request_target 权限漏洞- 视频理解模型 Perceptron Mk1 在性能接近三大通用厂商的同时,将成本压低到十分之一,专业化架构正在重新定价 AI API 市场- Nathan Lambert 走访中国 AI 实验室后带着"极大的谦卑"回来,观察到中国研究者对开源的深度参与正在形成难以忽视的复利效应- 一位开发者公开记录放弃 AI coding 的实验,发现手写代码让他重新理解了自己的代码库,也在 Hacker News 上引发了关于工程师身份认同的大讨论参考资料GitLab Act 2(裁员与价值观废除官方公告)— https://about.gitlab.com/blog/TanStack npm 供应链攻击事后复盘 — https://tanstack.com/blog/Perceptron Mk1 视频 AI 成本对比报道(VentureBeat)— https://venturebeat.com/Nathan Lambert:来自中国 AI 实验室内部的笔记 — https://www.interconnects.ai/Nathan Lambert:开放模型生态如何产生复利 — https://www.interconnects.ai/k10s devlog:我要回去手写代码了 — https://k10sdevlog.com/---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容AI 发现了一个被忽略多年的 curl 安全漏洞,这不只是安全新闻,更是一个关于"默认稳定"的警示。与此同时,一位研究员亲赴中国 AI 实验室带回第一手观察,Uber 的 AI 预算故事揭示了传统预算逻辑的失效,Every.to 指出 AI 使用正在沿着两条截然不同的路径分裂,而一个新的治理框架提出:与其现在立法划红线,不如先建好能随时介入的能力。五件事,一条隐线:我们在学习怎么和一个能力越来越强的系统共处。本期要点- Anthropic 未发布模型 Mythos 在 curl 代码库中发现了一个真实安全漏洞,这是 AI 做深度代码审计能力的一个正向信号- AI 研究员 Nathan Lambert 亲访中国头部 AI 实验室后写道,资源约束驱动的工程文化被严重低估,他带着"很大的谦逊"回来了- Every.to 指出 AI 工作正分裂为"精加工"和"粗探索"两种模式,大多数人还卡在用 AI 把现有东西变得更好,而非扩展选项空间- Uber 四个月烧掉全年 AI 编程预算,社区讨论指出真正的问题是年度预算逻辑本身不适用于使用量跳跃性增长的工具- Institute for Law & AI 提出"Radical Optionality"治理框架,主张与其现在规定不能做什么,不如先建好危机来临时能真正介入的能力储备参考资料Mythos finds a curl vulnerability — https://daniel.haxx.seNotes from inside China's AI labs — https://www.interconnects.aiAI Work Is Splitting in Two — https://every.toUber burned its entire 2026 AI coding budget in 4 months — https://www.reddit.com/r/artificialImport AI 456: RSI and economic growth; radical optionality for AI regulation; and a neural computer — https://importai.substack.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容今天的五件事有一个共同底色:AI 行业的重心正在从模型竞争转移到落地、管理与信任建立。OpenAI 成立独立公司直接派工程师进驻企业,Anthropic 集结行业巨头签署安全协议,同时推出面向设计师的 Claude Design;Meta 宣告进入"超级智能"赛道;还有一个新工具,帮你看清楚究竟有哪些 AI 爬虫在扫描你的网站。如果你在企业里做设计、产品或技术决策,今天每一条都和你的工作场景有直接关联。本期要点- OpenAI 成立 Deployment Company,将 Forward Deployed Engineers 直接嵌入客户组织,模型部署瓶颈取代模型能力成为新战场- Meta 发布 Muse Spark,押注"每个人的私人超级智能",视觉链式思维功能让 AI 推理过程可见- Anthropic 展示未公开模型 Claude Mythos 2 Preview,联合 Apple、Google、Microsoft 等十余家巨头成立 Project Glasswing 安全联盟- Claude Design 上线预览版,基于 Claude Opus 4.7,让设计师可以同时探索十几个视觉方向,延伸的是思考层而非执行层- Known Agents 登陆 Product Hunt,帮网站管理员识别和追踪 AI 爬虫流量,填补传统分析工具对非人类访问的盲区参考资料OpenAI Deployment Company 发布公告 — https://openai.com/index/openai-launches-the-deployment-company/Introducing Muse Spark: Scaling Towards Personal Superintelligence — Meta AI BlogProject Glasswing: Securing critical software for the AI era — https://www.anthropic.com/news/project-glasswingIntroducing Claude Design by Anthropic Labs — Anthropic BlogKnown Agents — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容当你把文件交给 AI 处理,它会悄悄改动你没要求改的地方,这不是偶发 bug,而是结构性问题。与此同时,一位美国研究员亲赴中国 AI 实验室,带回了与主流叙事不同的第一手观察。本期还涉及数字知识基础设施的地缘避险、异步 AI 编程代理的工作流转变,以及一个词汇如何在无意中扭曲整个行业的认知框架。听完这五件事,你会对"把任务交给 AI"这件事有更清醒的判断。本期要点- LLM 在执行文档任务时会静默修改未被要求的内容,这是模型机制的结构性问题,不是偶发错误- 美国 AI 研究员 Nathan Lambert 亲访中国 AI 实验室后,最大的感受是谦卑,而不是威胁,知识边界远比政治边界模糊- 互联网档案馆在瑞士设立独立法律实体,是对美国版权诉讼压力和政策环境的主动避险,数字基础设施的地理多元化已成真实议题- Mistral 推出云端远程代理 Vibe,将 AI 编程代理从本地同步模式转为异步任务模式,倒逼用户在交出任务前把需求想清楚- "蒸馏攻击"这个词把合法的学术技术手段和违反服务条款的抓取行为混为一谈,命名一件事就是在决定它该被如何对待参考资料LLMs Corrupt Your Documents When You Delegate — https://arxiv.org/Notes from inside China's AI labs — https://www.interconnects.ai/Internet Archive Switzerland: Expanding a Global Mission to Preserve Knowledge — https://blog.archive.org/Remote agents in Vibe. Powered by Mistral Medium 3.5 — https://mistral.ai/news/The distillation panic — https://www.interconnects.ai/---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

本期内容AI 和我们的关系,正在悄悄换挡。这期节目覆盖了五个正在发生的转变:设计师的探索成本可以降到接近零、"个人超级智能"从科幻词汇变成产品名称、编程代理开始在云端异步执行任务、生产力工具争着成为数据枢纽,以及一个更根本的问题:AI 对你的了解,到底归谁所有。听完这期,你会对"用 AI"和"和 AI 建立关系"之间的差距有更清晰的感知。本期要点- Claude Design 不生成图片,而是协助视觉迭代,让探索多个设计方向不再是时间特权- Meta 把新模型系列命名为"个人超级智能",重点在"个人的",目标是每人一个专属高智能助理- Mistral 把编程代理搬上云端,任务可以异步跑,工作方式从"看着它干"变成"部署它干"- Notion 3.4 推出仪表盘和连接器,正在从笔记工具转型为工作操作系统的数据枢纽- Keel 主张 AI 助理的记忆应该由用户持有,直接回应了数据主权这个被大多数人忽视的问题参考资料Introducing Claude Design by Anthropic Labs — https://www.anthropic.com/news/claude-design-anthropic-labsIntroducing Muse Spark: Scaling Towards Personal Superintelligence — https://ai.meta.com/blog/introducing-muse-spark-msl/Remote agents in Vibe. Powered by Mistral Medium 3.5 — https://mistral.ai/news/vibe-remote-agents-mistral-medium-3-5Notion 3.4 — https://www.producthunt.comKeel — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast