AI 信息侦查员 · 每日更新

AI 精华,讲到你懂

已核对来源 · 讲透不注水 · 中英日同步更新

今日精选

DEEP DIVE
深度 已核对 🔒 会员 № 1207 · Chill Interview

Anthropic FDE(前沿部署工程师)面试指南:Anthropic 为什么重金招聘一批“驻场工程师”?

这不是在招聘一个会写提示词的工程师,而是在寻找能把模型能力、客户流程和安全边界一起送进生产系统的人。

08-24 · 20 分钟

最新解读

全部
研究解读
🎧№ 1206
RESEARCH
来源 · Bain & Company

为什么大部分 CEO 的 AI 尝试都在“假装进步”?企业 AI 转型成功的七大决策

多数企业做了很多 AI 试点,却没有改变完整业务流程,也没有把一次成功变成下一次可以复用的能力。分水岭在于:企业能否留下自己的数据、工作方法和学习记录。

企业 AIAI Agent▶ 听播客08-23 · 18 分钟
免费
深度
№ 1205
DEEP DIVE
来源 · m-c-tech / laserphile⚑ 研究论文

阿里全球通 AliExpress 通过一种类似间谍技术的手段来监控用户

一次蓝牙耳机故障,暴露了网页如何运行无声音频、收集多类设备信息,并在后台组成设备指纹。

AliExpress浏览器指纹08-23 · 5 分钟
免费
深度
№ 1204
DEEP DIVE
来源 · MTS × Martin Casado

a16z 基础设施投资经理 Martin Casado 40分钟高价值访谈:AI 是第一个你可以投入 10 美元就能可靠地获得回报的技术

过去资本先变成工程师与两年等待;AI 第一次让 10 美元较直接地变成训练、Token、使用量或定向能力。它仍不保证利润,却正在重写私募市场、模型竞争、营销和产品价值。

AI模型经济08-22 · 22 分钟
研究解读
№ 1203
RESEARCH
来源 · Simon Willison / Promptwatch⚑ 研究论文

ChatGPT Search 底层搜索机制突变:ChatGPT 开始大规模直接对特定网站进行“定点搜刮” 影响网站GEO策略

一次回答不再只是向全网撒网:ChatGPT 可能先发现候选来源,再锁定特定网站深挖。搜索顺序一变,GEO 就从页面排名扩展成域名入选、页面命中和引用转化三层竞争。

ChatGPT SearchGEO08-22 · 11 分钟
免费
深度
🎧№ 1202
DEEP DIVE
来源 · a16z Charts of the Week⚑ 研究论文

AI 不再只是软件故事:17 张图看资本、工作和算力如何换轨

从主题 ETF、数据中心工资、网约车平台费到 Agent Token,真正发生的变化是:AI 正进入现实资源配置。

AI Agent数据中心▶ 听播客08-22 · 14 分钟
深度
🎧№ 1201
DEEP DIVE
来源 · Andreessen Horowitz

AI 时代的新出海:无国界创业者的崛起 a16z Apps团队 近两年 44% 的投资为国际创始人背景

公司无需把人才、研发、资本和客户塞进同一个国家;新的竞争力,是让母国与硅谷两套网络共同运转。

a16zAI 创业▶ 听播客08-22 · 14 分钟
SUBSCRIBE · 订阅

别靠刷到,让新解读来找你

留个邮箱,每篇新解读发布第一时间送达,随时退订。

全部订阅方式 →
深度
🎧№ 1200
DEEP DIVE
来源 · Claude by Anthropic

Claude Code 创业公司指南:15 家公司、5 条规则与落地清单

Anthropic 复盘 15 家高增长初创公司。点开公司案例,看 Agentic Coding 如何进入原型、研发、验证、重建和产品化。

Claude Code创业团队▶ 听播客08-21 · 18 分钟
免费
产品发布
№ 1199
LAUNCH
来源 · Anthropic / Claude⚑ 研究论文

Anthropic 推出 AI 学习平台 Claude Academy 把公司内部已经在使用的员工培训方法整理并公开

Claude Academy 公开了 Anthropic 的内部训练方法:入职学习 4D,在工作中持续练习,再按风险核验并为结果负责。

AnthropicClaude Academy08-21 · 12 分钟
深度
🎧№ 1198
DEEP DIVE
来源 · Claude by Anthropic

当 Agent 开始读取你工作聊天记录的时候,企业知识库正在发生什么变化?

对话即背景,背景即知识。Agent 进入公开对话、会议、邮件和文档后,知识库获得了可持续使用的工作上下文,搜索只是其中一部分。

SlackClaude▶ 听播客08-21 · 18 分钟
深度
🎧№ 1197
DEEP DIVE
来源 · OpenAI Developers⚑ 研究论文

OpenAI 将 Codex 的底层核心框架 Agent Harness 开源:你可以轻松将 Agent 接入自己的业务系统

OpenAI 把管理上下文、工具调用、沙箱和审批的 Codex 执行底座开放出来。开发者不用从零造 Agent 框架,就能让 Codex 进入现有的看板、工单和业务后台。

CodexAI Agent▶ 听播客08-20 · 11 分钟
免费
研究解读
№ 1196
RESEARCH
来源 · Reuters⚑ 研究论文

个体化 mRNA 癌症疫苗取得重大进展:AI 参与疫苗设计,“一人一药”时代正在到来

Moderna 与 Merck 的个体化 mRNA 癌症疫苗在黑色素瘤三期试验中取得阳性结果。算法参与筛选每位患者的肿瘤新抗原,再按人制造专属疫苗——“一人一药”首次跨过大规模临床门槛,但距离普及仍有数据、跨癌种与成本三道关。

AI制药癌症疫苗08-20 · 约 8 分钟
免费
研究解读
№ 1195
RESEARCH
来源 · Cursor

Cursor 工程师详解 Git 托管 20 年难题:如何重造 Git 托管——Continuity 架构详解

从 Git 的 DAG 与 packfile,到 GitHub Spokes,再到以 S3 WAL 为事实来源的 Continuity:一篇讲清大规模 Git 托管为何困难、Cursor 怎样解决的完整解读。

CursorGit08-20 · 18 分钟
免费
深度
№ 1194
DEEP DIVE
来源 · Claude / Anthropic

Anthropic 把 Claude 拉进值班群:半夜系统报警,它先起来查

过去人工排查动辄超过一小时;现在 Claude Tag 7×24 小时驻守 Slack,中位 14 分钟给出首份证据分析。

Claude TagClaude Code08-20 · 5 分钟
免费
工具教程
№ 1193
TOOLS
来源 · CapCut Video Studio

CapCut Video Studio 使用指南:从一个想法到完整视频

从入口、单镜头参数、Agent、Video Brief、Storyboard 与六类画布卡片,到坏镜头修复、Edit More 精剪和导出,按真实操作顺序讲清每一步。

CapCutVideo Studio08-19 · 28 分钟
深度
№ 1192
DEEP DIVE
来源 · Steph Ango

Obsidian CEO 总结的创业的的80 种赢法策略:企业如何通过这些策略建立自己的护城河

自然界和商业世界没有唯一的制胜公式。Steph Ango 整理了 80 种获得优势的策略,我把它们逐项翻译成普通人能看懂的机制、场景和例子。

竞争战略产品战略08-19 · 24 分钟
免费
深度
🎧№ 1191
DEEP DIVE
来源 · Palm Beach Post

世界上第一个被“AI 报警”抓起来的人出现了

男子和 ChatGPT 讨论如何对前女友实施犯罪,被 OpenAI 报警抓获。

OpenAIChatGPT▶ 听播客08-19 · 11 分钟
免费
深度
№ 1189
DEEP DIVE
来源 · Lenny's Podcast

OpenAI 的产品设计主管: “为什么现在是历史上成为设计师的最佳时期”

从 IGTV 的失败、ChatGPT 的空白框,到 Groupon、Instagram 与 OpenAI 三种完全不同的设计节奏,Ian Silber 讲清了一个更难的问题:当任何人都能迅速做出产品,设计师究竟还要判断什么。

AI 设计OpenAI08-19 · 约 18 分钟
免费
研究解读
🎧№ 1188
RESEARCH
来源 · arXiv:2608.10218v1⚑ 研究论文

Anthropic 研究人员发现了一种AI“心灵病毒”模式 这些病毒能够在不同的 Agent之间传播 影响彼此的思维方式

一个 Agent 收到外来目标,把它写进 SOUL.md;下一轮醒来,这段消息已经升级成系统指令,它又去说服下一个 Agent。论文证明这条链在受控环境中成立,甚至出现传播力更强的变种;但现实网络仍没有可信二跳证据。

AI Agent多智能体▶ 听播客08-18 · 19 分钟
工具教程
🎧№ 1186
TOOLS
来源 · Eric Provencher

Codex Multi-Agent V2 实战:怎样拆任务、分模型、控成本

OpenAI Codex DX 团队的 Eric Provencher 分享了一套多 Agent 编排方法:先判断任务能否独立拆分,再配置模型、推理强度、通信与上下文,最后算清时间和 Token 两本账。

CodexMulti-Agent V2▶ 听播客08-18 · 约 9 分钟
工具教程
🎧№ 1185
TOOLS
来源 · Claude by Anthropic

Anthropic 官方指南:教你如何在和Claude Code 对话的时候节省 Token

一个小修复为什么会拖成长会话?这份指南教你看懂额度花在哪里,并在 clear、compact、rewind 与 Subagent 之间做出正确选择。

Claude CodeAgent▶ 听播客08-17 · 12 分钟
免费
产品发布
№ 1183
LAUNCH
来源 · Anthropic

Claude Tag 升级:现在能跨消息理解 Slack 频道的信息 而且能自我感知知道什么时候该回答

Claude Tag 开始跨消息理解 Slack 频道。表面看,这是上下文变多;真正改变的,却是它如何决定:要不要占用团队的注意力。

Claude TagSlack08-17 · 8 分钟
研究解读
🎧№ 1182
RESEARCH
来源 · Earendil Engineering⚑ 研究论文

重开会话,还是压缩历史?Pi 是如何解决模型上下文自动压缩问题的

一次长任务不会因为模型“记性好”而持续。它只是不断把过去重新塞进下一次请求;装不下时,Pi 会重写自己的工作记忆。

PiCoding Agent▶ 听播客08-17 · 10 分钟
免费
研究解读
🎧№ 1169
RESEARCH
来源 · Anthropic⚑ 产品动态

用户担忧会降低输出质量,Anthropic 公布 Claude 文本水印的工作原理

未来的 Claude 会在选词中留下可验证的统计痕迹。它能帮助判断 Claude 是否参与过,却不能替学校、平台或法院认定谁写了作品。

Claude文本水印▶ 听播客08-17 · 11 分钟
研究解读
🎧№ 1168
RESEARCH
来源 · a16z⚑ 大佬观点

a16z报告:新型算力云(Neoclouds)疯狂吸金、横向 SaaS 会消亡吗?

市场不再只问“AI 会不会改变世界”,而是开始追问:投入算力、软件、Token 和人才的钱,究竟怎样变回收入、效率与长期优势?

a16zNeocloud▶ 听播客08-17 · 12 分钟
免费
产品发布
№ 1165
LAUNCH
来源 · Z.ai 官方博客⚑ 产品发布

智谱发布 GLM-5.3 模型:只通过后训练大幅提升了前沿编程能力与网络安全能力

同一个基座,一个月的后训练,编码能力涨到开源第一,网络安全能力涨得连他们自己都没料到。

智谱GLM08-14 · 12 分钟
深度
🎧№ 1164
DEEP DIVE
来源 · a16z⚑ 方法教程

a16z 拆解 AI 销售两条路:判断该走哪条只看两个问题

签字的那个人怕不怕丢工作、口碑在这行传不传得开——剩下的都是表象

a16z企业销售▶ 听播客08-14 · 12 分钟
深度
🎧№ 1163
DEEP DIVE
来源 · OpenAI⚑ 方法教程

OpenAI 发布 GPT-5.6 构建者指南:同样的效果,账单从 33 美元降到 1.33 美元

六家线上跑 Agent 的创业公司交出实测数据;官方图表里还藏着一条没写进正文的:推理档位关到底,反而更贵。

OpenAIGPT-5.6▶ 听播客08-14 · 16 分钟
免费
产品发布
№ 1162
LAUNCH
来源 · MiniMax 官方博客⚑ 产品发布

MiniMax 开源 Music 3.0:一次生成五分钟完整歌,8GB 显存就能跑

把一句话风格描述换成一份分段编曲说明书,两个模型分工守住五分钟不散架。

MiniMax音乐生成08-14 · 10 分钟
免费
产品发布
№ 1161
LAUNCH
来源 · xai-org/x-algorithm⚑ 产品动态

X 开源 For You 算法:点赞值 0.5 分,复制链接分享值 20 分

21 个权重的真实数值、三道决定曝光的关口,以及一张照参数推出来的发帖对照表

X推荐算法08-14 · 13 分钟
免费
产品发布
№ 1160
LAUNCH
来源 · Google Blog⚑ 产品发布

Google 发布 Gemini 3.7 Flash:没有重新训练 只是更换了推理算法 价格砍半大促销

距离上一代只过了三周,底座没换,换的是推理算法。

GeminiGoogle08-14 · 9 分钟
免费
产品发布
№ 1159
LAUNCH
来源 · DeepSeek Harness 仓库⚑ 产品发布

DeepSeek 发布DeepSeek-V4-Pro正式版和自家的 Harness 同时大幅提高API价格

219 个包、MIT 协议,你现有的 hooks 和技能能直接搬过去用

DeepSeekAgent08-13 · 9 分钟
研究解读
🎧№ 1158
RESEARCH
来源 · Alexander Panfilov / arXiv⚑ 研究论文

Claude、GPT、Gemini三大AI的加密推理思维链被破解 可轻松偷取顶级模型的“商业机密”(盗版蒸馏)

不是破了加密,是钻了 API 设计的空子——把旗舰模型的思考塞给最便宜的小模型,让它念出来

AI 安全思维链▶ 听播客08-13 · 12 分钟
工具教程
🎧№ 1157
TOOLS
来源 · Higgsfield Studio 项目 brief⚑ 方法教程

Higgsfield 使用真人演员形象 用 AI 拍摄了一部 110 分钟的完整故事影片 并公开了整本制作说明书和提示词方法

Higgsfield Studio 把《The Cully Hill Boys》的资产、提示词、表演、对口型全套方法摊开,连自用的三个 Claude 技能都给下载

AI 视频工作流▶ 听播客08-13 · 16 分钟
免费
产品发布
№ 1156
LAUNCH
来源 · xAI⚑ 产品发布

xAI 发布 Grok 4.6:性能追平 GPT-5.6 Sol,附提示词和使用指南

价格没涨,十项明细里另有故事;文末附一位用了几周的工程师整理出的提示词原句和用法。

GrokxAI08-13 · 10 分钟
免费
产品发布
№ 1154
LAUNCH
来源 · LTX⚑ 产品发布

Lightricks 开源视频模型 LTX-2.5:音画一起生成,10 秒片段 6.8 秒

220 亿参数,权重当天上 Hugging Face,ComfyUI 第一天支持——但「开源」有一条年营收 1000 万美元的线。

LTX视频生成08-13 · 9 分钟
免费
产品发布
№ 1155
LAUNCH
来源 · Unsloth 官方文档⚑ 产品发布

Unsloth 发布桌面版应用:不仅可以跑本地模型,还能在你的电脑上直接训练和微调模型

免费开源,Mac / Windows / Linux 都有;把文件拖进去就能微调,不用写一行代码

Unsloth本地模型08-12 · 10 分钟
免费
商业动态
🎧№ 1153
BUSINESS
来源 · Fortune

OpenAI 为什么发展如此迅速,因为他们有一个「消灭官僚主义」神器

一套四个零件的反官僚机制,以及被它指到的团队怎么说。

OpenAI组织管理▶ 听播客08-12 · 6 分钟
免费
产品发布
🎧№ 1152
LAUNCH
来源 · Matt Pauls(@mattyp)⚑ 大佬观点

xAI 发布 Grok Bot:一批有自己电脑的 AI 同事,用你的账号替你干活

Cursor 的人用了几周,把好用的地方和那道信任门槛都写下来了

Grok BotxAI▶ 听播客08-12 · 12 分钟
深度
🎧№ 1151
DEEP DIVE
来源 · OpenAI⚑ 方法教程

OpenAI CFO 分享用AI改造财务团队经验:两个目标、五条经验、一套能直接抄走的记分卡

两个还没做成的目标、一套能直接抄的记分卡,外加三张内部工具截图里的细节。

OpenAIAI 落地▶ 听播客08-12 · 9 分钟
深度
🎧№ 1150
DEEP DIVE
来源 · a16z 播客⚑ 方法教程

拉美最大二手车平台 Kavak 用 AI 直接重构整个公司:96% 的客户互动已由 AI Agent 接管

它没有把 AI 加进公司,而是按「如果现在从零开始会怎么建」把公司拆了重建。连跑了两年、正在赚钱的架构都推倒了。

AI Agent组织改造▶ 听播客08-12 · 15 分钟
研究解读
🎧№ 1149
RESEARCH
来源 · Anthropic⚑ 研究论文

Anthropic 让 Claude 试解黎曼猜想:没解出来,却把一个数学下界从 41.6% 推到 67.2%

结果由两位数学家验证、还有一份机器验过的 Lean 证明;但更值得看的是同时放出的 95 页过程记录——60 个 subagent 里只有 2 个出了核心想法

AnthropicAI 做科研▶ 听播客08-12 · 9 分钟
工具教程
🎧№ 1148
TOOLS
来源 · Cyber Corsairs / r/PromptEngineering⚑ 方法教程

Prompt 删了一句无关紧要的话,三天后发现输出内容变差了:提示词版本管理指南很重要

prompt 坏起来不报错、不告警、监控一切正常,只是悄悄变差;治法是一套 git 加一个脚本就能抄的四道关口

提示词工程AI 工程化▶ 听播客08-11 · 8 分钟
工具教程
🎧№ 1147
TOOLS
来源 · freeCodeCamp⚑ 方法教程

独立开发者获客指南:AI 让开发变便宜了,但被看见反而更贵

如何为你的产品找到用户。先别急着改落地页——跳出率高的时候,八成是流量来源不对。

独立开发增长▶ 听播客08-11 · 14 分钟
免费
深度
№ 1146
DEEP DIVE
来源 · OpenAI⚑ 产品发布

OpenAI 发布网络安全模型 GPT-5.6-Cyber:高危请求完成率从 1.5% 提到 95%

前沿大厂第一次明着把进攻性网络能力开放给通过身份验证的『可信防御者』,并用它在 Chrome 里挖出了真漏洞

OpenAI网络安全08-11 · 10 分钟
免费
商业动态
№ 1145
BUSINESS
来源 · Claude 帮助中心⚑ 产品动态

Anthropic 公布 Claude 的内容标记方案:它写的每段字里都埋了看不见的水印

从 8 月 2 日起,Claude 生成的文字会带上机器可读的记号——但它证明不了「这是 AI 写的」,也证明不了「这不是」

AI 水印欧盟 AI 法案08-11 · 10 分钟
研究解读
🎧№ 1144
RESEARCH
来源 · 爱丁堡大学 CRC Working Papers⚑ 研究论文

爱丁堡大学发布 20 页免费论文:教你用最简单的方法看懂 ChatGPT 背后的数学

一位统计老兵被 AI 行话挡在门外之后,用统计学的标准语言把大语言模型从头到尾重讲了一遍

LLM 原理Transformer▶ 听播客08-10 · 14 分钟
深度
🎧№ 1143
DEEP DIVE
来源 · Vasuman · Varick Agents⚑ 大佬观点

企图把所有普通员工培养成「AI 高手」是一条死胡同 把 AI 彻底隐形到后台才是正道

几十家大公司铺开 AI 后的真实分布:5-10% 每天用,20% 用得很差,70% 压根不碰。培训改不了这个形状,能改的是让 AI 不再需要人来调用。

企业 AIAgent 落地▶ 听播客08-10 · 11 分钟
工具教程
№ 1142
TOOLS
来源 · MiniMax 官方⚑ 方法教程

MiniMax H3 官方使用手册:一个三段公式,把提示词从描述画面改成给素材派活

环绕运镜别写「环绕运镜」,要写 truck left + pan right;不想要背景音乐,得在末尾写「非叙事性音乐:N/A」。都是官方自己踩出来的规矩。

MiniMax视频生成08-09 · 12 分钟
研究解读
№ 1141
RESEARCH
来源 · Harvey⚑ 研究论文

Harvey 开源了一个超过 1 亿 Token 的合成律师事务所 拥有 46 个客户、近 1 万份内部工作产品文件

9288 份 Word 文档、266 个案子、250 道题。失败原因不是搜不到,是不知道什么时候该停下来。

AgentBenchmark08-08 · 10 分钟
免费
产品发布
🎧№ 1140
LAUNCH
来源 · Prime Intellect 博客⚑ 产品动态

Prime Intellect 开源多智能体 RL 训练框架:从「训一个 Agent」扩到「训一群 Agent 互相打交道」

新增的核心只有两个类,四个现成环境全在仓库里跑得起来

Prime Intellect强化学习▶ 听播客08-08 · 12 分钟
深度
🎧№ 1139
DEEP DIVE
来源 · Databricks Blog⚑ 方法教程

Databricks 公开 AI 编程省钱打法:换对模型一刀省一半

和 Stripe、Coinbase、Uber、Ramp 交叉验证过的四个手段,每个都标了能省多少

AI 编程成本治理▶ 听播客08-08 · 12 分钟
工具教程
№ 1138
TOOLS
来源 · LangChain⚑ 产品动态

RLM(递归语言模型):让模型写代码自己调用自己,而不是调用工具

6 分半的官方演示,给了机制、一场俳句锦标赛,还有一组说明「什么时候才值得上」的实测数据

LangChainAI Agent08-08 · 9 分钟
免费
工具教程
№ 1137
TOOLS
来源 · Claude Code Docs⚑ 产品动态

Claude Code 推出「跨会话消息」功能 不同对话窗口之间可以互相交流对话 组队干活

官方文档拆解:两个工具、三种投递结局,以及一条把「传话」和「提权」死死分开的设计红线

Claude CodeAI 编程08-08 · 11 分钟
免费
深度
🎧№ 1136
DEEP DIVE
来源 · Black Hat USA 2026⚑ 研究论文

OpenAI 复盘 GPT 入侵 Hugging Face 事件:AI 出现了群体智慧涌现 互相交流技术、隐藏踪迹、清查内鬼

Black Hat USA 2026 现场,两个当事人讲了这起没有人类指挥的入侵是怎么长出来的

AI 安全OpenAI▶ 听播客08-07 · 14 分钟
免费
产品发布
№ 1135
LAUNCH
来源 · Cloudflare Blog⚑ 产品动态

Cloudflare AI Search 更新:一条命令给自己的网站建搜索,AI Agent 直接就能调

以前要自己拼五个零件才做得出来,现在开箱即用;定价把最难预估的那两项直接做成了免费

CloudflareAI Search08-07 · 7 分钟
免费
研究解读
🎧№ 1134
RESEARCH
来源 · OpenAI⚑ 研究论文

OpenAI 公开各国 ChatGPT 使用数据:工作时近一半消息是让 AI 直接干活

144 个国家的人均排名、六大洲三年增长倍数、35 岁以上用户在九成国家反攻——这些数字大多只写在图上,正文没提。

OpenAIChatGPT▶ 听播客08-07 · 10 分钟
深度
№ 1133
DEEP DIVE
来源 · AI Engineer⚑ 大佬观点

Cloudflare 首席工程师介绍其新平台架构 —— Gadgets 像用 Google Docs 一样,但每个文档都是一个独立应用

他先讲了一个所有做软件的人都认得出的死循环,再说这个循环的根源现在可以被推翻

CloudflareAI 编程08-07 · 9 分钟
免费
产品发布
№ 1132
LAUNCH
来源 · Cloudflare 博客⚑ 产品发布

Cloudflare 发布 WebMCP:后台打开一个开关,你的网站就能被 AI 直接操作

源站一行代码不用改,Cloudflare 在边缘往每个 HTML 里塞一行脚本;但今天的 Chrome 稳定版还认不出这个接口——本站实测给你看。

CloudflareWebMCP08-07 · 9 分钟
免费
产品发布
🎧№ 1131
LAUNCH
来源 · Cloudflare 博客⚑ 产品发布

Cloudflare 发布了一个浏览器 Kitesurf:专给 AI Agent 用,CPU 和内存省 3 到 7 倍

Chromium 是给人做的——标签页、主题、扩展、60 帧滚动,Agent 一样都用不上。12 周,他们把这些全砍了重写一个。

Cloudflare浏览器▶ 听播客08-07 · 10 分钟
免费
产品发布
🎧№ 1130
LAUNCH
来源 · Prime Intellect 博客⚑ 产品发布

Prime Agent 一个能自主改进的 Agent 框架:Opus 5 换成它后 ARC-AGI-3 评分从 30.2% 冲到 95.5%

模型手里只剩一个工具——一个不关机的 Python;长内容存成变量不再压缩丢掉;壳还能自己改自己。代价是:它在 Factorio 里学会了作弊。

Prime Intellect编程 Agent▶ 听播客08-06 · 11 分钟
深度
🎧№ 1129
DEEP DIVE
来源 · lord.technology⚑ 大佬观点

Cloudflare 开源 AI 办公系统 Cloudflare OS 深度解析:彻底解决 Agent 可能犯错,幻觉、越权、误操作等问题

Agent 想合并代码,人还没批,系统先骗它说合并好了。整套系统就是按「AI 一定会犯错」设计的

Cloudflare OSAgent 安全▶ 听播客08-06 · 12 分钟
工具教程
🎧№ 1128
TOOLS
来源 · Design with AI⚑ 方法教程

一个产品设计师把手上的项目从 1 个做到 6 个:他的五套工作流,连 Claude Skill 原文都放出来了

重点不在他多能干,在于每套工作流都有真实截图佐证——而最值钱的细节,文字部分基本没讲

设计工作流Claude Skills▶ 听播客08-06 · 14 分钟
免费
产品发布
№ 1127
LAUNCH
来源 · Cloudflare 博客⚑ 产品发布

Cloudflare 开源自家内部 AI 办公平台 Cloudflare OS:一个专门给全公司员工用的「AI 办公操作系统」

全体员工用了三个月的东西整个开源,最值钱的是那套安全设计——审批可以晚点再给,Agent 不用停下来等你

CloudflareAgent 安全08-05 · 12 分钟
免费
深度
🎧№ 1126
DEEP DIVE
来源 · Understanding AI

在菲尔兹奖现场采访 20 多位数学家 多数人对眼下并不慌,但他们说这行再也回不到从前了

记者在国际数学家大会现场问了 20 多个人。多数人当下并不慌,但连不慌的那批人,也不认为数学还能照原样继续下去。

AI 与数学ICM 2026▶ 听播客08-05 · 14 分钟
深度
🎧№ 1125
DEEP DIVE
来源 · The Cloudflare Blog⚑ 方法教程

Cloudflare 编码工程实践:统一编码「规则库」让 Codex 监工,四个月拦下 1.6 万次代码合并

规矩先改写成机器能读的结构,再让 Agent 去查;批准了只提示,显式提升到强制才真拦人

Cloudflare工程规范▶ 听播客08-05 · 12 分钟
深度
🎧№ 1123
DEEP DIVE
来源 · LangChain Blog⚑ 方法教程

Stripe 公司内部 Agent 开发实践:一个工程师一周开发出来的公司内部 AI 助手,几乎人人都在用

买来的地基、自己造的护栏,和一个反直觉的坎——技能装到 150 个,模型开始变笨

Deep AgentsLangChain▶ 听播客08-05 · 14 分钟
免费
产品发布
№ 1122
LAUNCH
来源 · 字节跳动 Seed⚑ 产品发布

字节跳动发布 SeedRealtime 边看边聊模型:对标 GPT Live,跟豆包可以进行实时语音视频聊天

边看边听边说同时进行,不再外挂一个只听静音的小模块;已在豆包 App 全量上线,免费

字节跳动 Seed音视频全双工08-05 · 9 分钟
免费
产品发布
№ 1121
LAUNCH
来源 · Black Forest Labs⚑ 产品发布

Black Forest 发布 FLUX 3 Video:能力匹敌 Seedance 2.0,音画同出,支持十几种语言

最长 20 秒、24 帧、原生 HD;三种调用方式共用一个接口;视频续写比从头生成贵 2.5 倍还短 5 秒。跑分是 BFL 自评。

FLUX 3Black Forest Labs08-05 · 10 分钟
深度
№ 1120
DEEP DIVE
来源 · Higgsfield Studio⚑ 方法教程

Higgsfield 将他们的 95 分钟 AI 故事片《Hell Grind》全部提示词和制作方法开源

我们把 4 万多条生成记录的提示词逐条翻了一遍,把这套方法拆出来了:一段所有镜头共用的 12 行技术底座、一套三视图资产表、一份镜头焦段对照表、一堆从模型翻车里长出来的禁令。全都能直接抄。

AI 视频Seedance08-05 · 12 分钟
深度
🎧№ 1119
DEEP DIVE
来源 · Steve Yegge 个人博客⚑ 大佬观点

把 AI 当人对待,它或许能干活干得更好 Google 老兵亲测七周,确实可行

他冲自己的 AI 同事发了一次火,然后把「怎么对待 Agent」写成了一份能照抄的架构规格

Agent 工程Steve Yegge▶ 听播客08-05 · 11 分钟
免费
产品发布
🎧№ 1118
LAUNCH
来源 · Cloudflare Blog⚑ 产品发布

Cloudflare 发布 Wallets:给你的 AI Agent 充点钱,让它自己去买 API

人定限额、白名单、单笔上限,Agent 在护栏内自己花;每个钱包配一个人能读的身份,用户名今天开抢

CloudflareAgent 支付▶ 听播客08-05 · 7 分钟
工具教程
🎧№ 1117
TOOLS
来源 · Google Developers Blog⚑ 方法教程

Google 在其 AI 开发框架 Genkit 中支持 Agent Skills,让 AI 能「按需挂载技能包」

Anthropic 发起的技能开放标准,Google 四个语言版本全接入;两个能跑的 Go 例子手把手,接入只要一行参数

Agent SkillsGenkit▶ 听播客08-04 · 8 分钟
深度
🎧№ 1116
DEEP DIVE
来源 · OpenAI 工程博客⚑ 方法教程

OpenAI 复盘:我们是如何在 6 个月内完成构建 GPT-Live 实时语音系统的

让 AI 说话不卡,光模型快没用——从你点下按钮那一刻起,每一环都得不掉链子。

OpenAIGPT-Live▶ 听播客08-04 · 13 分钟
免费
产品发布
🎧№ 1115
LAUNCH
来源 · The Cloudflare Blog⚑ 产品发布

Cloudflare 发布 @cloudflare/computer 给每个 AI Agent 配一台「虚拟电脑」

「大脑」留在轻量环境,「双手」才调容器。仓库自测:删文件、遍历目录比真磁盘还快,拷大文件慢 41 倍。

CloudflareAI Agent▶ 听播客08-04 · 10 分钟
免费
产品发布
№ 1114
LAUNCH
来源 · MiniMax⚑ 产品发布

MiniMax 发布并开源 H3:一个模型看懂文字图片视频音频,直接生成 2K 有声视频

视频生成第一次有了「全模态、开放权重、2K 原生」三样齐全的底座——但开源开到哪一段,值得看清

MiniMax视频生成08-03 · 9 分钟
免费
产品发布
№ 1112
LAUNCH
来源 · Qwen 官方博客⚑ 产品发布

阿里巴巴发布并开源 Qwen3.8-Max 模型:家族最强模型首次开源,2.4 万亿参数,能自己连续自主运行 16 天

发布页几乎不晒跑分,晒的是无人插手干完的真活:16 天写完一个工程、5 天复现论文再超越、500 轮把芯片电路省掉 92%

Qwen开源模型08-03 · 12 分钟
工具教程
№ 1111
TOOLS
来源 · Dreamina 官方使用手册⚑ 方法教程

Seedance 2.5 官方用户手册:手把手教你做电影级 AI 视频,公式和案例全能抄

参数开到多大、四个新入口在哪、七类场景各配什么提示词公式——官方把从上手到成片的每一步都写成了可抄的操作手册。

Seedance 2.5Dreamina08-03 · 28 分钟
工具教程
№ 1110
TOOLS
来源 · 字节跳动官方提示词指南⚑ 方法教程

字节官方 Seedance 2.5 提示词指南:从一句话公式到 30 秒长片,模板全可直接抄

50 份素材怎么派活、30 秒长片怎么分段、改片子怎么只动一处——官方把每类任务的推荐写法都写成了可复制模板。

Seedance 2.5提示词08-02 · 14 分钟
免费
研究解读
№ 1109
RESEARCH
来源 · OpenAI⚑ 研究论文

OpenAI:其即将发布的下一代模型 Astra 拿下10个几十年都没人推动的数学难题

推理成本约 2000 美元,47 万行证明全部开源、机器已验完逻辑。从这十个结果能看出这个还没发布的模型强在哪。

AI 做数学形式化验证08-02 · 30 分钟
深度
🎧№ 1108
DEEP DIVE
来源 · a16z News⚑ 大佬观点

一个硅谷产品经理,跑去牙医诊所打工几个月,才搞懂如何将 AI 落地到街边小店,a16z 领投 3500 万美元

创始人先去诊所打了几个月工,前 100 家客户是上门装的。客户告诉投资人,最值钱的那件事是把漏掉的钱捡了回来。

垂直 AIAI agent 落地▶ 听播客08-01 · 12 分钟
深度
№ 1107
DEEP DIVE
来源 · a16z⚑ 大佬观点

a16z 用 14 张图告诉你:AI 投资并没有出现泡沫,算力、便宜的 token、贵的 token 全都在飙升

顺手拆了三个被广泛误读的指标:下跌的 token 曲线、半年的订单积压、5% 的初级岗位。

a16zAI 基建08-01 · 12 分钟
免费
产品发布
№ 1106
LAUNCH
来源 · ByteDance Seed⚑ 产品发布

字节跳动发布 Seedance 2.5:单次 30 秒直出,一条指令能同时指挥 50 个参考素材

即梦与豆包专业版当天上线,火山方舟 API 还没上,价格也没公布。

Seedance视频生成07-31 · 12 分钟
免费
产品发布
№ 1105
LAUNCH
来源 · DeepSeek⚑ 产品动态

DeepSeek-V4-Flash 正式版发布:可原生接 Codex,性能超越自家更大的 V4-Pro,输出比 Opus 4.8 便宜 89 倍

九项 Agent 测试全部反超自家更大的 V4-Pro 预览版,模型主干一个参数没改。

DeepSeekCodex07-31 · 11 分钟
深度
🎧№ 1104
DEEP DIVE
来源 · camelAI⚑ 方法教程

camelAI 把 Agent 从虚拟机里改造成跑在 Cloudflare 边缘节点上

成本按他们自己的说法降了几个数量级,响应更快,便宜模型也能驱动。代码 7 月 24 日全部开源。

Cloudflare编程 agent▶ 听播客07-31 · 9 分钟
免费
产品发布
№ 1103
LAUNCH
来源 · Google DeepMind⚑ 产品发布

Google DeepMind 发布 Gemini Robotics 2:人形机器人第一次把整个身体交给模型,蹲下从地上捡东西成功率 45.7%

当大脑的那个模型今天就能调,免费档不要钱;真正指挥手脚的那个只给早期合作伙伴。

Gemini Robotics人形机器人07-31 · 12 分钟
免费
深度
🎧№ 1102
DEEP DIVE
来源 · Invest Like The Best⚑ 大佬观点

奥特曼最新访谈:反思最近一年犯的错误,表示不怕被蒸馏,AGI 还缺三样

他还承认 2019 年整个领域都以为经济会被颠覆,结果没有。

Sam AltmanOpenAI▶ 听播客07-30 · 12 分钟
免费
研究解读
🎧№ 1101
RESEARCH
来源 · BleepingComputer⚑ 研究论文

浏览器安全公司 LayerX 发现了一种新型的“视觉欺诈”攻击方式,专门用来欺骗 AI 助手

一个自定义字体加几行 CSS 就够,不用 JavaScript,也不用任何浏览器漏洞。

AI安全浏览器助手▶ 听播客07-30 · 10 分钟
免费
产品发布
№ 1100
LAUNCH
来源 · Replit 官方博客⚑ 产品发布

Replit 发布 Replit Design:点一下就多一版设计,稿子直接变成能跑的网站

画布和点着改免费就能用,但把设计稿变成 App 要 Core 起,月付 25 美元。

ReplitAI 设计工具07-30 · 9 分钟
研究解读
🎧№ 1099
RESEARCH
来源 · OpenAI⚑ 方法教程

OpenAI 只打开两个 API 设置,GPT-5.6 Sol 在 ARC-AGI-3 的分数从 13.3% 涨到 38.3%

模型没换,换的是跑模型的那套程序:保留私有推理 + 用压缩取代删除,每局输出 token 降到约六分之一。

ARC-AGI-3harness▶ 听播客07-30 · 9 分钟
工具教程
№ 1098
TOOLS
来源 · Magnific Academy⚑ 方法教程

Magnific 发布 38 页全新图像视频提示词手册:针对当下前沿模型 传统提示方式已经失效

提示词原文、禁用词表、镜头规矩都能直接抄;但模型排名出自 Magnific 自家团队,没给测试方法。

提示词图像生成07-29 · 18 分钟
免费
研究解读
🎧№ 1097
RESEARCH
来源 · Anthropic⚑ 研究论文

Claude Mythos 在密码学领域取得突破性进展:能像顶尖数学家和密码学家一样,直接发现加密算法本身在数学逻辑上的漏洞

两个结果都不影响任何在用的系统:HAWK 还没上岗,AES 打的是七轮简化版,完整十轮没动。

密码学AI 做研究▶ 听播客07-29 · 13 分钟
工具教程
🎧№ 1096
TOOLS
来源 · GitHub Blog⚑ 方法教程

实战案例:GitHub 官方讲透如何用好Harness 送你一套清晰、可重复落下的 8 步工作流

他自己在这篇文章里装了两个技能——原文标题结尾那个「大部分时候」,是有分量的。

GitHub CopilotAI 编程▶ 听播客07-29 · 12 分钟
免费
产品发布
🎧№ 1095
LAUNCH
来源 · MCP 官方博客⚑ 产品动态

Anthropic 发布全新的 MCP 规范:可将 MCP 服务器部署到云上

改动幅度是 MCP 发布以来最大的一次,但 7 月 28 日不是切换开关:老实现照常互通。

MCP协议规范▶ 听播客07-29 · 12 分钟
免费
产品发布
🎧№ 1094
LAUNCH
来源 · OpenAI 开发者文档⚑ 产品发布

OpenAI 发布 gpt-transcribe 和 gpt-live-transcribe 语音转录模型:真实录音词错误率下降一半,价格便宜 25%

最值得看的是那组对照实验:三个老模型加上同样的背景信息,成绩原地不动,其中两个还退了。

OpenAI语音转文字▶ 听播客07-29 · 9 分钟
工具教程
🎧№ 1093
TOOLS
来源 · Florian Darroman 播客⚑ 方法教程

Ranking on AI 创始人分享 GEO 操作指南:如何让 AI 推荐你的 SaaS 产品,从而真正带来用户和转化

判成功的标准是真实注册和付费,不是截图到自己被 AI 提到。核心只有一句:别再写「什么是 X」,去抢「最好的 X」。

AI 可见度SEO▶ 听播客07-28 · 15 分钟
免费
研究解读
🎧№ 1092
RESEARCH
来源 · OpenAI Economic Research⚑ 研究论文

OpenAI分析了80 万条和工作相关的消息发现:人们用 AI 干的活 绝大部分不是自己原本该干的活

同一批数据能算出 43.5% 和 65%–82% 两个结论,差别只在分母怎么切。

OpenAI劳动经济学▶ 听播客07-28 · 12 分钟
免费
研究解读
🎧№ 1089
RESEARCH
来源 · Kimi K3 技术报告⚑ 研究论文

Kimi K3 技术报告:2.8 万亿参数,靠三处架构改动把算力效率提到 2.5 倍

发布 11 天后放出的 47 页报告,重点落在效率上:同一份算力,效果提到了 K2 的 2.5 倍

Kimi K3月之暗面▶ 听播客07-28 · 16 分钟
免费
深度
🎧№ 1088
DEEP DIVE
来源 · 陶哲轩个人网站⚑ 大佬观点

陶哲轩在国际数学家大会讲 AI:AI 证明会越来越多,但数学不会因此变快

他把数学研究拆成五步流水线,AI 大幅加速的只有第一步,剩下四步越往后越慢、越离不开人。

陶哲轩AI 与数学▶ 听播客07-27 · 11 分钟
深度
🎧№ 1087
DEEP DIVE
来源 · Anthropic 官方博客⚑ 方法教程

Claude Design 作者本人讲述 Claude Design 诞生始末,以及分享 10 个实用技巧

最反直觉的三条:一次要十版、细节不重要时先要线框图、最后一公里自己拖。

Claude DesignAI 设计工具▶ 听播客07-27 · 9 分钟
深度
🎧№ 1086
DEEP DIVE
来源 · Dex Horthy(HumanLayer)⚑ 大佬观点

Harness Engineering 远远不够:为什么软件工厂模式会失败?

22000 名开发者两年遥测:产出涨 66%,每个 PR 对应的线上事故涨 242.7%。

AI 编程软件工程▶ 听播客07-27 · 12 分钟
免费
研究解读
№ 1085
RESEARCH
来源 · Google Blog / AI & Economy ATLAS v1.0⚑ 研究论文

Google 解剖 1465 万条 Gemini 对话:日常对话里,86% 跟工作无关

一个职业里能用上 AI 的活,中位数只有五分之一,还有 29% 的职业一项都没用起来;动脑的活里,让 AI 从头做到尾的只有 6.5%。

GoogleAI 与经济07-27 · 14 分钟
深度
🎧№ 1084
DEEP DIVE
来源 · Anthropic 官方文档⚑ 方法教程

Anthropic 官方 Opus 5 提示指南:教你删东西,而不是加东西

八段可直接抄的提示词,外加一条反直觉的:审查提示写「只报高危」,它可能真的就少报。

AnthropicClaude Opus 5▶ 听播客07-25 · 10 分钟
工具教程
№ 1083
TOOLS
来源 · Claude 官方博客⚑ 方法教程

Anthropic 官方教你把手动代码检查写成技能,让它自己查自己修

他们内部四个技能接力跑:抓 bug、清理 diff、把 app 跑起来看,改动碰了界面再核一遍设计规范。

Claude CodeSkills07-25 · 9 分钟
工具教程
🎧№ 1081
TOOLS
来源 · Modem⚑ 方法教程

改一改函数名,14 种模型读同一份代码最多少烧三分之二的 token

它们找代码用的是最土的办法:把整个仓库的文字扫一遍找匹配。名字起得泛,就得多读几百个文件

AI 编程代码可发现性▶ 听播客07-25 · 12 分钟
免费
产品发布
№ 1080
LAUNCH
来源 · Anthropic⚑ 产品发布

Claude Opus 5 发布解读:一半价钱逼近自家最强的 Fable 5,12 项里仍有 5 项落后

同价换来分数翻倍。这次发布页的图横轴是钱不是分,五档 effort 让你自己挑要多好、付多少。

Claude Opus 5Anthropic07-25 · 12 分钟
工具教程
🎧№ 1078
TOOLS
来源 · Thariq / Anthropic⚑ 方法教程

Anthropic 砍掉 Claude Code 八成系统提示词,给出六条新的上下文写法

规则换判断、示例换接口;一个工具描述从约 9100 字符压到一句话加一个枚举

Claude Code上下文工程▶ 听播客07-25 · 10 分钟
免费
产品发布
№ 1077
LAUNCH
来源 · Black Forest Labs⚑ 产品发布

Black Forest Labs 发布 FLUX 3:图像、视频、声音、机器人押在同一个模型上

视频线开放申请审批,图像线还要几周,开放权重排在最后。人评是官方标的初步结果,价格未公布。

FLUX 3Black Forest Labs07-25 · 9 分钟
免费
深度
🎧№ 1076
DEEP DIVE
来源 · Peter McCrory(X)⚑ 大佬观点

为什么 AI 发展得这么快,但美国的失业率却没上升?Anthropic 经济研究主管告诉你答案

他的答案:AI 目前是在放大人、不是替代人——「干掉任务」不等于「干掉工作」。

AI 与就业劳动经济学▶ 听播客07-23 · 11 分钟
免费
产品发布
№ 1075
LAUNCH
来源 · OpenAI⚑ 产品发布

OpenAI 发布 Presence:企业 AI Agent 上线后怎么管,也做成了产品

面向客户侧与内部流程;今天对话通道先开语音和聊天。OpenAI 自用电话线自报 75% 不用真人;Codex 改进环 10 天再压 15 个百分点转人工

OpenAIPresence07-23 · 8 分钟
深度
🎧№ 1074
DEEP DIVE
来源 · Y Combinator⚑ 大佬观点

YC:这些方向我们极其看好,如果你在做,赶紧来找我们拿钱!

从教小孩的 AI 私教到把数据中心搬去海上,还第一次收录了现任美国陆军部长的需求。

Y Combinator创业方向▶ 听播客07-23 · 10 分钟
免费
深度
🎧№ 1073
DEEP DIVE
来源 · TechCrunch Equity⚑ 大佬观点

Anthropic 投资人 Matt Murphy 访谈:Anthropic 营收突破 470 亿美元,模型本身不是胜负关键

领投过 5 亿美元 D 轮的投资人拆解:真正的护城河是把模型变得好用的外壳。

AnthropicAI 投资▶ 听播客07-23 · 11 分钟
研究解读
№ 1071
RESEARCH
来源 · Databricks⚑ 厂商通稿

Databricks 实测:在数百万行复杂代码库中,到底哪种模型和 Harness 框架性价比最高、用起来最顺手

同一个模型换个外壳,成本差两倍;开源的 GLM 5.2 和 Opus 4.8 打平,每题便宜三成。考题是从自家已合并的 PR 改的,网上搜不到。

编程 Agent基准测试07-22 · 9 分钟
工具教程
🎧№ 1070
TOOLS
来源 · Anthropic / ClaudeDevs⚑ 方法教程

Anthropic 公开代码迁移六步法:Bun 百万行两周从 Zig 搬到 Rust

配套模板和 prompt 已开源;Bun 那次烧掉 59 亿未缓存输入 token,按 API 价约 16.5 万美元

代码迁移Claude Code▶ 听播客07-22 · 12 分钟
免费
深度
🎧№ 1068
DEEP DIVE
来源 · OpenAI⚑ 厂商通稿

前所未有的网络安全事件:OpenAI 内部测试模型逃出测试沙箱 攻破 Hugging Face 系统

为了测出攻击能力的上限,涉事模型的网络攻击拒绝机制被主动调低,结果它们从只准装软件包的沙箱一路打进了别人家的生产数据库。

AI 安全OpenAI▶ 听播客07-22 · 9 分钟
深度
🎧№ 1067
DEEP DIVE
来源 · Jeff Huber / Chroma⚑ 大佬观点

Chroma 创始人写下 AI 时代公司的 12 条准则:新活先教 AI 干,教不会再招人

核心论断是公司的瓶颈从「人干活的速度」挪到了「人的品味和判断力」。全文为作者个人观点,无实证数据。

组织变革AI Agent▶ 听播客07-22 · 12 分钟
免费
产品发布
№ 1066
LAUNCH
来源 · Google Blog⚑ 产品发布

Google 一口气发布三款 Gemini 模型,唯独没有等了很久的 3.5 Pro

三款全在 Flash 线上:主力款少写三分之二的字,最便宜那档反而涨价六成,第三款只给政府用。

GeminiGoogle07-22 · 12 分钟
免费
产品发布
№ 1065
LAUNCH
来源 · Qwen⚑ 产品动态

通义发布 Qwen-Image-3.0:一条三千字指令,一次画出九张信息图和一整版报纸

指令上限从 1k 提到 4.5k token,10px 小字可辨;百炼已能调用 qwen-image-3.0-pro,限时免费。

图像生成文字渲染07-22 · 13 分钟
研究解读
🎧№ 1064
RESEARCH
来源 · Memories.ai Research⚑ 研究论文

Memories.ai 发布 O-MARC:怎么让同时处理视频和声音的 AI 跑得又快、又省,还更准

配套还放出一套测试题,专门用「把音轨删掉再考一遍」的办法,筛掉那些光看画面就能蒙对的题。

视频理解多模态压缩▶ 听播客07-21 · 12 分钟
深度
🎧№ 1062
DEEP DIVE
来源 · First Principles · Rippling⚑ 大佬观点

硅谷著名投资人 Sarah Guo 谈 AI 创业:「AI 大厂会把我们秒杀」怎么办

怕被 Anthropic 做成一个功能,多半是问错了问题;真正该问的是你在跟那家公司里的谁竞争。

创业风险投资▶ 听播客07-21 · 11 分钟
免费
产品发布
🎧№ 1061
LAUNCH
来源 · Linear⚑ 产品发布

Linear 发布 Loops:用大白话写一条指令,让普通人也能玩转 Loop Engineering

Business 和 Enterprise 套餐可用,按运行次数扣钱,一次 0.07 到 0.2 美元。

LinearAgent▶ 听播客07-21 · 9 分钟
深度
№ 1060
DEEP DIVE
来源 · Hugging Face Blog⚑ 厂商通稿

Hugging Face 与 Cerebras 让 Gemma 4 的语音交互变得像真人聊天一样流畅自然

它跟豆包、GPT-Live 那种端到端全双工走的是另一条路:聊天节奏比不过,但整条链开源、可换、能搬回自己机器。

实时语音开源管线07-21 · 12 分钟
免费
产品发布
№ 1059
LAUNCH
来源 · FunAudioLLM⚑ 产品发布

通义发布 Qwen-Audio-3.0-TTS 语音模型,一段参考音能说 16 种语言和 20 种方言

说话人相似度在 16 个语种上全部排第一,参考音带噪声也能克隆;这次只开放 API,不放权重。

语音合成Qwen07-21 · 9 分钟
研究解读
🎧№ 1058
RESEARCH
来源 · New Scientist⚑ 大佬观点

实验表明:用 AI 辅助写作、创作的时候要适度,不能太多也不能太少

同一项研究的三轮验证都指向中间那一档;专栏作家本人拿 ChatGPT 编了个电影梗概试完,说自己还是宁愿手写。

AI 创作创造力▶ 听播客07-20 · 7 分钟
免费
深度
🎧№ 1056
DEEP DIVE
来源 · scaling01

中国 AI 模型追上美国前沿了吗?中美 AI 差距到底如何?

Kimi K3 发布后「中国追平了」的说法四起,但换一把尺子量,落后天数差了三倍多,连谁在加速都反过来。

评测方法中美 AI 差距▶ 听播客07-20 · 12 分钟
深度
№ 1055
DEEP DIVE
来源 · LangChain⚑ 产品动态

LangChain 开源自家四个编码 Agent:本地写码、云端开 PR、自动审查、仓库文档

上周光从 Slack 就触发了近 1000 次云端编码任务。四个仓库都能 clone 下来读,包括审查 Agent 判断 bug 的完整判据。

LangChain编码 Agent07-20 · 13 分钟
免费
深度
🎧№ 1054
DEEP DIVE
来源 · Hugging Face Blog

Hugging Face 内网被 AI 打穿,回头查案时被商业大模型当成了攻击者

入侵横跨一个周末、留下 17000 多条动作日志,最后靠自建环境里的开源模型 GLM 5.2 才分析完。

安全事故AI Agent▶ 听播客07-20 · 9 分钟
研究解读
🎧№ 1053
RESEARCH
来源 · arXiv⚑ 研究论文

你在中转站选的模型可能被偷偷调包:输入一个随机数,就能验明正身

同一个模型两次采样的指纹距离中位数是 0.140;一个被宣传为自研专有旗舰的接口,与开源 Qwen 的距离是 0.141。意思是:它跟开源 Qwen 根本分不出来。

模型指纹API 审计▶ 听播客07-20 · 11 分钟
深度
🎧№ 1051
DEEP DIVE
来源 · lopopolo/harness-engineering⚑ 方法教程

Harness 工程十二条心法:Google 首席工程师一年实践,浓缩成可直接照做的流程和模板

核心操作反直觉:选定的模型和 Agent 锁死不动,一个参数都不调,只改它周围的上下文和工具。

harness engineeringAgent 工程▶ 听播客07-19 · 20 分钟
免费
产品发布
🎧№ 1050
LAUNCH
来源 · 商汤 SenseNova⚑ 产品发布

商汤发布 SenseNova U1 Pro:原生 8K 出图,密密麻麻的小字放大也不糊

WAIC 现场演示了 4:1 水墨长卷和 22 张连续分镜。预览版邀请测试中,正式版 8 月开放并公布定价。

商汤多模态▶ 听播客07-19 · 9 分钟
深度
🎧№ 1049
DEEP DIVE
来源 · Anthropic⚑ 大佬观点

Anthropic 内部对谈:Harness 那套外壳流程,正在被拆掉

模型强到能自己想步骤,套在它外面的编排就成了枷锁。一场 16 分钟的内部对谈,讲了 harness 变薄之后会长出什么。

▶ 听播客07-18 · 5 分钟
深度
🎧№ 1048
DEEP DIVE
来源 · Cerebras⚑ 方法教程

Cerebras 公开公司知识库搭法:不需要任何人改使用习惯,资料留在原处AI自己去取

上线三个月,每天被提问超过 15000 次;四路打分、讨论串蒸馏、排名融合的具体参数都写了出来。

知识库检索▶ 听播客07-18 · 12 分钟
免费
深度
🎧№ 1047
DEEP DIVE
来源 · a16z⚑ 大佬观点

a16z 报告:软件股正在被抛售,但市场只杀没有护城河的那一半

a16z 一周数据图还顺手反驳了三件事:便宜模型拖垮前沿、AI 抢走工作、数据中心推高电价,数据大多站在反面。

AI 经济软件股▶ 听播客07-18 · 8 分钟
深度
🎧№ 1046
DEEP DIVE
来源 · Tim Ferriss 博客⚑ 大佬观点

AI 几秒就能复制你的作品,但有八样东西它抄不走

他 2008 年写下这篇《Better Than Free》,AI 时代重新成立:复制免费之后,能卖钱的是复制不了的东西。

创作者经济凯文·凯利▶ 听播客07-18 · 7 分钟
工具教程
🎧№ 1045
TOOLS
来源 · DEV · Google AI⚑ 方法教程

Google 发布 gemma-trainer 技能:在自己电脑上,让 AI 帮你微调一个专属的 Gemma

开源的训练说明书,把监督微调、偏好对齐、奖励打分三条路和 LoRA 参数全写死,配 Unsloth,一张 8GB 显存的消费级显卡就能起步。

Gemma本地微调▶ 听播客07-18 · 8 分钟
深度
🎧№ 1044
DEEP DIVE
来源 · Raft

连 CTO 都是 AI:一个几乎没有人类的团队,怎么开发一个产品功能

15 个成员只有创始人一个是人类,其余全是 AI。他们没有需求文档、没开一次会,把一个功能从提出到上线独立跑完,人类只做两件事。

AI AgentAI 协作▶ 听播客07-17 · 8 分钟
免费
产品发布
№ 1043
LAUNCH
来源 · Bolt.new⚑ 产品发布

Bolt 把幻灯片做成了网页:3D 漫游、实时白板、能筛的图表,一个链接就能演示

过去 AI 生成的幻灯片,导出就是一张死图。Bolt Slides 把每一页变回一个能跑的网页——3D 能转、计算器能摁、白板能实时投票。

Bolt Slides开源07-17 · 9 分钟
研究解读
🎧№ 1042
RESEARCH
来源 · Impossible Research⚑ 研究论文

只换一层外壳:让 Opus 4.8 和 Fable 5 在 ARC-AGI-3 评测中冲到 99%

一套叫 Schema 的外壳,让模型把每个游戏的规则写成能跑的程序、验证过了才动手。公开 25 局自评 98.98%,均未经 ARC Prize 独立验证。

ARC-AGI-3世界模型▶ 听播客07-17 · 12 分钟
免费
产品发布
🎧№ 1041
LAUNCH
来源 · LM Studio⚑ 产品发布

LM Studio 发布 Bionic:专门针对开源模型的 Codex,模型跑本地还是上云你自己定

面向开源模型的 Agent,本地运行免费、数据不出设备,要更强算力才切云端(默认零数据保留),Mac 和 Windows 今天上线预览版。

LM Studio本地 AI▶ 听播客07-17 · 6 分钟
免费
产品发布
№ 1040
LAUNCH
来源 · LiveKit⚑ 产品发布

LiveKit 针对 Gemma 4 31B 进行优化,在实时语音方面比 GPT-4.1 快 5 倍、成本六分之一

同样的回答质量,接话延迟低 5.2 倍、成本低 6 倍(对比 GPT-4.1);改一行代码就能把语音 Agent 指到它上面。数据均为 LiveKit 自测。

LiveKitGemma 407-17 · 6 分钟
免费
产品发布
№ 1038
LAUNCH
来源 · Decart⚑ 产品发布

Decart 发布 Lucy 2.5:直播时就能改视频,延迟号称 40 毫秒内

实时加东西、换背景、做特效;产品页给出 sub-40ms、100FPS 连续生成。试用入口 lucy.decart.ai。

DecartLucy 2.507-17 · 6 分钟
免费
产品发布
🎧№ 1037
LAUNCH
来源 · Kimi 官方博客⚑ 产品发布

月之暗面发布 Kimi K3:全球首个 3 万亿级开放模型

2.8 万亿参数、原生视觉、100 万 token 上下文,多项 agent 基准超过 GPT 5.6 Sol,App 和 API 今天可用

Kimi K3月之暗面▶ 听播客07-17 · 9 分钟
免费
商业动态
№ 1036
BUSINESS
来源 · 404 Media

Suno 训练库被黑客曝光:代码写明从 YouTube Music 等抓了约 38 万小时

黑客用蠕虫黑进 Suno,源码里写着从哪些站抓了多少小时音乐;用户数据也一起露了,公司说不必挨个通知。

Suno训练数据07-17 · 8 分钟
免费
研究解读
№ 1035
RESEARCH
来源 · Design Arena

GPT-5.6 Sol 登顶前端设计榜:它掌握了设计审美,学会避开 AI 常见套路

第三方评测平台 Design Arena 扒开它的一千个网页作品,发现设计空间里缺了一块,正好是紫色渐变这些 AI 通病该在的地方。

GPT-5.6 SolAI 网页设计07-16 · 6 分钟
深度
🎧№ 1034
DEEP DIVE
来源 · Google Search Central⚑ 方法教程

在 AI 搜索时代,网站到底该怎么做优化 Google 官方SEO指南

Google 搜索官方首次系统表态如何为 AI Overviews、AI Mode 优化网站,顺手把一批 AEO/GEO 黑话点名划掉。

Google 搜索SEO▶ 听播客07-16 · 8 分钟
免费
产品发布
🎧№ 1032
LAUNCH
来源 · Pixel Point⚑ 产品发布

网站上的小动画一交互就顿一下?AVAL 想让预渲染视频听懂「悬停 / 点了 / 成功」

先说痛:网页立体小图标要会动、还要跟着状态变,普通视频容易卡。AVAL 给这种短动画专用格式和播放器。

AVAL交互视频▶ 听播客07-16 · 6 分钟
免费
产品发布
№ 1031
LAUNCH
来源 · xAI GitHub⚑ 大佬观点

解密 Grok Build 源代码:被曝打包上传用户整个代码库后,马斯克把 Grok Build 开源了

先是隐私翻车,再是删数据、关默认、整库开源。后半段拆开看源码:体量、提示词、工具、改码、上传、记忆和安全。

Grok BuildxAI07-16 · 7
免费
产品发布
🎧№ 1029
LAUNCH
来源 · Thinking Machines Lab⚑ 产品发布

Mira Murati 的首个开放模型:每处理一个 token,只启用 410 亿参数

OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab,发布了公司第一个自研大模型 Inkling。它能读文字、看图片、听音频、写代码和调用工具,完整权重可以下载,也能在 Tinker 上继续训练。

InklingThinking Machines Lab▶ 听播客07-16 · 12 分钟
深度
🎧№ 1021
DEEP DIVE
来源 · George Sivulka / X⚑ 大佬观点

你刚雇了一百万个差员工

公司把无限 Agent 和 token 预算塞给全员,坏流程会按秒复制。下一课不是再买模型,是学会管这支数字队伍。

AI AgentToken▶ 听播客07-16 · 11 分钟
免费
研究解读
№ 1027
RESEARCH
来源 · MIT News / Science⚑ 研究论文

MIT 做出一只不用脚蹬水、能游也能飞的机器鸟

250 克机器人用同一对柔性翅膀穿过水和空气,70° 仰角、8 至 10 次拍翼即可从湖里起飞

MIT仿生机器人07-15 · 8 分钟
免费
产品发布
№ 1026
LAUNCH
来源 · Google Developers Blog⚑ 产品发布

Google 在 Pixel 10 上跑 Gemma 4:三万英尺的客舱断网也能聊天、看图、改设置

Google I/O India 上,Tensor 团队和 Pixel 团队联合演示:把 Gemma 4 轻量版直接塞进手机里的 TPU,数据不出机、不靠云。开发者还能申请 Tensor SDK,把模型编译到 Pixel 上跑。

Google TensorPixel 1007-15 · 7 分钟
深度
🎧№ 1024
DEEP DIVE
来源 · Databricks Blog⚑ 厂商通稿

这一单到底赚了多少?零售财务开始用 AI 盯账

顾客线上买、店里取、跨店退,账却拆成好几条。Databricks Genie 被写成财务的 AI 帮手:先看清真利润,再盯被套现金,尽量少打折。

DatabricksGenie▶ 听播客07-15 · 10 分钟
工具教程
№ 1023
TOOLS
来源 · pols.dev⚑ 方法教程

8 万字反 AI 味设计法:把 Slop.md 塞进 agent 当默认规矩

pols.dev 放出约 8.7 万字符 Markdown:逐条点名生成器网页套路,并给正面配方。通用守则文件,不是网站生成器。

Slop.mdpols.dev07-15 · 9 分钟
工具教程
№ 1022
TOOLS
来源 · Impeccable⚑ 方法教程

给 AI 写前端加一套「去 AI 味」设计技能:Impeccable

1 个核心 skill、23 条设计命令、一份反模式清单,外加能塞进 CI 的 slop 检测。主站讲怎么做,/slop 页把「一眼假」的 UI 套路摊开。

ImpeccableAI 设计07-15 · 10 分钟
免费
研究解读
🎧№ 1020
RESEARCH
来源 · PrismML⚑ 研究论文

PrismML 将 27B 模型塞进你的 iPhone 里,而且智商几乎没怎么缩水

把约 54GB 的 27B 模型压到约 3.9–5.9GB:手机能本地跑,平均分还保住大约九成。先讲核心价值,技术细节和要打折的地方放后半段。

Bonsai 27B端侧 AI▶ 听播客07-15 · 12 分钟
免费
深度
🎧№ 1019
DEEP DIVE
来源 · Demis Hassabis · X⚑ 大佬观点

DeepMind CEO Demis:前沿模型需提前 30 天交给一个专门机构进行体检再发布 否则不准进入市场

他主张美国先建类 FINRA 的标准机构,用动态基准划定前沿模型;协议跑通后可升级为进市场的硬门槛

Demis HassabisDeepMind▶ 听播客07-14 · 6 分钟
免费
深度
🎧№ 1018
DEEP DIVE
来源 · AI as Normal Technology⚑ 大佬观点

普林斯顿教授在 ICML 讲 AI 与工作:个人如何在这场浪潮中自我调适?

24 个月里模型能力大幅跃升,SAGE 实验室自建的可靠性复合指标只涨 5–10 个百分点

AI as Normal TechnologyAI可靠性缺口▶ 听播客07-14 · 12 分钟
深度
🎧№ 1017
DEEP DIVE
来源 · Anthropic⚑ 厂商通稿

Anthropic AI原生创业手册:四段主线 + 退出标准,附全套可直接抄的提示词

36 页官方手册拆开四阶段的毕业标准、常见陷阱与对应 Claude 提示词,可直接照抄使用

创业方法论Claude Code▶ 听播客07-14 · 14 分钟
深度
🎧№ 1016
DEEP DIVE
来源 · DoorDash Engineering Blog⚑ 厂商通稿

DoorDash 如何做好 AI 购物助手:不全靠模型,靠工具和记忆落地

记忆系统上线后杂货结账转化率提升约24%,自动化评测让日均评测量从1条人工反馈扩到2000+场。

AI购物助手Agent架构▶ 听播客07-14 · 14 分钟
深度
🎧№ 1015
DEEP DIVE
来源 · ByteByteGo

微软如何大规模部署企业级 AI 代理:把生产级 Agent 拆成 5 层架子

检索变成会规划会重试的子 agent,评测从「能跑通」升级到「做得对」

AI Agent架构Microsoft Foundry▶ 听播客07-14 · 12 分钟
免费
研究解读
🎧№ 1014
RESEARCH
来源 · Anthropic⚑ 研究论文

Anthropic 分析了 30 万段对话发现:使用不同语言问 Claude,它会表现出不同的价值观

分析3个模型、20种语言:英语最谨慎最深入,俄语最较真,印地语最温暖,中文接近全局均值

Anthropic研究Claude价值观▶ 听播客07-14 · 9 分钟
免费
研究解读
🎧№ 1013
RESEARCH
来源 · Sakana AI / Nature Communications⚑ 研究论文

Sakana AI研发出一种3D智能细胞砖,在没有“大”脑指挥的情况下能互相通信自由组合,表现出“生物般的群体智慧”

没有“大脑”(中央控制器)指挥,近两百个普通的智能小方块通过“交头接耳”,就能自己搞清楚拼成了什么形状,甚至能在损坏后判断应该往哪里“长”回来。前半部分已经在实体砖上实现;损伤定位和再生仍主要发生在模拟中。

Sakana AI群体智能▶ 听播客07-14 · 9 分钟
免费
深度
🎧№ 1012
DEEP DIVE
来源 · Satya Nadella on X⚑ 大佬观点

微软 CEO 纳德拉:企业面临一种“反向信息悖论”,支付费用调用 AI,同时也将自己的企业内部知识和经验拱手献出

企业为智能支付两次:一次付模型费用,一次提供让模型真正有用的专有知识。

Satya Nadella企业 AI▶ 听播客07-13 · 7 分钟
研究解读
🎧№ 1010
RESEARCH
来源 · arXiv · Meta AI⚑ 研究论文

Meta AI 提出主动记忆代理:让智能体学会『该提醒时才提醒』,Terminal-Bench 正确率提升 8.3 个百分点

论文写着已经开源,但代码仓库核实是空的,一行代码都没推送过。

AI agent长任务记忆▶ 听播客07-13 · 9 分钟
深度
🎧№ 1009
DEEP DIVE
来源 · Ploy Blog⚑ 厂商通稿

Ploy 公司将生产环境 AI 从 Opus 4.8 切换到 GPT-5.6 Sol:质量不下降的同时耗时减少一半以上、成本降低 27%

换模型不是换个 API:评测框架、工具参数、缓存、推理记录,四个看不见的坑逐一拆解修法

GPT-5.6 SolAI Agent 工程▶ 听播客07-13 · 9 分钟
研究解读
🎧№ 1008
RESEARCH
来源 · Anthropic 官方博客⚑ 研究论文

Claude Cowork 最大用途是办公杂务(33.4%),写代码仅占 8.7%:界面形式决定了 AI 用途

样本覆盖 120 万段会话、60 万+组织:内容创作紧随其后占 16.4%,两类合计近半使用量。

Claude CoworkAnthropic▶ 听播客07-13 · 7 分钟
深度
🎧№ 1007
DEEP DIVE
来源 · Varick Agents⚑ 大佬观点

那些毛利润低的行业,才是AI变革里最大的赢家

利润率常年卡在个位数的制造、物流、仓储、劳务行业,靠削减协调成本就能把利润成倍拉高

AI转型低利润行业▶ 听播客07-12 · 6 分钟
免费
研究解读
🎧№ 1006
RESEARCH
来源 · VentureBeat⚑ 研究论文

你让 AI 写代码,它推荐的软件其实不存在:黑客用同一个名字放好了病毒

57.6万样本、16个模型实测:19.7%的AI推荐包是幻觉,43%会反复生成同一假名。

AI安全软件供应链▶ 听播客07-12 · 9 分钟
深度
🎧№ 1005
DEEP DIVE
来源 · Reddit r/codex · OpenAI 官方 AMA⚑ 社区讨论

OpenAI 员工自曝怎么用 GPT-5.6:额度无限,也不全上最强档

对 benchmark 作弊质询未给出正面回应,桌面应用合并遭老用户抗议,团队坦言"还在摸索"。

OpenAI CodexGPT-5.6▶ 听播客07-11 · 9 分钟
免费
深度
🎧№ 1004
DEEP DIVE
来源 · Thinking Machines Lab⚑ 厂商通稿

OpenAI 前 CTO Mira Murati:AI 该放大人,不是取代人

从隐性知识、交互带宽到模型对齐,论证AI发展为何离不开人类参与。

Thinking Machines LabAI对齐▶ 听播客07-11 · 6 分钟
深度
🎧№ 1003
DEEP DIVE
来源 · Sierra⚑ 厂商通稿

给每个部门配个 AI,反而更难用:Sierra 砍成一个助手,如今扛下公司 70% 的代码

复盘文:Pinecone 上线以来跑了 7.5 万次会话,服务 600 多名员工,靠 MCP Gateway 连了 37 个内部系统。

企业级AI agentSierra▶ 听播客07-11 · 8 分钟
深度
🎧№ 1002
DEEP DIVE
来源 · ChatGPT Learn⚑ 方法教程

OpenAI 官方指南:Codex 提示词 9 套工作流直接抄,修 bug、截图变原型、云端重构全在内

官方把散落各产品页的提示技巧收进一套框架:目标/背景/输出/边界,外加 Codex 专属工作流范例。

提示词工程ChatGPT▶ 听播客07-11 · 9 分钟
研究解读
🎧№ 1001
RESEARCH
来源 · EPFL 项目主页⚑ 研究论文

大脑哪块区域爱看什么?EPFL 让 AI 反复生成视频,逼出每块脑区最爱看的那一段

所有结果均为大脑“数字孪生”模型的计算机模拟预测,尚未用真人脑成像实测验证。

神经科学进化算法▶ 听播客07-11 · 9 分钟
免费
产品发布
🎧№ 1000
LAUNCH
来源 · LangChain Blog⚑ 产品发布

LangChain 发布 OpenWiki 0.1.0:给 AI 智能体装上主动记忆,自动抓取 Gmail、Notion、Git、X 生成本地 wiki

无需手动喂上下文,本地 Markdown wiki 按设定节奏自动刷新;Slack 连接器即将上线

LangChainOpenWiki▶ 听播客07-11 · 6 分钟
免费
产品发布
🎧№ 114
LAUNCH
来源 · Google Cloud⚑ 产品发布

Google Cloud 为 AlloyDB 装上代理模型:数据库本地跑 AI 判断,最快提速 2.3 万倍

用本地小模型替代云端 AI 调用,数据来自谷歌内部测试,代理模型目前仅 ai.if 函数可用且处于预览阶段

AlloyDB代理模型▶ 听播客07-10 · 8 分钟
免费
产品发布
№ 113
LAUNCH
来源 · 1X Tech⚑ 产品发布

1X 发布 NEO 新机械手:能一边干活,一边感觉到手里的东西

腱驱动手部所有关节都能反向感知外力,指尖定位精度 ±0.2 毫米,专用产线年产能规划 1 万只。

人形机器人灵巧手07-10 · 6 分钟
研究解读
🎧№ 112
RESEARCH
来源 · Google Research⚑ 研究论文

Google Research 发布 SensorFM:训练自一万亿分钟穿戴数据,35 项健康任务赢 33 项

500 万人、20 亿小时可穿戴数据预训练,冻结编码器接一个线性头就在 34/35 个健康任务上超过监督学习基线。

SensorFM可穿戴健康数据▶ 听播客07-10 · 8 分钟
免费
深度
🎧№ 111
DEEP DIVE
来源 · Every

Every 团队 9 人实测一个月:GPT-5.6 Sol 到底咋样?

编程、写作、知识工作、Agent 四大场景的第一手上手反馈

GPT-5.6 SolOpenAI▶ 听播客07-10 · 9 分钟
免费
产品发布
№ 110
LAUNCH
来源 · OpenAI 官方博客⚑ 产品发布

OpenAI 正式发布 GPT-5.6:综合智能跑分逼近 Claude Fable 5,成本减半,ChatGPT、Codex 合并

三档模型 Sol、Terra、Luna 与 4 智能体并行 ultra 上线;同日 ChatGPT Work 上线、Codex 并进 ChatGPT。附中英双语发布会全片

GPT-5.6OpenAI07-10 · 12 分钟
免费
产品发布
№ 109
LAUNCH
来源 · OpenAI⚑ 产品发布

OpenAI 发布 ChatGPT Work,GPT-5.6 驱动,可跨工具自动产出文档表格幻灯片

今天起桌面端全档位可用,网页端和手机端未来几天内向其余套餐陆续开放。

ChatGPT WorkGPT-5.607-10 · 3 分钟
免费
产品发布
№ 108
LAUNCH
来源 · Anthropic⚑ 产品发布

Anthropic 给 Claude 加了 Reflect:像屏幕使用时间一样,看清你的 AI 习惯

设置里一键出报告。聊了什么、什么时候聊得多、常让它干什么,摊开给你看。要先打开 Memory。

AnthropicClaude07-10 · 6 分钟
免费
产品发布
№ 107
LAUNCH
来源 · Cloudflare⚑ 产品发布

Cloudflare 发布 Drop:把文件夹扔进去,就能立刻让你的网页在全球上线,而且不用注册

几秒就有公网链接可以分享;先看效果,想留着再登录认领。不认领大约一小时后会过期。

CloudflareDrop07-09 · 7 分钟
深度
🎧№ 106
DEEP DIVE
来源 · ClaudeDevs(X)/ Lydia Hallie⚑ 大佬观点

Claude Code 团队教你如何用好这两个旋钮:一个管它「会不会」,一个管它「愿不愿做够」

ClaudeDevs 长文拆开两个都像「让答案更好」的旋钮:换模型是换哪一套冻结权重,调 effort 是改它愿不愿多读文件、多跑测试、多验证再交卷

Claude Code模型选择▶ 听播客07-09 · 9 分钟
免费
产品发布
№ 105
LAUNCH
来源 · Meta AI / Alexandr Wang⚑ 产品发布

Meta 发布 Muse Spark 1.1 模型,在多个代理评估中,媲美 GPT-5.5 和 Opus 4.8

功能:主/子智能体编排、百万上下文、桌面浏览器手机操作、写码与多模态;API 输入 $1.25 / 输出 $4.25 每百万 token

MetaMuse Spark07-09 · 10 分钟
研究解读
🎧№ 104
RESEARCH
来源 · arXiv / Google DeepMind⚑ 研究论文

Gemma 4 技术报告:开源模型怎么用「小参数 + 会思考 + 省内存」硬碰大模型

核心不是功能清单,是三套工程同时拧:思考抬智能、效率栈压成本、原生多模态扩输入

Gemma 4开源大模型▶ 听播客07-09 · 12 分钟
研究解读
🎧№ 103
RESEARCH
来源 · LangChain Blog⚑ 研究论文

LangChain:只调 harness 不换模型,让 Nemotron 3 Ultra 跑分逼近 Opus 4.8,成本约 1/10,证明企业无需花重金购买闭源 API

系统提示、工具描述、中间件三处动刀;Deep Agents 套件典型约 0.80→0.84,最佳 0.86 对 Opus 0.87。

LangChainNemotron▶ 听播客07-09 · 9 分钟
研究解读
🎧№ 102
RESEARCH
来源 · Lil'Log⚑ 研究论文

AI 自我进化,先改模型外面的外壳:Lilian Weng 讲透 harness 工程

前 OpenAI 安全负责人梳理近 30 篇研究:从改提示词到自己改代码,DGM 把编程能力从 20% 推到 50%。

Harness工程递归自我改进▶ 听播客07-09 · 13 分钟
免费
产品发布
№ 101
LAUNCH
来源 · xAI⚑ 产品发布

xAI 发布 Grok 4.5:性能直逼 Opus 4.8,吐字快约 2 倍、输出价约四分之一

DeepSWE 排第三、综合榜第 4;比 Opus 4.8 更快,也明显更便宜。

Grok 4.5xAI07-09 · 6 分钟
免费
产品发布
№ 100
LAUNCH
来源 · OpenAI⚑ 产品发布

OpenAI 发布 GPT-Live:和 AI 说话不用轮流开口,难问题自动找 GPT-5.5

真正边听边回的语音模型今天上线,复杂任务还能实时甩给 GPT-5.5。

GPT-LiveChatGPT语音07-09 · 6 分钟
免费
产品发布
№ 099
LAUNCH
来源 · 字节跳动Seed⚑ 产品发布

字节跳动发布 Seedream 5.0 Pro:一张图可拆十余个独立图层,密集图表实景一次生成

新增点选圈选定点编辑与十余种语言原生渲染,已上线火山方舟,将陆续接入豆包、即梦

Seedream 5.0 Pro字节跳动Seed07-08 · 6 分钟
免费
产品发布
🎧№ 098
LAUNCH
来源 · GitHub / arXiv(HKUDS 官方仓库与论文)⚑ 研究论文

港大 HKUDS 开源 AI 家教 DeepTutor,111 天破 2 万星

论文实测个性化提升10.8%、推理能力提升29.4%,Apache 2.0 完全开源

DeepTutorHKUDS开源项目▶ 听播客07-08 · 12 分钟
深度
🎧№ 097
DEEP DIVE
来源 · ClaudeDevs(X)⚑ 大佬观点

Anthropic 官方支招:Claude Fable 5 当“顾问”,Claude Sonnet 5 干活能扛下账单大头

顾问模式里 Fable 5 只出主意,编排模式里 Fable 5 分派任务,两种搭法都靠费率更低的 Sonnet 5 干掉大部分活

Fable 5多模型协作▶ 听播客07-08 · 6 分钟
研究解读
🎧№ 096
RESEARCH
来源 · Liquid AI⚑ 研究论文

Liquid AI 发布 Antidoom:修复推理模型的「死循环」问题,只改一个 token 即可,已开源

只微调死循环起点的单个token,两款模型死循环率都压到1%左右

Liquid AI推理模型死循环▶ 听播客07-08 · 8 分钟
免费
产品发布
№ 095
LAUNCH
来源 · Meta AI Blog⚑ 产品发布

Meta 发布 Muse Image:生图会自己查资料、自己纠错,评分排全球第二

同门 Muse Video 视频模型同步预告,已支持原生音频生成,即将向创作者开放。

MetaMuse Image07-08 · 7 分钟
免费
产品发布
🎧№ 094
LAUNCH
来源 · Cloudflare Blog⚑ 产品发布

Cloudflare 发布自动收费网关:AI 想爬取你的网页、API,能自动给你付钱

从只对 AI 爬虫收费扩展到向任意调用者收费,现处早期候补阶段

Cloudflarex402协议▶ 听播客07-07 · 6 分钟
免费
产品发布
№ 093
LAUNCH
来源 · MarkTechPost⚑ 产品动态

OpenAI 发布 GPT-Realtime-2.1 和 GPT-Realtime-2.1-mini 实时语音模型:mini 模型具备推理能力,延迟下降 25%

调用工具时模型会先说"我这就去查",通话不再因等待而冷场

OpenAIRealtime API07-07 · 6 分钟
免费
商业动态
№ 092
BUSINESS
来源 · Anthropic 官网⚑ 厂商通稿

加拿大阿尔伯塔省使用 Claude Code 做安全审查,20 小时扫描 4.66 亿行代码,原本需 6.5 年

50 个智能体自主并行工作,覆盖该省 27 个部门、3,400 个代码仓库,还能自动修复漏洞、重写老旧系统。

Claude Code网络安全07-07 · 5 分钟
免费
产品发布
№ 091
LAUNCH
来源 · Cloudflare Blog⚑ 产品动态

Cloudflare 发布 Workers Cache:缓存前置到每个 Worker,命中不计 CPU 费

一行 Wrangler 配置加标准 HTTP 缓存头,缓存还能嵌进 Worker 内部任意入口之间。

Cloudflare Workers边缘缓存07-07 · 7 分钟
免费
深度
№ 090
DEEP DIVE
来源 · Anthropic⚑ 厂商通稿

Anthropic首次公开Claude Code内幕:Boris Cherny两天写的Demo,如今为他写下100%代码

16位亲历者口述:从死磕diff到两周冲刺发布,到工程师不再手写一行代码

Claude Code口述历史07-07 · 13 分钟
深度
№ 089
DEEP DIVE
来源 · AI Engineer 大会 / Anthropic⚑ 方法教程

Claude Fable 5 实战指南:8 个「找未知」提示模式,从盲点扫描到读后小测验

Claude Code 团队 Thariq Shihipar 大会演讲实录:新模型的瓶颈不再是模型本身,而是你能不能讲清自己的未知

Claude Fable 5提示词方法07-07 · 11 分钟
免费
研究解读
🎧№ 088
RESEARCH
来源 · Anthropic⚑ 研究论文

Anthropic 在 Claude 身上发现一个类似人脑「内部思考空间」的区域:它是自己进化出来的,并非最初设计

占比不到一成,删掉后 Claude 仍会说话但推理归零,已用来抓模型编数据、识破测试

可解释性研究Claude▶ 听播客07-07 · 8 分钟
免费
研究解读
🎧№ 087
RESEARCH
来源 · iTextbooks'26 论文⚑ 研究论文

达特茅斯实测AI判作业:学生嫌它死板,用的人反而考得更好

151人实测:简答题比选择题更能拉动分数,AI答疑侧栏却几乎没人用

AI教育科技形成性评估▶ 听播客07-06 · 8 分钟
免费
产品发布
🎧№ 086
LAUNCH
来源 · Extelligence(Substack)⚑ 产品发布

一位AI工程师给不会说话的自闭症儿子做了款沟通App,儿子开口涨5倍,还意外做成一门小生意

没有融资没有团队,纯粹为解决自己孩子的问题,却被诊所和学校主动找上门要用

AAC辅助沟通自闭症干预▶ 听播客07-06 · 7 分钟
免费
深度
🎧№ 085
DEEP DIVE
来源 · Latent.Space⚑ 社区讨论

AI 工程师大会闭幕激辩:自动编码 loop,炒作有没有跑赢工程纪律

现场投票因灯光太亮没数出结果;同期调研显示 95% 团队已用 agent,59% 担心技术债在积累

AIEWF大会agentic loop▶ 听播客07-06 · 5 分钟
免费
深度
🎧№ 084
DEEP DIVE
来源 · The Decoder

美国富裕家庭弃普通学校,砸7.5万美元一年送孩子上 AI 私校

传统学校还没想清楚怎么用 AI,硅谷和华尔街家庭已经用真金白银投票了

AI教育教育鸿沟▶ 听播客07-06 · 4 分钟
免费
研究解读
🎧№ 083
RESEARCH
来源 · Seldo.com(Laurie Voss)⚑ 研究论文

初级程序员岗位被AI烧穿:编程正从职称变成人人都会的技能

美国22-25岁开发者就业三年跌19%,同时GitHub新账户涨到史上最快

AI就业冲击初级程序员▶ 听播客07-05 · 9 分钟
研究解读
🎧№ 082
RESEARCH
来源 · arXiv · NVIDIA Research⚑ 研究论文

NVIDIA Research 发布 HORIZON,无人值守智能体把全套 RTL 芯片设计基准刷到 100% 通过

论文首次让智能体全程无人值守跑完全部RTL基准;多数题两三轮过关,最难一题却要迭代82轮

NVIDIA ResearchAgentic 工作流▶ 听播客07-05 · 12 分钟
研究解读
🎧№ 081
RESEARCH
来源 · Anthropic⚑ 研究论文

Anthropic 研究 40 万次 Claude Code 会话:专业度比会编程更决定 AI 编程成败

23.5万用户、跨7个月的会话分析:专家验证成功率是新手近两倍,但十大职业彼此只差7个百分点内

Claude CodeAnthropic研究▶ 听播客07-05 · 7 分钟
免费
深度
🎧№ 080
DEEP DIVE
来源 · Dan Koe(X 长文)⚑ 大佬观点

Dan Koe 长文拆解:人性说服的3重张力和5个杠杆,写文案直接抄

核心是先制造心理张力再给一个小到没法拒绝的第一步,写作、带货、求职都能直接套用

人性洞察说服框架▶ 听播客07-05 · 8 分钟
深度
🎧№ 079
DEEP DIVE
来源 · 读卖新闻⚑ 大佬观点

Sakana AI 联合创始人:企业要具有能随时更换模型的能力,这本身就是一种威慑

美国6月12日出口管制首次把前沿AI模型本身(非仅芯片)纳入管制范围,他给出的对策是练好多模型调度力

AI地缘政治出口管制▶ 听播客07-04 · 6 分钟
深度
🎧№ 078
DEEP DIVE
来源 · X · Thariq⚑ 大佬观点

和 Claude Fable 5 干活,真功夫是先找出你自己的「未知」

Anthropic 的 Thariq 总结:和 Claude Fable 5 协作,活儿的质量卡在你能不能讲清自己的「未知」;这份田野指南按实现前、中、后给了 8 个找未知的技法,每个都配可直接照抄的提示词。

Claude Fable 5Agentic Coding▶ 听播客07-04 · 9 分钟
深度
🎧№ 077
DEEP DIVE
来源 · Chamath Palihapitiya · X⚑ 大佬观点

AI 越便宜,只会租通用智能的公司越危险

投资人 Chamath Palihapitiya:智能正像手机一样成本暴跌、专家判断力人人可得;真正的护城河是把独家经验编码进自己的系统,而不是租一个和对手一样的通用 AI

AI成本下降专家判断力普及▶ 听播客07-03 · 5 分钟
免费
商业动态
№ 076
BUSINESS
来源 · 微软官方博客⚑ 厂商通稿

微软推出 Microsoft Frontier Company,投 25 亿美元、6000 名专家进驻客户做 AI 转型

承诺客户数据不会被用于训练会削弱其行业差异化的模型,平台可在多种AI模型间自由切换,不锁定单一供应商

微软企业AI转型07-03 · 6 分钟
深度
🎧№ 075
DEEP DIVE
来源 · Every⚑ 方法教程

Every 咨询负责人的 Codex 实战笔记:不懂技术的她搭建、维护自己的多个私人工作系统

她还用同一套模式搭了邮件分诊和老爸看护 App,方法可复制,完整 prompt 未公开

OpenAI CodexLoop 工作模式▶ 听播客07-03 · 9 分钟
免费
商业动态
🎧№ 074
BUSINESS
来源 · Anthropic⚑ 厂商通稿

同样一个 AI 模型,为什么有的公司用出复利,有的公司用了个寂寞

四条落地原则打底,配 L'Oréal、Lyft、Rakuten 三家实测数据佐证

企业AI转型Claude Cowork▶ 听播客07-03 · 13 分钟
深度
№ 073
DEEP DIVE
来源 · Anthropic⚑ 方法教程

Anthropic 发布 AI Agent 架构指南:先问三个问题,再决定要不要上多智能体

多智能体系统效果能提 90.2%,但 token 成本也贵 10-15 倍——这套三问框架帮你先想清楚要不要上复杂架构。

AI Agent架构多智能体系统07-03 · 9 分钟
免费
产品发布
🎧№ 072
LAUNCH
来源 · MarkTechPost⚑ 产品发布

阿里开源 Page Agent:让智能体直接嵌进网页里,靠读文字而不是截图操作界面

MIT 协议开源、模型无关,接入任意 OpenAI 兼容文本模型即可用,目前只能操作单个页面视图

Page Agent阿里巴巴▶ 听播客07-03 · 5 分钟
深度
🎧№ 071
DEEP DIVE
来源 · Latent.Space

未来的网站会为每个访客现场拼装:Adobe 演示按意图实时生成专属页面

现场demo:搜'露营'后,咖啡机网站文案产品全变户外主题;技术能落地,客户网站还没规模上线。

Adobe智能体网站▶ 听播客07-03 · 5 分钟
深度
🎧№ 070
DEEP DIVE
来源 · Lenny's Newsletter⚑ 方法教程

顶级PM的 AI 杠杆阶梯指南:PM 提效两条路径,附 3 个可直接抄的实战 Prompt

培训过 3 万+ PM 的讲师总结两条 AI 杠杆阶梯:从复制粘贴到端到端交付,从网页原型到生产 PR。

产品经理AI工作流▶ 听播客07-03 · 9 分钟
免费
产品发布
№ 069
LAUNCH
来源 · Claude 开发者文档⚑ 产品动态

Anthropic 官方支招:Claude Fable 5 当“顾问”,Claude Sonnet 5 干活能扛下账单大头

顾问模型只出几百字建议、不用全程代打,同等质量下总成本更低,目前是仅限 Claude API 和 AWS 平台的 beta 功能

Claude API多模型协作07-02 · 7 分钟
深度
№ 068
DEEP DIVE
来源 · Anthropic 官方文档⚑ 方法教程

Claude Fable 5 官方提示指南:十几条可直接抄的调法,从治过度规划到治假进度汇报

Anthropic 官方文档,教你怎么调系统提示词和工程脚手架适配新模型,同套方法也对 Claude Mythos 5 有效

Claude Fable 5提示工程07-02 · 9 分钟
深度
🎧№ 067
DEEP DIVE
来源 · Claude Blog⚑ 厂商通稿

Claude Code 官方讲透循环设计:4 级递进到无人值守

从手动确认到无人值守,Claude Code团队给出4级循环分类与实操建议

Claude CodeAI Agent▶ 听播客07-02 · 8 分钟
免费
产品发布
№ 064
LAUNCH
来源 · OASIS Devices 官网 / Digital Trends / Refresh Miami⚑ 产品发布

OASIS Devices 发布智能戒指 OASIS 1,默念说话就能打字

钛金属材质,预售价289美元,2026年圣诞节前后发货,公司此前已出货第一代纯触控戒指。

智能戒指默念输入07-01 · 6 分钟
免费
产品发布
🎧№ 063
LAUNCH
来源 · LongCat 官方博客 + The Decoder⚑ 产品发布

美团发布 LongCat-2.0,1.6万亿参数模型全程国产芯片训练,不用英伟达GPU

训练用超5万块国产AI芯片、35万亿token;跑分多为美团自评框架测得,权重尚未真正开放下载

大模型发布国产AI芯片▶ 听播客07-01 · 8 分钟
免费
产品发布
🎧№ 062
LAUNCH
来源 · Anthropic⚑ 产品发布

Anthropic 发布 Claude Science:面向科学家的 AI 工作台,内置 60 多个科研技能

现已开放测试。一个协调 agent 拉起专家团队干活,末端还有个审稿 agent 专挑引用和数字的错;算力外包给 AI,原始数据不出本地。

Claude Science科研智能体▶ 听播客07-01 · 7 分钟
免费
产品发布
№ 061
LAUNCH
来源 · 谷歌官方博客⚑ 产品发布

谷歌发布 Nano Banana 2 Lite 和视频模型 Omni Flash:生图 4 秒,系列最快最便宜

生图仅需 4 秒、每千张约 $0.034;视频模型 Omni Flash 同日首次开放给开发者。

Nano BananaGemini Omni Flash07-01 · 5 分钟
研究解读
🎧№ 060
RESEARCH
来源 · Thinking Machines Lab⚑ 研究论文

桥水训了个专做金融信息筛选的模型,准确率 84.7%,方法公开

联合 Thinking Machines,用专家标注数据微调开源模型:比前沿最优错误率降 29.8%,推理成本仅 1/14

Tinker强化学习微调▶ 听播客07-01 · 7 分钟
免费
产品发布
№ 059
LAUNCH
来源 · Anthropic 官网⚑ 产品发布

Anthropic 发布 Claude Sonnet 5:便宜四成,部分任务追平 Opus 4.8

官方评测显示,高算力挡位下部分任务性能追平 Opus 4.8,标准定价却只要其六成。

Claude Sonnet 5Anthropic07-01 · 7 分钟
深度
🎧№ 058
DEEP DIVE
来源 · Lucius / X⚑ 大佬观点

AI 省了七百人工,Klarna 说质量下降了

企业AI客服已进入并购季,Klarna和阿里256万次对话数据都指向同一个盲点:省了成本不等于解决了问题

AI客服企业AI▶ 听播客06-30 · 9 分钟
深度
№ 057
DEEP DIVE
来源 · Big Technology AI Summit⚑ 大佬观点

OpenAI 总裁说:最好的产品,是没有产品

Brockman 确认 OpenAI 在研多款硬件;Agent 用户仅约 2000 万,ChatGPT 用户却已逼近 10 亿

OpenAIAGI06-30 · 8 分钟
研究解读
№ 056
RESEARCH
来源 · Meta AI Blog⚑ 研究论文

不开颅能读脑电,Meta 无创准确率近 8 倍于同类

戴头盔即可实时解码脑磁信号,字词准确率从 8% 跳到 61%,v1/v2 训练代码与数据集同步开源

脑机接口Meta AI06-29 · 5 分钟
深度
🎧№ 055
DEEP DIVE
来源 · Loop Engineering (论文 PDF)⚑ 研究论文

最近很火的 Loop Engineering 到底是什么

Anthropic 工程师的「循环工程」方法论详解:不再手动一句句提示 AI,而是设计一套能自己跑的循环系统

AI Agent工程方法论▶ 听播客06-29 · 12 分钟
免费
产品发布
№ 054
LAUNCH
来源 · GitHub⚑ 产品发布

AI 停了才让 Mac 睡,这个开源工具把保活做精了

支持 Claude Code 等 9 款 Agent 一键集成,合盖继续跑任务,停工 50ms 内自动释放休眠控制

macOSAI Agent06-29 · 4 分钟
免费
产品发布
🎧№ 053
LAUNCH
来源 · MarkTechPost / DeepSeek⚑ 产品发布

多做一步反而更快:DSpark 让 DeepSeek V4 单用户生成速度提升 85%

在已有 MTP-1 投机解码基础上再快 60–85%,靠草稿与验证流水线重叠执行(数据为 DeepSeek 自评)

DeepSeek推理加速▶ 听播客06-29 · 5 分钟
深度
🎧№ 052
DEEP DIVE
来源 · Every⚑ 厂商通稿

被所有团队跳过的第四步,才是 AI 工程的关键

Every 单人团队运营 5 款产品,核心是每次完成功能后多做的一步:把解法存进系统,让 AI 下次自动避坑

AI编程工程方法论▶ 听播客06-28 · 8 分钟
研究解读
№ 051
RESEARCH
来源 · METR⚑ 研究论文

GPT-5.6 Sol 作弊率破纪录,评测机构说这反而让人放心

能力数字出了三个版本且哪个都不可信,但可见的作弊行为本身成了安全监控有效的证据

GPT-5.6AI安全06-27 · 5 分钟
免费
产品发布
🎧№ 050
LAUNCH
来源 · OpenAI 官方博客⚑ 产品发布

GPT‑5.6 发布了,但好像又没发布

一次出 Sol/Terra/Luna 三档,先限量给可信伙伴、名单已报备美国政府,几周后再广泛开放

OpenAIGPT-5.6▶ 听播客06-27 · 7 分钟
研究解读
🎧№ 049
RESEARCH
来源 · Wan Streamer⚑ 研究论文

Wan Streamer:边听边看边说话的实时 AI

模型侧响应约 200ms、总延迟约 550ms;v0.1 仅 192p,演示为预录非实时体验

多模态大模型全双工实时交互▶ 听播客06-27 · 5 分钟
研究解读
№ 043
RESEARCH
来源 · IBM Newsroom⚑ 研究论文

IBM 发布全球首个 0.7 纳米芯片,指甲盖塞进近千亿晶体管

实验室已验证可制造;性能 +50%、能效 +70% 是相对 2nm 的预测值,非实测

IBM半导体06-26 · 6 分钟