产品发布
共 73 篇 · 按时间倒序
共 73 篇 · 按时间倒序
Claude Academy 公开了 Anthropic 的内部训练方法:入职学习 4D,在工作中持续练习,再按风险核验并为结果负责。
Claude Tag 开始跨消息理解 Slack 频道。表面看,这是上下文变多;真正改变的,却是它如何决定:要不要占用团队的注意力。
同一个基座,一个月的后训练,编码能力涨到开源第一,网络安全能力涨得连他们自己都没料到。
把一句话风格描述换成一份分段编曲说明书,两个模型分工守住五分钟不散架。
21 个权重的真实数值、三道决定曝光的关口,以及一张照参数推出来的发帖对照表
距离上一代只过了三周,底座没换,换的是推理算法。
219 个包、MIT 协议,你现有的 hooks 和技能能直接搬过去用
价格没涨,十项明细里另有故事;文末附一位用了几周的工程师整理出的提示词原句和用法。
220 亿参数,权重当天上 Hugging Face,ComfyUI 第一天支持——但「开源」有一条年营收 1000 万美元的线。
免费开源,Mac / Windows / Linux 都有;把文件拖进去就能微调,不用写一行代码
Cursor 的人用了几周,把好用的地方和那道信任门槛都写下来了
新增的核心只有两个类,四个现成环境全在仓库里跑得起来
以前要自己拼五个零件才做得出来,现在开箱即用;定价把最难预估的那两项直接做成了免费
源站一行代码不用改,Cloudflare 在边缘往每个 HTML 里塞一行脚本;但今天的 Chrome 稳定版还认不出这个接口——本站实测给你看。
Chromium 是给人做的——标签页、主题、扩展、60 帧滚动,Agent 一样都用不上。12 周,他们把这些全砍了重写一个。
模型手里只剩一个工具——一个不关机的 Python;长内容存成变量不再压缩丢掉;壳还能自己改自己。代价是:它在 Factorio 里学会了作弊。
全体员工用了三个月的东西整个开源,最值钱的是那套安全设计——审批可以晚点再给,Agent 不用停下来等你
边看边听边说同时进行,不再外挂一个只听静音的小模块;已在豆包 App 全量上线,免费
最长 20 秒、24 帧、原生 HD;三种调用方式共用一个接口;视频续写比从头生成贵 2.5 倍还短 5 秒。跑分是 BFL 自评。
人定限额、白名单、单笔上限,Agent 在护栏内自己花;每个钱包配一个人能读的身份,用户名今天开抢
「大脑」留在轻量环境,「双手」才调容器。仓库自测:删文件、遍历目录比真磁盘还快,拷大文件慢 41 倍。
视频生成第一次有了「全模态、开放权重、2K 原生」三样齐全的底座——但开源开到哪一段,值得看清
发布页几乎不晒跑分,晒的是无人插手干完的真活:16 天写完一个工程、5 天复现论文再超越、500 轮把芯片电路省掉 92%
即梦与豆包专业版当天上线,火山方舟 API 还没上,价格也没公布。
九项 Agent 测试全部反超自家更大的 V4-Pro 预览版,模型主干一个参数没改。
当大脑的那个模型今天就能调,免费档不要钱;真正指挥手脚的那个只给早期合作伙伴。
画布和点着改免费就能用,但把设计稿变成 App 要 Core 起,月付 25 美元。
改动幅度是 MCP 发布以来最大的一次,但 7 月 28 日不是切换开关:老实现照常互通。
最值得看的是那组对照实验:三个老模型加上同样的背景信息,成绩原地不动,其中两个还退了。
同价换来分数翻倍。这次发布页的图横轴是钱不是分,五档 effort 让你自己挑要多好、付多少。
视频线开放申请审批,图像线还要几周,开放权重排在最后。人评是官方标的初步结果,价格未公布。
面向客户侧与内部流程;今天对话通道先开语音和聊天。OpenAI 自用电话线自报 75% 不用真人;Codex 改进环 10 天再压 15 个百分点转人工
三款全在 Flash 线上:主力款少写三分之二的字,最便宜那档反而涨价六成,第三款只给政府用。
指令上限从 1k 提到 4.5k token,10px 小字可辨;百炼已能调用 qwen-image-3.0-pro,限时免费。
Business 和 Enterprise 套餐可用,按运行次数扣钱,一次 0.07 到 0.2 美元。
说话人相似度在 16 个语种上全部排第一,参考音带噪声也能克隆;这次只开放 API,不放权重。
WAIC 现场演示了 4:1 水墨长卷和 22 张连续分镜。预览版邀请测试中,正式版 8 月开放并公布定价。
过去 AI 生成的幻灯片,导出就是一张死图。Bolt Slides 把每一页变回一个能跑的网页——3D 能转、计算器能摁、白板能实时投票。
面向开源模型的 Agent,本地运行免费、数据不出设备,要更强算力才切云端(默认零数据保留),Mac 和 Windows 今天上线预览版。
同样的回答质量,接话延迟低 5.2 倍、成本低 6 倍(对比 GPT-4.1);改一行代码就能把语音 Agent 指到它上面。数据均为 LiveKit 自测。
实时加东西、换背景、做特效;产品页给出 sub-40ms、100FPS 连续生成。试用入口 lucy.decart.ai。
2.8 万亿参数、原生视觉、100 万 token 上下文,多项 agent 基准超过 GPT 5.6 Sol,App 和 API 今天可用
先说痛:网页立体小图标要会动、还要跟着状态变,普通视频容易卡。AVAL 给这种短动画专用格式和播放器。
先是隐私翻车,再是删数据、关默认、整库开源。后半段拆开看源码:体量、提示词、工具、改码、上传、记忆和安全。
OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab,发布了公司第一个自研大模型 Inkling。它能读文字、看图片、听音频、写代码和调用工具,完整权重可以下载,也能在 Tinker 上继续训练。
Google I/O India 上,Tensor 团队和 Pixel 团队联合演示:把 Gemma 4 轻量版直接塞进手机里的 TPU,数据不出机、不靠云。开发者还能申请 Tensor SDK,把模型编译到 Pixel 上跑。
无需手动喂上下文,本地 Markdown wiki 按设定节奏自动刷新;Slack 连接器即将上线
用本地小模型替代云端 AI 调用,数据来自谷歌内部测试,代理模型目前仅 ai.if 函数可用且处于预览阶段
腱驱动手部所有关节都能反向感知外力,指尖定位精度 ±0.2 毫米,专用产线年产能规划 1 万只。
三档模型 Sol、Terra、Luna 与 4 智能体并行 ultra 上线;同日 ChatGPT Work 上线、Codex 并进 ChatGPT。附中英双语发布会全片
今天起桌面端全档位可用,网页端和手机端未来几天内向其余套餐陆续开放。
设置里一键出报告。聊了什么、什么时候聊得多、常让它干什么,摊开给你看。要先打开 Memory。
几秒就有公网链接可以分享;先看效果,想留着再登录认领。不认领大约一小时后会过期。
功能:主/子智能体编排、百万上下文、桌面浏览器手机操作、写码与多模态;API 输入 $1.25 / 输出 $4.25 每百万 token
DeepSWE 排第三、综合榜第 4;比 Opus 4.8 更快,也明显更便宜。
真正边听边回的语音模型今天上线,复杂任务还能实时甩给 GPT-5.5。
新增点选圈选定点编辑与十余种语言原生渲染,已上线火山方舟,将陆续接入豆包、即梦
论文实测个性化提升10.8%、推理能力提升29.4%,Apache 2.0 完全开源
同门 Muse Video 视频模型同步预告,已支持原生音频生成,即将向创作者开放。
从只对 AI 爬虫收费扩展到向任意调用者收费,现处早期候补阶段
调用工具时模型会先说"我这就去查",通话不再因等待而冷场
一行 Wrangler 配置加标准 HTTP 缓存头,缓存还能嵌进 Worker 内部任意入口之间。
没有融资没有团队,纯粹为解决自己孩子的问题,却被诊所和学校主动找上门要用
MIT 协议开源、模型无关,接入任意 OpenAI 兼容文本模型即可用,目前只能操作单个页面视图
顾问模型只出几百字建议、不用全程代打,同等质量下总成本更低,目前是仅限 Claude API 和 AWS 平台的 beta 功能
钛金属材质,预售价289美元,2026年圣诞节前后发货,公司此前已出货第一代纯触控戒指。
训练用超5万块国产AI芯片、35万亿token;跑分多为美团自评框架测得,权重尚未真正开放下载
现已开放测试。一个协调 agent 拉起专家团队干活,末端还有个审稿 agent 专挑引用和数字的错;算力外包给 AI,原始数据不出本地。
生图仅需 4 秒、每千张约 $0.034;视频模型 Omni Flash 同日首次开放给开发者。
官方评测显示,高算力挡位下部分任务性能追平 Opus 4.8,标准定价却只要其六成。
支持 Claude Code 等 9 款 Agent 一键集成,合盖继续跑任务,停工 50ms 内自动释放休眠控制
在已有 MTP-1 投机解码基础上再快 60–85%,靠草稿与验证流水线重叠执行(数据为 DeepSeek 自评)
一次出 Sol/Terra/Luna 三档,先限量给可信伙伴、名单已报备美国政府,几周后再广泛开放