#OpenAI
共 24 篇 · 按时间倒序
共 24 篇 · 按时间倒序
OpenAI 把管理上下文、工具调用、沙箱和审批的 Codex 执行底座开放出来。开发者不用从零造 Agent 框架,就能让 Codex 进入现有的看板、工单和业务后台。
男子和 ChatGPT 讨论如何对前女友实施犯罪,被 OpenAI 报警抓获。
从 IGTV 的失败、ChatGPT 的空白框,到 Groupon、Instagram 与 OpenAI 三种完全不同的设计节奏,Ian Silber 讲清了一个更难的问题:当任何人都能迅速做出产品,设计师究竟还要判断什么。
六家线上跑 Agent 的创业公司交出实测数据;官方图表里还藏着一条没写进正文的:推理档位关到底,反而更贵。
一套四个零件的反官僚机制,以及被它指到的团队怎么说。
两个还没做成的目标、一套能直接抄的记分卡,外加三张内部工具截图里的细节。
前沿大厂第一次明着把进攻性网络能力开放给通过身份验证的『可信防御者』,并用它在 Chrome 里挖出了真漏洞
Black Hat USA 2026 现场,两个当事人讲了这起没有人类指挥的入侵是怎么长出来的
144 个国家的人均排名、六大洲三年增长倍数、35 岁以上用户在九成国家反攻——这些数字大多只写在图上,正文没提。
让 AI 说话不卡,光模型快没用——从你点下按钮那一刻起,每一环都得不掉链子。
推理成本约 2000 美元,47 万行证明全部开源、机器已验完逻辑。从这十个结果能看出这个还没发布的模型强在哪。
他还承认 2019 年整个领域都以为经济会被颠覆,结果没有。
最值得看的是那组对照实验:三个老模型加上同样的背景信息,成绩原地不动,其中两个还退了。
同一批数据能算出 43.5% 和 65%–82% 两个结论,差别只在分母怎么切。
面向客户侧与内部流程;今天对话通道先开语音和聊天。OpenAI 自用电话线自报 75% 不用真人;Codex 改进环 10 天再压 15 个百分点转人工
为了测出攻击能力的上限,涉事模型的网络攻击拒绝机制被主动调低,结果它们从只准装软件包的沙箱一路打进了别人家的生产数据库。
编程、写作、知识工作、Agent 四大场景的第一手上手反馈
三档模型 Sol、Terra、Luna 与 4 智能体并行 ultra 上线;同日 ChatGPT Work 上线、Codex 并进 ChatGPT。附中英双语发布会全片
今天起桌面端全档位可用,网页端和手机端未来几天内向其余套餐陆续开放。
真正边听边回的语音模型今天上线,复杂任务还能实时甩给 GPT-5.5。
调用工具时模型会先说"我这就去查",通话不再因等待而冷场
Brockman 确认 OpenAI 在研多款硬件;Agent 用户仅约 2000 万,ChatGPT 用户却已逼近 10 亿
能力数字出了三个版本且哪个都不可信,但可见的作弊行为本身成了安全监控有效的证据
一次出 Sol/Terra/Luna 三档,先限量给可信伙伴、名单已报备美国政府,几周后再广泛开放