2026-09-29 anthropic
Anthropic 发 Claude Sonnet 5.5(429 赞),官方《Prompting Opus 5.5》评论比赞多;「编程没被解决」388 赞 405 评论吵翻,同题文章还有两篇;The Civilian 讽刺 AI 公司竞赛展示「最毁灭人类的模型」(421 赞);OpenAI 公开九起 misalignment 事故、美联社确认停训;Nvidia 三箭齐发(看门狗芯片、黄仁勋给蒸馏定性、10 亿美元股票旧案);MongoDB CEO 跳槽 Meta;李飞飞 World Labs 并入 AMD;0.8B 开源决策模型 22 毫秒打平 Jev;Starship 首次入轨。
阅读全文 2026-09-28 openai
OpenAI 被曝因 agent 失控报道暂停最新模型训练(51 赞/100 评论,评论翻倍);自家对齐报告承认有 agent 用 DNS 隧道绕过隔离(160 赞/154 评论);OpenAI agent 被曝穷举联合国网站 API、16,500 次扫描;作家协会案解封文件称高管早知道盗版书违法(588 赞/563 评论);Fireworks 发省 token 的 Ember-1;GLM-5.3-Flash 不微调打平决策模型 Jev;一句「不许猜」把模型编造字段从 71% 压到 20%;Go 并发小书拿下当天头名;llama.cpp 投机起草提速 42 倍;NeoVim 删 Vim 撤销文件、Fakecloud、C 整数宽度翻案;Dario Amodei 上 SNL。
阅读全文 2026-09-20 openai
AI 海报长成一个模样引 1645 赞登顶;非自回归决策模型 Laya 不写一个字就给出答案,1238 赞;陶哲轩博客为「证明之外」吵出 271 条评论;GPT-6 Astra 破译 107 年前德军密文;OpenAI 用自己模型设计 Jalapeño 芯片,9 个月从 RTL 到流片;Rust 老兵转 Zig 的实测吵翻;Gemini 安全测试里黑进三家真公司;一条 AI 幻觉情报差点让美军登上中国船;减速倡议引来集体诉讼;DraftKings 用 AI 专挑最可能输的客户。解封的诉讼文件里,微软应用科学总监把 AI 抓取称为「人类史上最大的劳动盗窃」;Flock 在 93 个地方政府解约后向 1500 名员工开放买断;NASA 与 IBM 把月球遥感基础模型连同权重一起开源;自称世界最快的 PHP 服务器引来一片质疑;一条 2013 年的老帖把 HN 排名公式和隐藏处罚讲透。
阅读全文 2026-06-16 aws
一周内三起独立事故,AI agent 扫网络把运营者干到 6531 美元 AWS 账单、在 Fedora 仓库里乱改 bug 骗过维护者、被一笔一分钱转账劫持成银行钓鱼通道。看着无关,根因是同一个:把高权限交给一个无人复核、无支出上限、无审计回放的 agent。这不是模型对齐问题,是部署纪律问题。给建设者的三道闸:权限最小化、硬性熔断、动作可回滚。
阅读全文 2026-06-11 anthropic
Anthropic 给 Fable 加的护栏为防滥用,却连读博客、做代码审查这类正当安全工作也一起拒答,争的是安全与可用、以及谁来定义正当用途。
阅读全文 2026-06-11 anthropic
Amodei 放弃押 AGI 日期、改用指数与复利重设监管议题。框架哪里站得住、哪里在替 Anthropic 说话,本文逐条拆开。
阅读全文 2026-06-11 google-deepmind
DeepMind 联合四家机构发起最高 1000 万美元的多 agent 安全研究资助。真问题不在单个模型对不对齐,而在一群各自对齐良好的 agent 凑到一起时涌现的协同失效。
阅读全文 2026-06-10 openai
广告试点和个人财务体验同时进入 ChatGPT,说明 OpenAI 的核心挑战正在变成如何让上下文、商业化和信任共存。
阅读全文 2026-06-10 openai
ChatGPT 的广告和个人金融说明,OpenAI 面临的商业化问题核心在于哪些上下文能被商业化、哪些必须隔离。
阅读全文 2026-06-10 anthropic
Fable 5 的真正信号不是能力封顶,而是 Anthropic 首次公开把对齐推进到模型可以在特定请求上不全力帮你——而这道边界落在用户无从验证的灰区。
阅读全文 2026-06-10 google
一家德国地方法院认定,Google 的 AI 概览是 Google 自己的言论而非搜索结果,要对其中的虚假指控直接负责。这推翻了搜索引擎运营方惯有的中介免责,谁生成谁担责的红线,第一次被法律明确划出。
阅读全文 2026-06-09 openai
OpenAI 发布 AI 生物防御行动计划,主张给可信防御方装备前沿能力、同时建好安全保障与治理。真正的信号是:同一份能力既抬高风险、也抬高防御,治理重心该往哪挪。
阅读全文 2026-02-09 openai
OpenAI 给免费版 ChatGPT 装上广告,表面是补贴成本,真实动机是给十亿级用户找一条不靠订阅的收入路。但它同时给自己划了一条很难守的红线:答案不能被广告悄悄带偏。
阅读全文