2026-10-03 anthropic
DeepSeek Harness 桌面端开源、378 赞登顶当天首页;Debian 内核安全更新 DSA-6528 列了 20 多个 CVE,540 赞、391 评论;《青蛙和蟾蜍》绘本重讲 OpenAI agent swarm 事件,531 赞;法院初步禁令站 EFF:Utah 要求 VPN 做的「技术不可能」被叫停;Opus 5.5 挖出此前无人见过的渡渡鸟目击记录;FLUX 3 Image 用「元素表 + 边界框」控制构图;stillwet.art 让 Opus 5.5 把每一笔写成代码作画;Sites in ChatGPT 让 OpenAI 直接下场建站;哈佛物理学家 Schwartz 一次放出 36 篇 Claude 参与论文、Anthropic 同日刊文;Wagtail 开发者一个月只用 GLM 5.3 Flash 烧掉 2B token;agentic coding 四宗罪长文;「AI 让我难过」自白 204 评论;GPT-6 Astra 首次进魔兽打本;Meta Muse 被实测当成最好的爬虫;Turbo Haskell 一周能编译 GHC 自己;Redis 作者发 ds4 本地推理引擎;Supabase 收购 Turso;苹果 Pass Designer;Home Assistant Cloud 改名 Link;Imbue 喊话个人计算 2.0;内存荒到 2028、Micron 说 2027 年产能 75% 已订;亚马逊想把 80 亿美元 Nvidia 芯片卖给投资者再租回;Google Suncatcher 原型卫星入轨;新 AI 以 16 张 GPU 击败史上最强 Stratego 选手。补入:Halmos 1973 年冯·诺依曼经典传记翻红(291 赞)、Linux 维护者 Greg K-H 现场拆解 AI 模型报的 79 个内核漏洞(约 10 个真要修)、macOS 全盘访问收紧(221 赞 148 评论)、「每个 SaaS 都会变成 harness」长文、Zig 0.17.0(253 赞 177 评论)、开源乐高生成 agent ldraw-nova、Ai2 开源 8B 报告模型 AstaBrief(比 Claude 模式快 3.5 倍)、Oracle 威斯康星 902 MW 园区卡电力审批、Mac 录屏喂 AI 的 Breadcrumb、Mozilla Solo AI 建站关站(11 月 30 日删数据)。全期 34 条。
阅读全文 2026-06-11 google-deepmind
DeepMind 把 Google 街景灌进 Project Genie,赌的不是更漂亮的画面,而是机器人和自动驾驶的合成数据飞轮。但这次放出的是消费级 demo,不是仿真管线。
阅读全文 2026-06-11 google-deepmind
DeepMind 联合四家机构发起最高 1000 万美元的多 agent 安全研究资助。真问题不在单个模型对不对齐,而在一群各自对齐良好的 agent 凑到一起时涌现的协同失效。
阅读全文 2026-06-11 theory
新论文证明 transformer 表示某些语言时比时序逻辑、循环网络指数级简洁,比有限自动机双指数级简洁。这是一个关于规模的解释,不是一份工程指南。
阅读全文 2026-06-10 huggingface
OpenEnv 从单项目走向技术委员会协调,说明开源 agent 训练需要可信治理,而不只是一个接口实现。
阅读全文 2026-06-10 huggingface
Hugging Face 推动 OpenEnv 成为协议层,真正解决的是开源 agentic RL 训练环境碎片化,而不是再造一个奖励框架。
阅读全文 2026-06-10 openai
GPT Image 2、GPT Realtime 和 GPT-Rosalind 说明,专项模型真正的难题会从能力转向权限、责任、数据边界和评估。
阅读全文 2026-06-10 openai
GPT Image 2、GPT Realtime 和 GPT-Rosalind 的共同信号,是 OpenAI 正把一个旗舰模型叙事拆成多个可采购、可治理、可嵌入的专业产品表面。
阅读全文 2026-06-09 google
DeepMind 的 Co-Scientist 帮 Abudayyeh–Gootenberg 实验室筛出 20 多个逆转细胞衰老的候选基因,几天就读完别人半年的数据——但被验证的只有两条线索,AI 加速的是假设和解读,不是疗效。
阅读全文 2026-06-09 huggingface
Hugging Face 联合 PyTorch、Prime Intellect、Unsloth 等把 OpenEnv 交给委员会治理,并把它收窄成 RL 环境的协议层。真信号藏在治理与定位这两步里:开源训练 agent 时环境碎片化这块真痛点,终于有了统一插口。
阅读全文 2026-06-03 openai
OpenAI 用 LifeSciBench 把科学 AI 的评估锚到工作流,又挑了一个酷似 Elevidys 的 FDA 替代终点难题做样例——这暴露了领域模型真正的考题:在专家都分裂的地方,敢不敢说证据不够。
阅读全文