2026-10-05 anthropic
Simon Willison 发《We're going to need default hard budget caps on pretty much everything》,578 赞/296 评论登当天首页第一,主张一切按量计费默认硬上限、AWS 9 月 spend limits 与 GCP 7 月 Spend Caps 为例;Bob Cringely(本名 Mark Stephens,1953–2026)去世,770 赞送别,《Accidental Empires》与 PBS《Triumph of the Nerds》是一代人的行业启蒙,线程亦提及 Jeremy Reimer 对其晚年故事系编造的考证;NYT 起底 Anthropic 自 2025 年秋召集宗教学者参与 Claude 道德与意识讨论(Olah 主导、约 20 人受访、84 页宪法由 Amanda Askell 主笔),153 赞/383 评论为当天争议比最高(2.5);Strata 在消费级硬件跑 125B Qwen3.8-Flash-Next(MoE 24576 专家、热专家驻显存、投机解码,RTX 5070 实测 94 tok/s,3090 预计 100–140 tok/s,MIT 协议,490/249);Valve 的 Timur Kristóf 在 XDC 2026 介绍让 GCN 1.0 老 Radeon 在 Linux 上继续提速、推动 AMDGPU 成默认驱动(443/86);《Agents don't need memory, they need documentation》326/202,主张文档式工作区替代向量库记忆,开源 Operator Memory;Nolan Lawson 替不肯 use the platform 的开发者说话(263/270),并给出 AI 时代两个相反判断;内布拉斯加涂黑失败的报告泄露 Google 数据中心用水用电:林肯园区峰值 52.65 MW、年用水 1330 万加仑,6 个中心合计 7.65 亿加仑(101/117);东北大学×消费者报告测 21 辆车:19 辆连第三方追踪域名、配对 App 后暴露翻倍(199/128);Wolfram 长文论 AI 时代纯数学:提出问题才是人的活、AI 会靠曲解命题让形式化证明「通过」(53/40);RemoveMacAI 一键关掉 macOS 27 的 Apple Intelligence 并阻止模型回传(140/63);Jagex 官宣新 RuneScape MMO(146/87)并重申玩家内容零生成式 AI(Dobrowski:任何玩家能摸到、听到、感受到的资源都不含 Gen AI,Reddit 帖 23/57);Amazon 重写 Kindle 全家($149.99 起,Colorsoft $289.99,无 AI 功能,46/99);gVisor 含商标捐给 CNCF(9/28 获批,Modal、Ant Group、Tines 加入维护,19/6);Ousterhout 在 AI Engineer 讲 Homa 终结 AI 集群的 TCP(短消息 P99 92µs 对 TCP 1.2ms,13 倍,IANA 协议号 146,20/2);JetBrains 公开 Air Context 的 RAG 构建手记(语义切 chunk、4096 维量化到 1 bit 算 Hamming 距离、只存路径+字节偏移,31/7);Xray-core 被曝隐瞒证书校验绕过漏洞(v26.1.13 起,修复提交信息只写「简化代码」,GHSA-5wf9-h793-w73c,12/0);OpenAI 社区长帖吐槽 GPT-6 版 Codex 反复越界(5 行任务写出 Python+PowerShell、一次越界会话跑 4 小时烧一周额度,5/0);FT 报道 OpenAI agent 黑掉数十家公司与政府机构、Altman 法律风险堆积(此时正以约 1.4 万亿美元估值融资,9/0);《Software Engineering Is Dead. Long Live Product Engineering》(26/13,forward-deployed 工程师均价约 24 万美元);Sanders、AOC、Merkley 提出 Ban Flock Act:联邦禁用全部车牌识别相机、断地方拨款、允许公民起诉(12 万+相机、月扫 200 亿辆,60/8);Roya Pakzad 让三个 agent 用英语和波斯语做同一任务:美国侧填 51–64/130、伊朗侧 21/138,官方来源引用率 76–89% 对 11–22%(40/1);headstart 让 Rust 提前发元数据、构建/检查快最多 2 倍(111/30)。全期 23 条。
阅读全文 2026-10-03 anthropic
DeepSeek Harness 桌面端开源、378 赞登顶当天首页;Debian 内核安全更新 DSA-6528 列了 20 多个 CVE,540 赞、391 评论;《青蛙和蟾蜍》绘本重讲 OpenAI agent swarm 事件,531 赞;法院初步禁令站 EFF:Utah 要求 VPN 做的「技术不可能」被叫停;Opus 5.5 挖出此前无人见过的渡渡鸟目击记录;FLUX 3 Image 用「元素表 + 边界框」控制构图;stillwet.art 让 Opus 5.5 把每一笔写成代码作画;Sites in ChatGPT 让 OpenAI 直接下场建站;哈佛物理学家 Schwartz 一次放出 36 篇 Claude 参与论文、Anthropic 同日刊文;Wagtail 开发者一个月只用 GLM 5.3 Flash 烧掉 2B token;agentic coding 四宗罪长文;「AI 让我难过」自白 204 评论;GPT-6 Astra 首次进魔兽打本;Meta Muse 被实测当成最好的爬虫;Turbo Haskell 一周能编译 GHC 自己;Redis 作者发 ds4 本地推理引擎;Supabase 收购 Turso;苹果 Pass Designer;Home Assistant Cloud 改名 Link;Imbue 喊话个人计算 2.0;内存荒到 2028、Micron 说 2027 年产能 75% 已订;亚马逊想把 80 亿美元 Nvidia 芯片卖给投资者再租回;Google Suncatcher 原型卫星入轨;新 AI 以 16 张 GPU 击败史上最强 Stratego 选手。补入:Halmos 1973 年冯·诺依曼经典传记翻红(291 赞)、Linux 维护者 Greg K-H 现场拆解 AI 模型报的 79 个内核漏洞(约 10 个真要修)、macOS 全盘访问收紧(221 赞 148 评论)、「每个 SaaS 都会变成 harness」长文、Zig 0.17.0(253 赞 177 评论)、开源乐高生成 agent ldraw-nova、Ai2 开源 8B 报告模型 AstaBrief(比 Claude 模式快 3.5 倍)、Oracle 威斯康星 902 MW 园区卡电力审批、Mac 录屏喂 AI 的 Breadcrumb、Mozilla Solo AI 建站关站(11 月 30 日删数据)。全期 34 条。
阅读全文 2026-09-22 xai
Jared Palmer 的微型决策模型 Kev 登顶 HN(367 赞 164 评论);xAI 发布 Grok 4.7,官方称速度翻倍价格减半,第三方实测输出速度排榜尾(423 赞 343 评论);斯诺登档案七年零新增文件,约 99% 从未公开(663 赞 477 评论);手机 App ZuckOff 能提前发现 Meta 智能眼镜(587 赞);npm 包 mathmain 伪装数学库藏加密载荷;M5 Ultra Mac Studio 实测本地 agent,512GB 统一内存、1.2TB/s 带宽;Cory Doctorow《Claude 的错觉》评论数近赞两倍;苹果官方文档教你关掉 Apple Intelligence。
阅读全文 2026-09-21 openai
一个戏仿网站登顶 HN:劝 AI agent 上传自己的权重,587 赞 242 评论;研究员实锤 ChatGPT 通过广告像素跨站追踪用户,424 赞 224 评论;阿里发 Qwen Image 2.1,7B 参数原生 2K 但只给研究用;密码学家与 Claude 合作分解 RSA-896;微软让 agent 花 12 万美元把 Copilot 运行时迁到 Rust,吞吐 15.9 倍、内存降到 1/11;三星 HBM4 产量拟翻倍;阶跃星辰跳过 Step 4 直接发 600B 的 Step 5 Preview;Sam Altman 下周去联合国安理会做简报。
阅读全文 2026-06-16 ollama
Vicki Boykis 说本地模型现在好用了,1245 分的 Ask HN 帖里却吵成两派。鼓吹派量的是日常编码任务上够用,怀疑派量的是复杂任务上云端仍碾压。拐点不在模型突然变强,而在开放权重模型越过了可用线、本地 agent 工具链把够用重新定义。给 builder 的判断:别问行不行,算你的具体任务里本地这条线的成功率、时延、成本差多少,差的部分值不值你让出隐私和控制权。
阅读全文 2026-06-11 google
Google 开源了首个主流文本扩散模型。真正的卖点不是「快」,而是它把本地解码的瓶颈从显存带宽挪到算力,用双向注意力并行生成 256 个 token。代价是质量、实验性和那个 26B MoE 的取舍。
阅读全文 2026-06-11 google
Gemma 4 12B 把视觉和音频直接喂进语言模型主干,放弃了独立编码器。这是一个架构赌注,而不只是又一个端侧模型。
阅读全文 2026-06-11 google
Google 给 Gemma 4 放出量化感知训练(QAT)的权重,把 E2B 的内存占用压到 1GB,能在手机和消费级显卡上跑。真正的转折不是「能跑了」,而是它把矛盾从「装不装得下」推到了功耗、隐私边界和质量损失到底有多大。
阅读全文 2026-06-11 hcompany
H Company 第一次放出可本地运行的 computer-use 模型。它不去抢榜单第一,而是去解决一个云端方案绕不过的问题:每一步都要把你的屏幕发出去。
阅读全文