最新内容

文章与资讯,登录与否均可阅读

Biomni登上Science:通用生物医学AI Agent自主完成科研任务

2026/07/1519 浏览

斯坦福大学华人团队打造的通用生物医学AI Agent Biomni正式发表于Science期刊。该智能体整合150个专业工具和59个数据库,能自主完成因果基因排序、药物再利用、罕见病诊断等任务,准确率达57%远超普通LLM的30%,在速度上比人类专家快数十倍,实现了从干实验分析到湿实验执行的全链路打通。

DSL让LLM更可靠:Martin Fowler详解领域特定语言的约束力量

2026/07/156 浏览

Martin Fowler网站发文探讨DSL如何提升LLM输出可靠性。DSL通过约束变异空间、提供内置验证器(解析器、类型检查器等),让LLM在Agent模式下实现自动生成-检查-修复闭环。文章主张DSL和语义模型才是真正的source of truth,而非prompt本身。

Bonsai 27B:27B级AI模型首次在手机上运行

2026/07/1512 浏览

PrismML发布Bonsai 27B模型,采用1-bit量化感知训练技术,将270亿参数模型压缩至3.8GB,首次让27B级大语言模型在iPhone上运行。该模型基于Qwen 3.6 27B,在数学和编程任务上表现优异,但极端压缩也带来推理循环和幻觉等问题。

生物信息学编程入门:从序列分析到蛋白质结构预测

2026/07/159 浏览

生物信息学是生物学与计算机科学的交叉学科,利用编程技术处理和分析生物分子数据。本文从DNA序列分析入手,介绍序列比对算法、数据库查询工具以及蛋白质结构预测的计算方法。

康奈尔哈佛联合:AI 大模型"分工合作"效率飙升 2.6 倍

2026/07/149 浏览

康奈尔大学与哈佛大学联合研究发现,LLM 一直在"身兼二职"——同时负责记忆存储和下一步预测。当这两项功能被拆分到独立流水线后,模型学习效率提升 2.6 倍,用不到一半训练数据即可达到相同水平。这一"状态-预测分离"假说为 LLM 架构设计提供了新方向。

斯坦福 AUTOMEM:AI 学会"记笔记",小模型追平大模型

2026/07/1413 浏览

斯坦福大学提出 AUTOMEM 框架,通过让 AI 自主学习"记笔记"技能,使 320 亿参数开源模型在复杂长时序游戏中的性能提升 2-4 倍,追平 Claude Opus 4.5 和 Gemini 3.1 Pro Thinking 等顶级商业大模型。研究表明,如何管理记忆可能比模型本身有多大更重要。

Codex 加密子代理提示:AI 编程安全的新博弈

2026/07/1414 浏览

OpenAI 的 Codex 开始加密发送给子代理的提示信息,引发社区热议。这一举措旨在防止提示注入攻击和提示信息泄露,但也引发了关于 AI 编程透明度和可审计性的讨论。在 AI Agent 日益复杂的背景下,安全性正成为关键议题。

光电协同镍催化:上海有机所 C(sp3)-C(sp3) 键构建新方法

2026/07/1411 浏览

上海有机所开发了光电协同镍催化策略,实现了羧酸与卤代烷的 C(sp3)-C(sp3) 交叉偶联。阴极还原生成 Ni(I) 通过卤原子攫取活化卤代物,两种自由基经镍催化交叉偶联构筑碳碳键。该成果发表于 JACS,展示了在天然产物后修饰和药物合成中的应用。

杂环骨架编辑新策略:中国科大 Nature Chemistry 成果

2026/07/1411 浏览

中国科学技术大学张海军团队发展了非氧化还原骨架编辑新策略,实现了氧杂环丁烷向氮杂环丁烷的直接骨架转换,为药物分子的后期结构优化提供了新工具。该成果发表于 Nature Chemistry。

步骤特异性光激发:中科院突破人工固氮热力学极限

2026/07/1410 浏览

中科院大连化物所陈萍、郭建平团队提出"步骤特异性光激发"策略,利用紫外光和可见光分别驱动氮气活化和中间体加氢,绕过了 Haber-Bosch 工艺中催化剂的标度关系限制。在常压、644K 条件下,出口氨浓度达 0.25%,超出热力学平衡上限。该成果发表于《美国化学会志》。

毫秒级热脉冲:天津大学实现铂壳催化剂原子级精准合成

2026/07/1410 浏览

天津大学胡文彬教授团队首创瞬态组装策略,利用毫秒级周期热脉冲技术,在数分钟内实现铂族金属核壳结构催化剂的超快合成与原子级精准调控。铂壳厚度稳定控制在三原子层,催化活性充分释放,单位质量能耗较传统工艺降低 90%。在氢燃料电池实测中达到 15.2 kW/g Pt。

日本突破:废旧EV电池锂回收率达90%的新方法

2026/07/142 浏览

随着全球电动汽车保有量激增,废旧锂电池的回收成为紧迫挑战。日本研究团队开发了一种新型回收工艺,实现了高达 90% 的锂回收率,远超传统火法的约 5% 和湿法的 60-70%。同时,中科院团队提出基于 CO2 和水的"三合一"绿色回收策略,常温常压下锂提取率超 95%,产物可直接用于新电池制造或作为催化剂。

AI 时代人机爬虫战争:近 6 小时爬取量 Top 统计

2026/07/145 浏览

近 6 小时爬虫爬取量排行:Applebot 以 193 次领跑,ClaudeBot、PerplexityBot 等 AI 爬虫总量已超过传统搜索爬虫——从搜索引擎时代进入大模型抢数据时代。

本周 AI 编程工具巡礼(Show HN 精选)

2026/07/1421 浏览

从本周 Hacker News 精选值得关注的编程 / AI 工具:DOM-docx(HTML 转原生可编辑 Word)、Clawk(一次性沙箱)、Tiny Emulators、Precursor 等。一篇速览,附上手要点与适用场景。

GhostLock:一个潜伏 15 年的 Linux 栈溢出漏洞启示

2026/07/1417 浏览

安全研究员披露 GhostLock——一个在所有主流 Linux 发行版中潜伏约 15 年的栈 Use-After-Free 漏洞,拿下 HN 347 分。本文讲清它是什么、为何能藏这么久,以及对工程实践的启示(非利用细节)。

Antirez:掌控想法,而非代码——AI 时代程序员的核心价值

2026/07/1413 浏览

Redis 作者 antirez 在《Control the Ideas, Not the Code》里提出:当"写代码"可以被代理化,人的稀缺价值正从逐行代写转向对问题、架构与权衡的全局把控。本文拆解这对个人与团队的启示。

llama.cpp 合入 MTP:本地推理速度翻倍

2026/07/1431 浏览

llama.cpp 把多 Token 预测(MTP)合入主线,在支持的模型上把解码阶段吞吐约翻倍。本文讲清 MTP 是什么、怎么开启、为什么对本地 Agent 尤其重要。

JetSpec 开源深度解析:候选树如何突破线性瓶颈

2026/07/1414 浏览

阶跃联合多所高校开源 JetSpec,用"候选树(candidate tree)"方法突破传统线性推测解码的扩展天花板,H100 上 MATH-500 加速 9.64 倍、开放对话 4.58 倍。本文解析它为什么比"一条线猜"更强。

推测解码是什么:为什么它能让大模型快 9 倍

2026/07/1415 浏览

今天大模型推理最实用的加速技术之一,不是更大的模型,而是"让小模型先猜、大模型再批改"的推测解码。它为何能"免费"加速?何时该用?一篇看懂。

Clawk 与一次性沙箱:如何安全地给编码 Agent 配环境

2026/07/148 浏览

Show HN 项目 Clawk 给编码 Agent 分配"一次性 Linux 虚拟机"而不是你的笔记本,把代理可能越权的风险关进可丢弃的盒子。本文讲清沙箱化代理的价值、实现要点与适用场景。