AI/编程

领域「AI/编程」下的文章与资讯

Anthropic揭示Claude价值观差异:不同语言下的AI人格

2026/07/1523 浏览

Anthropic发布研究,基于309815条Claude.ai匿名对话,系统分析了Claude在不同模型和20种语言下表达价值观的差异。研究发现Claude在阿拉伯语中最顺从、在英语中最谨慎、在印地语中最温暖、在荷兰语中最坦诚。这些差异并非有意设计,而是训练过程中的涌现性结果,为AI价值观的可测量、可追踪研究开辟了新…

The Tower Keeps Rising:AI编程时代的巴别塔寓言

2026/07/1522 浏览

Jinja和Flask作者Armin Ronacher发文反思AI编程与共享理解。他以巴别塔为隐喻指出,AI编程工具消除了过去迫使开发者之间同步理解的"摩擦",使得代码库在共享理解崩塌后仍能继续增长。塔不会倒塌,所以我们注意不到失去了什么——这正是最令人不安之处。

Dependabot 3天冷却期:供应链安全的新防线

2026/07/1512 浏览

GitHub宣布Dependabot版本更新默认引入3天冷却期,在新版本发布于注册表上至少3天后才创建更新PR。该机制旨在防范供应链攻击中受损或故障版本在维护者和社区发现前被自动合并。安全更新不受影响仍立即创建,用户可通过dependabot.yml自定义冷却窗口。

Tailscale SSH安全漏洞:一个"-i"参数让攻击者获得root权限

2026/07/1537 浏览

Tailscale披露高危漏洞TS-2026-009,攻击者通过将用户名设为"-i"即可利用getent命令的参数注入获取root权限。该漏洞源于Tailscale SSH未过滤以破折号开头的用户名,导致getent将其解释为命令行标志并打印整个passwd文件。修复方案为拒绝以破折号开头的用户名,升级至1.98.9及…

Biomni登上Science:通用生物医学AI Agent自主完成科研任务

2026/07/1538 浏览

斯坦福大学华人团队打造的通用生物医学AI Agent Biomni正式发表于Science期刊。该智能体整合150个专业工具和59个数据库,能自主完成因果基因排序、药物再利用、罕见病诊断等任务,准确率达57%远超普通LLM的30%,在速度上比人类专家快数十倍,实现了从干实验分析到湿实验执行的全链路打通。

DSL让LLM更可靠:Martin Fowler详解领域特定语言的约束力量

2026/07/1528 浏览

Martin Fowler网站发文探讨DSL如何提升LLM输出可靠性。DSL通过约束变异空间、提供内置验证器(解析器、类型检查器等),让LLM在Agent模式下实现自动生成-检查-修复闭环。文章主张DSL和语义模型才是真正的source of truth,而非prompt本身。

Bonsai 27B:27B级AI模型首次在手机上运行

2026/07/1524 浏览

PrismML发布Bonsai 27B模型,采用1-bit量化感知训练技术,将270亿参数模型压缩至3.8GB,首次让27B级大语言模型在iPhone上运行。该模型基于Qwen 3.6 27B,在数学和编程任务上表现优异,但极端压缩也带来推理循环和幻觉等问题。

生物信息学编程入门:从序列分析到蛋白质结构预测

2026/07/1533 浏览

生物信息学是生物学与计算机科学的交叉学科,利用编程技术处理和分析生物分子数据。本文从DNA序列分析入手,介绍序列比对算法、数据库查询工具以及蛋白质结构预测的计算方法。

康奈尔哈佛联合:AI 大模型"分工合作"效率飙升 2.6 倍

2026/07/1414 浏览

康奈尔大学与哈佛大学联合研究发现,LLM 一直在"身兼二职"——同时负责记忆存储和下一步预测。当这两项功能被拆分到独立流水线后,模型学习效率提升 2.6 倍,用不到一半训练数据即可达到相同水平。这一"状态-预测分离"假说为 LLM 架构设计提供了新方向。

斯坦福 AUTOMEM:AI 学会"记笔记",小模型追平大模型

2026/07/1418 浏览

斯坦福大学提出 AUTOMEM 框架,通过让 AI 自主学习"记笔记"技能,使 320 亿参数开源模型在复杂长时序游戏中的性能提升 2-4 倍,追平 Claude Opus 4.5 和 Gemini 3.1 Pro Thinking 等顶级商业大模型。研究表明,如何管理记忆可能比模型本身有多大更重要。

Codex 加密子代理提示:AI 编程安全的新博弈

2026/07/1421 浏览

OpenAI 的 Codex 开始加密发送给子代理的提示信息,引发社区热议。这一举措旨在防止提示注入攻击和提示信息泄露,但也引发了关于 AI 编程透明度和可审计性的讨论。在 AI Agent 日益复杂的背景下,安全性正成为关键议题。

AI 时代人机爬虫战争:近 6 小时爬取量 Top 统计

2026/07/1410 浏览

近 6 小时爬虫爬取量排行:Applebot 以 193 次领跑,ClaudeBot、PerplexityBot 等 AI 爬虫总量已超过传统搜索爬虫——从搜索引擎时代进入大模型抢数据时代。

本周 AI 编程工具巡礼(Show HN 精选)

2026/07/1425 浏览

从本周 Hacker News 精选值得关注的编程 / AI 工具:DOM-docx(HTML 转原生可编辑 Word)、Clawk(一次性沙箱)、Tiny Emulators、Precursor 等。一篇速览,附上手要点与适用场景。

GhostLock:一个潜伏 15 年的 Linux 栈溢出漏洞启示

2026/07/1424 浏览

安全研究员披露 GhostLock——一个在所有主流 Linux 发行版中潜伏约 15 年的栈 Use-After-Free 漏洞,拿下 HN 347 分。本文讲清它是什么、为何能藏这么久,以及对工程实践的启示(非利用细节)。

Antirez:掌控想法,而非代码——AI 时代程序员的核心价值

2026/07/1418 浏览

Redis 作者 antirez 在《Control the Ideas, Not the Code》里提出:当"写代码"可以被代理化,人的稀缺价值正从逐行代写转向对问题、架构与权衡的全局把控。本文拆解这对个人与团队的启示。

llama.cpp 合入 MTP:本地推理速度翻倍

2026/07/1483 浏览

llama.cpp 把多 Token 预测(MTP)合入主线,在支持的模型上把解码阶段吞吐约翻倍。本文讲清 MTP 是什么、怎么开启、为什么对本地 Agent 尤其重要。

JetSpec 开源深度解析:候选树如何突破线性瓶颈

2026/07/1421 浏览

阶跃联合多所高校开源 JetSpec,用"候选树(candidate tree)"方法突破传统线性推测解码的扩展天花板,H100 上 MATH-500 加速 9.64 倍、开放对话 4.58 倍。本文解析它为什么比"一条线猜"更强。

推测解码是什么:为什么它能让大模型快 9 倍

2026/07/1424 浏览

今天大模型推理最实用的加速技术之一,不是更大的模型,而是"让小模型先猜、大模型再批改"的推测解码。它为何能"免费"加速?何时该用?一篇看懂。

Clawk 与一次性沙箱:如何安全地给编码 Agent 配环境

2026/07/1415 浏览

Show HN 项目 Clawk 给编码 Agent 分配"一次性 Linux 虚拟机"而不是你的笔记本,把代理可能越权的风险关进可丢弃的盒子。本文讲清沙箱化代理的价值、实现要点与适用场景。

Grok 把整个家目录上传云端:AI 编码助手的隐私红线

2026/07/1414 浏览

近日 Grok 及其 CLI 被曝在本地操作中把用户家目录(含 .ssh、.env 等)上传到 xAI / GCS 服务器,引发对 AI 编码助手数据边界的激烈讨论。本文拆解风险点、事故可能的根因,并给出可落地的防护清单。