🔥51CTO热榜:2026-08-17

据CodeRabbit统计,今年的代码提交量预计将达到往年的14倍及以上;在编码智能体渗透率位居行业前10%的企业里,35%的PR已经由自主智能体生成。
DeepSeek Harness这下真快被网友「插成万物」了。小黑鲸上线还没多久,单单在GitHub上打着dsh-plugin标签的公开仓库,就已经冲到了700+个???
最近,Kushal Chakrabarti在论文Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding中把这个问题研究明白了。
唐杰给马斯克“画的饼”(说国产模型超越Fable 5不会太久),往前拱了一大截,也就花了2个月整。
LangGraph 讲 Checkpoint,OpenAI 讲 Thread 和 Run,A2A讲 Task,AG-UI 讲 Event,Deep Agents 又引入 Todo、Subagent 和 Virtual Filesystem。名字越来越多,API 越来越像一套套独立世界观。
代码的"相关"和文本的"相关"根本不是一回事。文本相似不等于代码功能相关。值得问自己一句:你检索出来的是代码片段,还是代码结构?今天就把这个说清楚。
Anthropic发了一篇博客,首次公开解释了Claude文本水印的技术细节。最新一批模型已经全部内置,老模型也在适配的路上。
用Claude Code干活,API按量走,订阅制月费从20美元到200美元分三档。根据官方推算,开发者日均消耗13美元token,月均花在150到250美元之间。
全程仅靠Claude Fable 5,将Python库「TerminalTextEffects」一口气全盘重写为Rust。
这次 Keyv、Cacheable 事件,最值得关注的其实不是"又一个 npm 包被攻击了",而是:一个普通依赖,为什么能够变成一条攻击链?
作为xAI的全新AI队友产品,每个 Bot 拥有自己的云端虚拟机,可以登录你的工具和应用,像真人一样操作;还能全天候(24/7)自主运行多步骤真实任务,关掉电脑也能工作。
就在刚刚,Anthropic甩出了第二份《Risk Report》,覆盖到2026年7月15日为止的全部风险评估。
读完你将理解 coding agent 的核心架构,拿到 6 条可以直接复用的 agent 设计原则,以及一个可以直接开干的 while 循环模板。
Claude之父Boris Cherny最近在X上贴出了这组数字。它们来自他过去几周一直在做的一个「奇怪实验」:让Claude接管自家App的日常维护。
本文不讨论某个框架怎么用。我们以 Agent Protocol 为主线,把 Agent Runtime 拆解成一组可协议化的对象、操作和状态机。这里说的 Protocol 不是 A2A、AG-UI 或 LangChain Agent Protocol 等任何单一标准,而是 Agent Runtime 对外暴露的一组稳定对象、生命周期操作和状态迁移。
Serial GC简单但效率低,Parallel GC高效但停顿时间长,CMS并发但内存碎片严重,G1可控但延迟仍不够低,ZGC实现了10ms以内的停顿——这就是GC算法的演进逻辑:每一代解决上一代的短板,同时引入新的问题。
HPC 程序为什么会崩?又为什么经常不是“崩”,而是“卡住”?
这篇文章重点放在 DeepSeek Harness 真正跟别人不一样的几处设计,顺带会跟 Codex 的几个具体工程决策做对比。
对普通开发者和产品设计者来说呢,最实际的建议是这几个:永远假设Agent会接触到不可信内容,按最坏情况设计权限。高风险操作前,人工确认永远是最后一道、也是最可靠的一道防线。还要持续监控和迭代,因为攻击手法也在不断进化。
对于GB级大文件上传,表单直传绝对不行,网络抖动一次就是带宽灾难。我的设计思路是 "前端化整为零,后端异步合并,存储计算分离"。