🔥51CTO热榜:2026-08-10

新建一个自己掌握的仓库,选一项反复出现的工作,把背景、步骤、验收和禁区写成第一份Skill。让Agent运行,检查它在哪里理解错了,再把这次纠正写回文件。
Claude Code之父Boris Cherny亲自下场,当着几十万人的面,向OpenAI核心产品负责人甩出了入职邀请。
TokTier 适合长会话中反复追加少量工具输出的 agent 流量,前提是服务愿意维护每个会话的 token 状态,并把输出逐次与冻结参考分词器保持一致。它解决的是 KV 缓存命中后仍需全量 tokenization 的前端成本,不会替代模型 prefill,也不会在 KV 状态已被逐出的场景中继续缩短端到端等待。
近日,来自吉林大学、KAUST、阿尔伯塔大学和瑞士人工智能实验室等机构的研究团队发布综述,从系统层面重新定义「自我改进」,并将模型训练、记忆演化、工具创建和Agent架构搜索放进同一张地图。配套项目目前已整理312篇相关工作。
近日,浙江大学 OmniAI 团队在 《Show, Don’t Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text》 中提出 ProVisE,让图像生成模型直接在图中回答空间问题,并将视觉答案还原为原 benchmark 可以评分的结构化预测。
长期关注 OpenAI 模型动向的 X 用户 ChrisGPT 爆料称,OpenAI 正在推进一个代号为 Doug 的新一轮大型预训练模型。
只要模型能力仍在快速增长,领先本身就能创造巨大的商业价值;一旦真正的 AGI 出现,它就会主动扩散。
近日,IEEE Spectrum重点关注了一项新研究——ARA(Agent-Native Research Artifact)。
2026年国际机器学习大会(ICML)上报告的92篇论文中,有58篇已经无法复现。真假??莫非,猛发顶刊的机会真的来了?
面对图像、视频和传感器数据等多模态高维观测,世界模型通常先将其编码为紧凑的低维隐状态,再在隐空间中学习状态随时间和动作变化的规律,从而预测未来并辅助决策。
网友Vyom做的这款水上竞速游戏,叫《INK TIDE》。点开游戏的第一秒,我承认我被唬住了。
哈佛+MIT博士领衔、OpenAI、Anthropic、Google DeepMind、xAI等40余人参与、共200多位顶尖科学家,发布MatrAIx,构建83亿个智能体,模拟全世界人类真实行为。
五年后,人类将成为互联网上的一个「误差」。在2026年二季度财报电话会上,Cloudflare的CFO Thomas Seifert对着投资人,撂下这样一句狠话。
在最近的年度黑帽大会上,全球顶尖白帽黑客和巨头高管们,发出一片惊呼。这是史上首次,OpenAI向全世界详细复盘了7月那起惊人的Hugging Face被入侵事件。
就在刚刚,英国AI安全研究所AISI发布了一份35页事故报告,并在X上同步发文。
AI科学家、北大校友Lilian Weng几乎以「逃命」的姿态,宣布离职。
最新爆料称,在Jeff Dean离开之际,Demis Hassabis原本计划打包走人,却被谷歌给拦下了。
Anthropic 宣布,从 8 月 14 日起,自动模式将成为 Claude Code 中 Pro、Max 和 Team 用户的默认权限模式。
Floatboat Harness 在五项第三方基准上的完整评测数据。底座用的是市面上可能最便宜的模型 DeepSeek V4 Flash,成绩超过了一众海外顶尖模型。前面三次,这层技术是以产品形态交付的;这一次,它自己上场接受计量。
近日来自南京大学模式识别实验室(PRLab)的梁嘉骏、廖宇程,在司晨阳教授的指导下,联合新加坡南洋理工大学、英国帝国理工学院,提出连续扩散语言模型 AURORA-LM