🔥51CTO热榜:2026-08-11

微软已经确认,他们不会“立即调整”Windows 11 的透明效果选项,而是建议用户使用 Windhawk 等第三方工具,而不是在操作系统中原生加入类似 macOS “Liquid Glass(液态玻璃)”风格的透明控制功能。
这一发现凸显了业界对间接提示注入日益增长的关注。这是一种安全问题,可能影响连接到文档、网站、电子邮件和业务工具的 AI Agent。
多轮RAG它不是单轮RAG的简单叠加,而是从"无状态的一次性任务"变成了"有状态的序列决策问题"。下面就把这中间的差异,掰开揉碎来讲清楚。
西安交通大学研究团队发现,即使施加了高斯正则,模型学习到的潜变量分布仍可能呈现明显的重尾现象,即少量潜变量远离主体分布,形成极端表示。
一个诞生于 1859 年的数学猜想,悬而未决 167 年,还挂着 100 万美元奖金。最近Anthropic 内部有人给尚未发布的 Claude 研究版本布置了一个近乎「不讲道理」的任务。
今天我们从"程序为什么需要链接"出发,一步步把链接器推导出来。明白了链接器做了什么,这些报错都不再神秘。
能否不靠蒸馏、不靠测试时的大量开销,而是让模型在训练阶段就学会“在不确定时主动去检索”,把检索调用自然地编织进自己的推理链条里。R1-Searcher 的回答是:把外部检索环境接入强化学习训练,通过结果导向的奖励设计,激励模型自主探索如何调用检索系统来解题。
Muse Glimmer,一个300亿参数的开源Agent模型,Apache 2.0协议,权重直接挂到了Hugging Face。
这是 “全球机器人灵巧操作之父” Matthew Mason 写在个人主页上的一句话:灵巧操作在于脑,而不在手。
本文主要介绍来自该团队的最新论文 Teaching Vision-Language-Action Models What to See and Where to Look,目前该论文已经被 ECCV 2026 正式接收,相关代码和模型已全部开源。
刚刚,A社官宣自家一个尚未公开的Claude研究模型,在黎曼猜想上取得了重大进展。它将满足黎曼猜想的黎曼ζ函数零点比例的下界,从41.6%提高到了67.2%。
早在 8 月 4 日,就有网友注意到 OpenAI 正在进行 A/B 测试,测试重点集中在提示词遵循能力和文字渲染上。
OpenAI 的一位研究员一句话扫射三大顶会:太多夸大其词和造假!
持有类似判断的,不是别人,正是十年前推动AlphaGo项目的DeepMind联合创始人哈萨比斯。
DeepSeek官方版还在路上,民间「最佳Harness」已经先杀出来了!
近日,北京航空航天大学洪晟教授团队在信息处理领域顶级期刊Information Processing&Management(IPM)上发表了最新成果。他们提出了一套名为BGA的噪声免疫神经蒸馏框架。
数据治理工程师转FDE,不是跨界,是升维。你的治理经验是地基,FDE的交付能力是上层建筑。地基已经打好,现在该往上盖楼了。
作为首个面向机器人三视角世界模型的评测榜单,TriWorldBench旨在建立更加全面的具身世界模型评价体系,推动世界模型从“视觉生成”迈向“世界理解”。
在聊Hutool之前,我们先理解一个根本问题——为什么Java开发者总是需要工具类?Java作为一门“严肃”的编程语言,它的标准库设计偏向底层和全面。好处是功能完备、稳定性高,坏处是——用起来太繁琐。
AI Agent正在把计算机从「接到问题后完成一次模型调用」,变成持续观察、推理、调用工具、修改环境并保留状态的运行系统。