🔥热词:发布

今日头条   小米发布会
新浪新闻   小米发布会
2026 年 9 月 22 日 ,拓竹科技正式发布消费级 CO₂ 激光切割机 R1。 作为一款55W 高功率 CO₂ 激光加工设备,R1 独家搭载了自动光路校准功能,将过去只能手动、耗时十几分钟的专业调试,简化为一键即可完成的常规操作;并采用雕刻+切割的双能设计,配合可穿仓进料的结构,可处理最长3 米的超长原料;再加上由双摄像头、双测高激光与双编码器组成的三重定位系统,R1 把原本属于专业工作室的加工精度与使用门槛,一并带到了家用桌面上。 从一块黑胡桃木胶合板到一件精美作品,如今只需要一张桌子、一台机器即可完成。 第一次让消费级 CO₂ 激光设备实现自动光路校准 “光路校准”是 CO₂ 激光设备特有的一道维护工序。CO₂ 激光的光束需要经过多面镜片反射,才能最终传导到激光头;一旦镜片因搬运、维护或更换激光管而发生细微偏移,光路就会跑偏,直接导致切割功率下降、精度变差,严重时甚至无法正常工作。传统方式下,校准普遍依赖手动完成——在镜片前贴上美纹胶纸,打一枪测试点,根据焦痕判断偏移方向,再手动微调镜片角度,如此逐面镜片、反复试打。这套流程对熟练者也要花十几分钟,对新手更是无从下手,是许多人使用 CO₂ 激光时最劝退的一环。 R1 配备了光路校准传感器,将传感器安装至激光头后启动自动光路校准,系统即可自动识别偏移并完成修正,”一开、二放、三校准”,最快一分钟即可完成,全程无需胶纸、无需试打、无需拧螺丝,一项原本需要经验和耐心的技术活,就此变成了人人可做的日常操作。 雕刻、切割双能,最长加工3米原料 R1 搭载 55W 高功率 CO₂ 激光,不仅能雕刻,也能切割,一台设备覆盖两种加工方式。它支持木材、亚克力、皮革、纸材、纺织品、EVA 泡棉、贝壳片等多种材料的雕刻与切割,并可在玻璃、陶瓷、涂层金属等表面雕刻。 相比桌面场景常见的二极管激光,CO₂ 激光穿透力更强、边缘碳化更少,亚克力可切、玻璃可雕,最厚能切透 18mm 黑胡桃木胶合板与 20mm 亚克力。此外,R1 采用可穿仓进料的结构设计,突破了封闭机身的尺寸限制,能够加工超出机身长度的长料——无论是长条木板、整卷布料还是大幅面材料,都能一次成型,可胜任更多小微商业量产与大尺寸创作的需求。 三重定位系统+主动振动补偿,质量和速度兼得 定位与运动精度直接决定成品质量,也恰恰是消费级激光设备的普遍短板。R1 由双摄像头、双测高激光与双编码器组成一套完整的感知体系:全景摄像头统览工作区、俯视摄像头锁定加工对象,解决”在哪加工”;测高激光实时读取材料表面高度、自动对焦并标示加工位置,解决”加工多高”;XY 轴编码器实时回传运动坐标,解决”如何移动”。 三路数据协同之下,让R1对加工对象的位置、高度与运动轨迹形成完整感知,共同保障加工的定位精度与运动精度。拓竹早在旗舰机型 H2D 上就已将高精度摄像头与计算机视觉算法引入激光场景,R1 在此基础上完成了面向消费级的优化与下放,让高端设备才有的视觉定位能力走进更广泛的个人创作场景。 现有激光加工设备在雕刻复杂图案时,常因机械共振陷入两难:要么为保证质量而降速,要么维持速度却牺牲精度。R1 搭载主动振动补偿技术,可抵消拐角处的机械振动残留,最高雕刻速度达 1000 mm/s、加速度达 20000 mm/s²,在提升精细加工速度的同时兼顾精度,加工效率较传统设备明显提升。 个人制造体验,从此更进一步 R1 完整承接了拓竹既有的生态:共用 MakerWorld 与拓竹账户,沿用 Bambu Suite 工作流,支持 Windows 与 macOS。对已在使用拓竹打印机的用户来说,几乎无需重新学习即可上手。3D 打印负责结构与配件,R1 则补足了打印难以覆盖的材料与工艺——木材、亚克力、皮革、玻璃、石材乃至涂层金属,两者相互衔接,让”从设计到成品”更完整地落在同一套生态里。 R1 面向一批清晰的人群:已在使用拓竹打印机、希望拓展创作材料的创客;寻求低门槛量产工具的小微商家与工作室;需要一站式处理日常切割与长料加工的木工与手作爱好者;以及在玻璃、石材、金属和曲面上做个性化雕刻的设计师与定制卖家。 当下,激光加工正加速从工业场景向消费级、桌面级市场渗透。谷子经济、潮玩娃衣、个性化周边定制等趋势的兴起,让消费级激光设备逐渐从小众工具走向大众创意与小微商业的智造入口。从集成激光功能的 H2D,到独立成品类的 R1,拓竹正把 3D 打印领域积累的算法、硬件、视觉定位与生态运营经验,稳步迁移至激光加工赛道,让更多人以更低的门槛把创意变成现实。
9月20日,上纬新材旗下消费级具身智能品牌启元机器人在上海西岸梦中心举行全球首场新品发布会,以“我和我的个人机器人”为主题,正式发售启元Q1、启元T1两款个人机器人,其中,启元Q1售价19999元,启元Q1探索版售价26999元;启元T1售价19999元,启元T1 Pro售价29999元,并同步公布品牌、技术、产品与生态战略。本次发布会采用多城联动模式,上海、广州、深圳、杭州、厦门、西安、武汉等城市同步开启线下体验活动,让消费者在“家门口”也能体验到前沿具身科技的魅力。 作为粤港澳大湾区核心引擎与商贸之都,广州持续迸发 “科技 + 生活” 融合活力。启元机器人广州门店落子天河区商圈,让具身智能从展台走进真实消费场景,为广州消费升级与智能生活场景写下创新注脚。 现场,启元Q1、启元T1全程投入展示,花式秀绝技,迅速成为现场焦点。作为全球首个个人机器人,启元Q1现场展现出灵活丝滑的姿态控制、贴心细腻的智能应答、趣味满满的互动玩法,产品还支持软件零代码编排,硬件3D打印DIY等自定义玩法。启元T1采用行业首创的Transformer跨形态一体化架构,可在轮足人形与四足形态间自主无缝切换,能够智能跟随,还可联动运动相机完成跟拍、绕拍等多样玩法,从室内跟到室外,成为你的拍摄搭子。 两款产品兼具颜值与硬核能力,引得众多市民到店打卡体验,现场人气高涨。更有不少消费者现场锁单,抢先解锁属于自己的个人机器人,让「我和我的个人机器人」不再停留于想象。 此前,启元Q1、启元T1已亮相2026世界人工智能大会,以动态巡游、实景交互等形式打破静态陈列;在ChinaJoy期间,启元机器人通过IP跨界联动、沉浸式逛展互动,让年轻用户直观感受个人机器人的个性化与生活化。此外,启元机器人还在全球消费科技领域的重要展会“德国柏林国际消费电子及家用电器展览会”等国际舞台包揽多项奖项、收获国际认可。从科技展会、潮流盛会,到城市商圈,启元机器人正一步步走出展厅,走进普通人的生活场景。 随着多城体验活动的同步启动,启元机器人多地门店建设节奏也在有序推进。目前,广州天河区正佳广场6楼尚品宅配×启元机器人广州体验中心已开启体验,上海、深圳、杭州、厦门、西安、武汉等城市门店也同步等待大家到场体验。除了线下零售门店,线上电商也可以下单。未来,启元机器人将持续拓展线下体验网络,让更多人在家门口也能直观感受启元Q1、启元T1 带来的人机交互新体验。
9 月 20 日,阶跃星辰发布新一代旗舰基座模型 Step 5 Preview,重点面向 AI 编程、软件工程、专业知识工作、金融等场景,提升模型在真实世界 Agentic 任务中的综合表现,在能力、成本、效率和场景覆盖之间实现良好平衡,进一步拓展智能与成本之间的最优边界。 在全球权威榜单 Artificial Analysis Intelligence Index(AA 综合智能指数)中,阶跃 Step 5 Preview 跻身全球开源前三。值得关注的是,该模型单任务成本仅为Claude Opus 5 的 1/8。据了解,阶跃将于 10 月 15 日正式开源 Step 5 Preview。
2026 年 9 月16日,华为坤灵新品发布会2026在上海举行。华为常务董事、ICT BG CEO 杨超斌宣布,华为坤灵全面升级 “4+10+N” 一站式场景化方案,发布 20 款新品,并面向中国分销伙伴发布“经纬计划”和 50 个样板点,让智能世界触手可及。 围绕四大特质,升级 “4+10+N” 场景化方案 在企业加速智能化转型的过程中,网络、存储、安全成为高效释放AI算力的关键要素。但在分销市场,企业仍存在共性挑战,包括产品功能单一、跨产品集成难、部署周期长、运维效率低等。 为解决以上挑战,华为坤灵围绕“化繁为简、开箱即用、智驭智维,品质普惠”四大特质,聚焦智能办公、商业、教育、医疗四大核心场景、十个场景化方案及N个明星产品,全面升级 “4+10+N” 场景化方案。 化繁为简:发布业界首个网络安防融合一体机 AR281、酒店宝 F1004 等产品,通过一体化多产品融合,用更少的设备,带来更强的能力,简化产品集成,降低交付门槛。 开箱即用:发布数字诊疗 IT 平台,集 FusionCube Nemo 630 超融合、存储及网络于一体,实现一套系统支撑影像、信息、病历等多种业务,通过场景化方案预集成,让业务上线更高效,系统运行更可靠。 智驭智维:推出“小灵智能体”,通过智能化装维工具,具备智能配单、智能组网、智能排障等核心能力,让非专业人员也可轻松驾驭配单、组网和运维。 品质普惠:发布交互式协作平板 IdeaHub B3 Base 和企业级 Wi-Fi 7 无线路由器 Aura10,通过流程化硬件设计与品控,将华为企业级严苛质量要求融入生产工作场景,以高可靠的产品,降低故障风险。 杨超斌表示:“全场景智能化前景广阔,华为坤灵将坚定围绕‘4+10+N’持续打造一站式场景化方案,把复杂留给自己,把简单留给客户和伙伴。” 发布“经纬计划”及 50 个样板点 为更高效服务客户,华为坤灵发布“经纬计划”,通过全域联动 1.5 万多家工程商伙伴,构建覆盖全国 300 个城市的销售与服务网络。目前,华为坤灵已在全国 300 个城市的核心商圈、电脑城、工程商密集区域,识别1万多个网格,极大拉近华为坤灵与最终用户的距离,提升服务响应速度。 同时,华为坤灵发布 50 个样板点,为广大客户提供智能化实践参照,助力更多企业走好智能化转型之路。
9月15日,荣耀在深圳召开了荣耀开发者大会运动健康技术沟通会,宣布荣耀运动健康战略全面升级,进入主动智能健康管理时代,未来将持续以创新技术赋能大健康生态发展,宣布新一代旗舰智能手表荣耀手表6 Pro将于9月28日正式发布,这也标志着荣耀运动健康从“被动记录”迈向“主动守护”的全新阶段。 沟通会上,荣耀终端有限公司产品线总裁方飞发表主题演讲,她表示:“运动健康将成为荣耀AI生态的重要战略支点,荣耀将继续聚焦感知技术、健康研究、AI能力与开放生态。”此次战略升级,源自荣耀运动健康十年积淀。自2016年起,荣耀便开始构建运动健康体系,凭借AI技术与专业医疗机构的合作,实现从单一硬件到全场景智慧健康生态的跨越,率先落地心脏停搏预警、血糖、血压等前沿健康数据监测管理功能,推动健康守护从日常监测迈向生命守护。 “生命至上,在所有健康风险中,最危险的情况之一就是心脏停搏。”方飞在演讲中强调,心脏停跳4分钟以上即可能造成不可逆的脑损伤。心脏健康监测管理作为荣耀手表的核心优势之一,始终处于行业第一梯队,荣耀手表6 Pro携手知名医疗机构开展联合研究,将行业首发的“心脏停搏预警”功能带入智能手表。该功能通过双波长基准识别、多波长交叉核验、强光终极探查和用户行为识别四个递进阶段进行综合研判,并建立低、中、高、极高风险四级响应机制,一旦检测到心脏骤停即自动触发主动社会求救,率先实现智能穿戴在心脏骤停极境下的主动求救能力。 区别于传统智能手表的“心率过低提醒”,荣耀手表6 Pro能够在心脏停搏升至极高风险乃至骤停时自动触发紧急呼救,为佩戴者争取宝贵的抢救时间,手表会立即拨打紧急电话,并启动包含高频声光呼救与屏幕高亮警示的全面提醒,让周边群众快速意识到异常并及时施救,为独居老人、熬夜白领及高强度运动人群牢牢守住黄金4分钟。从日常监测到主动求救,荣耀手表6 Pro实现了从“预警”到“急救”的完整健康守护闭环,也引领智能手表行业从“被动记录提醒”走向“主动社会求救”。 “主动健康管理的基石,是高精度的底层感知。没有高质量的数据,再往上的健康管理就会成为空中楼阁。”方飞表示。荣耀自研的灵瞳感知系统历经三代演进,从第一代两通道、三波长升级为第三代九通道、四波长的分布式布局,通过多点布设全面扩容感知信道,达到行业领先的九通道。再结合460纳米蓝光与控光玻璃方案滤除无效光干扰,使底层光学效率提升83%、动态信号质量提升26.9%。依托该系统,荣耀手表在日常运动场景下的心率准确率达到行业领先的99.09%,为血压和脉搏评估奠定了高保真数据基础。 除了上述功能外,荣耀手表6 Pro更带来了全面健康监测功能,其搭载防猝筛查、脉搏波房颤及早搏提示、全天HRV监测、ECG心电检测及三甲医院医生人工解读等专业健康功能,并随机附赠全国三甲医院门诊协助挂号服务,实现“手表发现风险,荣耀帮你挂号”,真正做到全天候多维度守护用户的健康。 运动健康一直是荣耀手表的强项,荣耀手表6 Pro搭载北极星定位系统,结合GPS波形融合算法、惯性导航纠偏和AI大模型持续学习,支持双频高精度定位,满足户外运动轨迹记录。 在专业运动层面,荣耀手表6 Pro内置专业羽毛球、专业足球与越野跑等多种运动模式,覆盖不同运动人群的进阶需求。专业羽毛球模式可精准识别6种挥拍动作,并输出20项运动数据,帮助球友清晰掌握每一次挥拍细节;专业足球模式生成热力图与轨迹图,直观呈现场上跑动表现,为赛后复盘提供数据参考;越野跑模式支持轨迹导入、偏移提醒与循迹返航,结合高精度高度表与气压计,实时呈现累计爬升、坡度变化等关键数据,助力跑者从容应对复杂地形与多变路况。 荣耀手表6 Pro以“先锋旗舰质感”为设计原点,融合高级腕表的奢华工艺与现代机能线条,重塑腕间美学。经典圆形表盘配备1.5英寸像素光刻屏,峰值亮度高达5500nits,支持高亮AOD常显,户外强光下依然清晰通透。拥有精钢黑、精钢黄、陶瓷黑、陶瓷棕、陶瓷银五款配色,细节彰显独特品位。 荣耀运动健康“战略升级”的发布,标志着荣耀在运动健康领域从“技术创新”到“生态引领”的质变跃迁,以创新技术不断突破行业边界,为用户带来更科学、更精准、更完善的腕上健康守护。在谈及荣耀下一步的探索时,荣耀终端有限公司产品线总裁方飞表示:“可以说,荣耀已经进入了行业无人区。血糖研究现在只是起步。未来,血糖研究将与血压研究一起,为我们打开更大的想象空间。荣耀将携手更多合作伙伴一起不断向前探索。”此次荣耀运动健康战略升级所勾勒的主动健康及运动监测能力,将在9月28日正式发布的新一代旗舰智能手表荣耀手表6 Pro上集中呈现,为每一位用户带来更智能、更全面的健康守护。
智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0 今天,智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(模型简称 HD-V1)。HD-V1采用智象自研原生全模态架构,支持文本、图片、视频等多种模态输入,可一键直出5–20秒1080p高保真视频,同时 在意图理解、物理规律理解、自主规划叙事、以及音画一体化生成等维度均全面升级,达到全球领先水平。 发布同期,HD-V1 在两项国际权威评测榜单中,均位居世界前列。在全球领先的独立 AI 基准测试与分析平台Artificial Analysis Image to Video Leaderboard(With Audio)排行榜上,HD-V1 取得全球排名第四的佳绩。Artificial Analysis 的图生视频榜单以标准化、可复现的基准对全球头部视频生成模型进行系统评测,被视为衡量AI视频模型综合实力的重要标尺。 在全球最具影响力的AI 模型盲测评测平台 Arena.ai Image-to-Video 中,HD-V1也取得了第8的优异成绩。Arena.ai Image-to-Video是专注于AI视频生成模型的盲测评测子平台,是目前评估图生视频模型能力的重要第三方参考,被全球国际主流 AI 厂商广泛引用。 放在全球 AI 竞争格局中看,这一成绩的意义远超名次本身:多模态是当下全球人工智能的核心战场,图生视频则是其中技术密度最高、竞争最激烈的方向之一。HD-V1 以双榜高位成绩完成全球首次亮相,这标志着中国优秀大模型企业已全面领先,形成全球AI视频模型第一梯队 。 智象未来 CTO 姚霆表示:“HiDream-O1-Video-1.0 是智象原生全模态世界模型矩阵的关键组成部分。我们始终相信,视频生成的代际进化不仅仅是像素的提升和时长的延续,而在于模型是否真正理解创作者的意图和真实世界的物理规律。HD-V1从架构设计之初便面向文本、视频与音频的统一表征,原生全模态技术使之从‘看得清、动得顺’,迈向‘听得懂、说得准、演得连贯’。这次在两项国际权威榜单中再次进入第一梯队,是对智象原生全模态技术路线最直接的验证。” 01.原生全模态,更懂意图、更懂物理 视频生成的难点,往往不在“会不会画”,而在“有没有听懂”。用户输入常常是口语化、碎片化、模糊化的信息。直接输入丢给模型,很容易出现意图漏解、镜头跳戏、人物漂移与音画错位等问题。 为此,HD-V1的设计中 前置多模态意图理解模块,借助多模态理解模型的深度理解与思考,对视频内容进行结构化规划。规划内容包括镜头时长、场景地点、画面内容、首帧约束、在场角色、动作与表情、景别构图、运镜焦段、台词与背景声等音效设计等等字段。该模块的存在,保证模型充分理解用户自然语言输入的意图,并转换成模型可接受的专业表达。理解越深,规划越稳;规划越稳,后续联合生成越不容易“跑偏”。 理解意图只是第一步,HD-V1的另一重要突破,是“更懂物理”。 物体在重力作用下如何落下、碰撞如何反馈、惯性如何延续、光影如何衰减、空间如何保持连续——这些物理规律既被理解,也被写进视频模型的叙事之中,成为画面生成的底层逻辑。 当物理规律进入生成逻辑,画面的真实质感得到全面提升。以下三组demo,是在同样的提示词下,三款业内顶级模型生成的视频对比,第三个demo为HD-V1生成(全文均同)。 模型一的画面中,双手相向发力,红线产生了向内缩短的“不合理”现象;模型二则突兀地凭空生出一根针。而HD-V1生成的画面截然不同:双手相向发力时,红线自然隆起,与模型一形成鲜明对比;当左手拇指向外轻捻线头,红线便随手的发力顺势延展,张力、走向与形变皆贴合真实物理。而且画面还有着极佳的真实质感,指甲的纹理,针的金属感等都表现得非常真实,甚至从中能感受到线的柔韧。 02.画面高保真、叙事连贯性、人物一致性全面升级 针对高保真画质、叙事连贯性与人物一致性等关键指标,HD-V1实现了全面优化升级。它不只追求单帧画面的精美,更要让视频内容在整体叙事维度上自洽。 当人物、情绪、动机、物理规律,一旦进入连续镜头,就必然互相影响。为此,智象提出了 “先规划、后联合生成、再以多模态 Reward 对齐”的技术思路 ,让模型先在全局层面规划叙事与角色状态,再在联合生成中约束画面、动作和语义,最后用多模态奖励信号对齐画质、连贯性与物理合理性。 03.服从叙事内容视频生成时长的逻辑革新 多数视频生成时长遵循的是固定提示词路线,比如用户在提示词中输入生成 5 秒,模型只能在这个时间窗口内填充内容,内容叙事“被迫”适应时长。 HD-V1的做法,是 把时长决策交还给内容本身 。模型根据事件展开的逻辑、动作完成的周期、叙事推进的节奏,自行规划生成时长。这一能力的关键,不在于简单改变帧数,而在于把时长选择与内容情境绑定,服务用户真正的目标——在连贯叙事中交付合理、真实质感的完整画面。 同样是三款模型的真实对比。前两款模型都“机械地”生成了10秒钟画面,但一颗苹果从抛出到接住,本是一个短促的过程,并不需要撑满10秒。于是,模型一在动作完成后,从第三秒起只能让手继续握着苹果,画面停留在无意义的等待里;模型二则用慢放的形式,来填补时长。而HD-V1生成的画面,人物抛出、接住、稳定手持,节奏自然发生。 04.文本、视频、音频信号联合建模音画原生一体化生成 音画不同步是AI视频生成模型的一个普遍通病。这是因为当前多数视频模型采用的后期拼接技术路线:先逐帧生成画面,再回头配音配效,声音跟画面很难保持一致。 HD-V1 采用了原生全模态架构,对文本、视频、音频信号进行联合建模 。三者在同一生成过程中相互约束、相互对齐:画面运动牵引声音节奏,台词与音效反哺镜头情绪,文本条件贯穿始终。这种联合建模,直接服务于音画同步与叙事连贯。镜头切换时,环境声与配乐随之过渡;人物开口时,口型、气口与情绪同频;物理动作发生时,拟音效果与撞击反馈更贴近真实因果。 这是一个乒乓球在桌子上弹跳的画面。从三款模型生成的画面来看,只有HD-V1生成的内容,不仅乒乓球掉落的节奏符合物理规律,每次掉落的声音也随着高度的变化而变化,完全符合现实质感。实现真实世界的质感,根源在于模型的技术产品哲学:以人的感受为尺度。为此在后训练阶段,采用 Diffusion Reinforcement Learning,并设计与人工认知对齐的多模态 Reward 模型,对音视频内容进行从画面到声音、从局部到整体的统一评估。 05.世界模型闭环成型从单点能力到原生全模态矩阵 从今年4月正式发布原生全模态世界模型架构HiDream-O1以来,智象陆续发布了基于同一架构的模型家族,这几款模型也分别在各自赛道上取得国际权威榜单的领先位置。 图像生成模型HiDream‑O1‑Image系列 ,其中商用版1.5 版本在国际独立评测平台 Artificial Analysis 文生图榜单中,取得中国第一、全球第二的成绩;开源版本也取得了第二的成绩。 交互式世界模型 HiDream‑O1‑World ,名列行业首个交互式世界模型基准 WBench综合总榜第一。 具身世界模型 HiDream‑O1‑Embodied ,先后在 RoboColiseum的扰动适应和空间推理子榜单中登顶榜首。 随着视频模型正式发布,业内首个原生全模态世界模型闭环就此成型。图像、视频、3D交互与具身动作,在统一原生的世界模型中交汇、共生、循环。 智象创始人梅涛博士表示:“基于我们对下一代人工智能技术路线的认知,智象致力于构建 ‘一个原生全模态底座、四大模型同源演进’的模型矩阵。我们所构建的,不是四条彼此独立的能力线,而是一套以统一技术架构为底座、面向世界模型持续进化走向可落地的原生全模态体系。” 06.C+轮融资落定,国资产业资本组团再加码 在HD-V1发布之际,智象同时宣布完成C+轮融资。本轮投资方为 新微资本、交子资本、工银资本 ,体现了资本市场对公司原生全模态技术路线、世界模型布局及产业化潜力的高度认可。 新微资本由上海新微科技集团、上海科创投集团以及管理团队共同发起成立,管理基金规模近百亿元。作为新微集团的CVC,新微资本正持续加强在人工智能赛道的布局,依托新微集团在集成电路特色工艺制造领域的产业基座,构建在AI时代具备持续竞争力的新微产业生态。 新微资本表示:“智象未来的原生全模态世界模型矩阵,向上连接算力与AI基础设施,向下延伸至智能终端与行业应用,与新微集团的产业布局高度协同。未来新微将以制造能力支撑算力基建,以产业资源加速模型落地,助力智象未来占据世界模型时代的关键席位。” 交子资本是成都交子金控集团旗下全资国有股权投资平台,也是成都建设西部金融中心的重要产业资本载体,管理基金规模超1700亿元。依托成都、辐射西部、链接全国,交子资本聚焦人工智能等硬科技赛道,以长期资本和产业资源推动科技成果转化与产业生态建设。 交子资本相关负责人表示:“智象未来持续推动图像、视频、3D交互与具身四大模型同源演进,围绕底层架构持续创新,构建原生全模态世界模型矩阵。这一路线在行业中具有鲜明的稀缺性和领先性。HiDream-O1-Video-1.0的发布补齐了模型矩阵的关键一环,进一步验证了公司技术路线的前瞻性与落地能力。我们期待发挥国有产业资本的长期陪伴与资源协同作用,助力智象未来成长为具有全球竞争力的AI企业,并带动成都、辐射西部人工智能产业生态建设。” 随着HD-V1视频模型的发布,从原生全模态通往世界模型,不再只是一张战略蓝图,而是闭环发展、持续演进的现实。
2026 年9月 15日 – MediaTek 今日发布天玑9600 系列旗舰 5G 智能体AI芯片:天玑 9600 Pro 和天玑 9600M。作为旗舰移动芯片的划时代之作,天玑 9600 Pro凝聚了振奋人心的诸多革新和突破,不仅汇集天玑超性能、超能效的基因级优势特性,更拥有为智能体体验而生的先进AI 技术,以及可持续推动体验进化的丰富生态,将前沿技术变为用户可感知的卓越能力,实现全场景旗舰体验的跃升。 天玑 9600 Pro 采用全新的AI 原生架构设计,先进的台积电 2纳米制造工艺辅以 MediaTek 台积电设计工艺协同优化,造就了突破性的超性能和超能效,赋能智能体 AI 手机新体验。 天玑 9600 Pro 焕新的2+3+3全大核 CPU架构包括 2 个主频高达 4.55GHz 的 C2-Ultra 超大核,3 个主频为 4.35GHz 的C2-Pro 大核以及 3 个主频为 3.1GHz 的 C2-Pro 大核,拥有更大容量的 34.5MB缓存架构(L2+L3+SLC),并率先支持更高速的 LPDDR6 内存和 UFS 5.0 闪存。天玑 9600 Pro 的单核性能相较上一代提升17%,多核性能提升 15%,多核功耗相较上一代峰值性能下节省 61%。 天玑 9600 Pro创新的天玑智算融合架构,将全面焕新的CPU与 NPU 深度协同,构成强大的AI 计算底座。此外,该芯片还升级了天玑调度引擎,软硬件协同精准调动算力、电源和内存资源,助力手机厂商打造既快又省电、多应用全保活的系统和AI 体验。 MediaTek 长期深耕 AI 领域,致力于推动 AI 应用创新,透过技术革新与生态合作,持续重构和外拓智能体手机能力的边界。天玑 9600 Pro 集成天玑引以为傲的双 NPU 架构和智能体化 AI 引擎,具备强大的主动式感知和执行能力,并兼顾系统级 AI 隐私安全保护。 全新第二代超能效 NPU 融合低功耗传感器中枢,功耗相较上一代大幅节省40%,让智能体实现低功耗长续运行,为移动设备提供卓越的全时感知能力,提供持续在线的主动服务。超性能 NPU 1090 面向当下和未来的复杂端侧 AI 应用而打造,大语言模型预填充性能相较上一代大幅提升 51%,每瓦特生成词元数至高可提升 55%。天玑 9600 Pro 的新一代生成式 AI 引擎 3.0,INT4运算能力翻倍提升,并支持Hybrid Attention(混合注意力)运算和新一代大模型压缩技术,同时可支持高达 30B 的MoE 混合专家模型端侧运行,为万千创新 AI应用提供强劲算力。此外,天玑 9600 Pro 还提供了先进的天玑 AI智能体化引擎 3.0 ,与广泛的生态伙伴共同打造新奇、实用的智能体化新体验。 天玑 9600 Pro 搭载旗舰 G2-Ultra NX GPU,其峰值性能相较上一代提升 27%,功耗相较上一代峰值性能下节省24%,光线追踪性能提升18%。该芯片采用全新的天玑神经网络渲染架构,结合GPU 和AI 计算单元的强大算力,助力移动游戏画质实现跨越式突破,让玩家畅享高分辨率惊艳画质。 此外,天玑 9600 Pro 还支持185 帧超高帧率游戏,打造酣畅淋漓的电竞级满帧流畅表现,助力玩家在瞬息万变的对战中快人一步,锁定胜局。诸多先进的天玑星速引擎游戏技术还包括第三代光线追踪引擎、天玑 OMM 光追硬件加速技术,焕新升级的倍帧技术 4.0,并在天玑平台率先落地Ray Tracing Pipeline 技术。天玑 9600 Pro以强悍冷劲的软硬件技术和广泛的游戏生态合作优化,为玩家带来超畅爽、超沉浸的感官享受,将主机级游戏体验推向新的高度。 天玑旗舰深入人心的专业影像,是成就非凡佳作的关键所在。天玑 9600 Pro 集成Imagiq 1290 图像处理器,采用天玑智能影像架构,实现ISP 与 NPU融合计算,为内容创作者带来卓越出众的拍摄体验。该芯片支持全景深计算光学影像技术,通过NPU 协同计算来精准合成多景深的画面,令照片的远近画面细节皆清晰;还支持超性能NPU 协同追焦硬件引擎赋能的60fps 专业运动级追焦技术。视频录制方面的创新包括:率先带来 4K240 原生直出超高速慢动作录影、支持 CSISP 4K60 电影级视频直出和 4K120 电影级 Log 原色视频直出,还支持微单级17EV高动态影像技术,不论是日常生活还是专业生产力需求,都能让用户从容驾驭高品质的全场景内容创作。 MediaTek 天玑 9600 Pro的特性还包括: •多帧OverDrive 面板响应补偿技术:1nit 极暗屏动态清晰,视频观赏不拖影 •支持全链路 BT.2020 规格:色彩真实呈现,可视色彩丰富度较 DCI-P3 提升 38% •支持新一代H.266硬件解码:功耗较 VCC 软解码至多节省 23% •天玑 AI 蜂窝选网技术 2.0:智能切换蜂窝基站,大幅降低网络卡顿时长 •天玑 AI Wi-Fi 速率调校技术:信号密集环境下借助AI推理实现更佳的传输速率,游戏直播不卡顿 •天玑 AI 定位技术 2.0:智能选星提升定位精准度,打车不绕路 •前沿漫游信号共享技术:跨境三卡在线,短信语音不漏接 •先进蓝牙连接技术:来电及时转接,双机用户电话不漏接 天玑 9600M 搭载性能强劲的旗舰级计算核心,承袭天玑芯片家族一脉相承的高能效特性,通过影像引擎、天玑 AI智能体化引擎 3.0、天玑调度引擎以及星速引擎的软硬件高效协同,并融合旗舰级多元技术,为用户带来杰出的影像、AI、游戏和通信等旗舰体验。 天玑 9600M 的 ISP 图像处理器结合强劲的NPU算法加速,可提供专业的高画质、实时追焦影像能力;天玑 AI智能体化引擎 3.0 为移动设备带来全时感知和主动协作的 AI 能力,助力打造懂用户、有温度的智慧体验。天玑调度引擎则通过实时且准确的算力调控,赋能系统和应用具备高速响应;游戏方面,借助旗舰级的天玑神经网络渲染架构,可大幅提升画质体验,同时天玑星速引擎的多元技术不仅为玩家带来185 帧流畅快感,更可节省功耗让高能畅玩更持久。首批采用MediaTek天玑9600 Pro 和天玑 9600M芯片的智能手机将于近期上市。
9月15日,阶跃发布新一代语音大模型 StepAudio 3 系列,一次性推出 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music 五款模型,覆盖实时语音交互、语音识别、真人级语音生成和音乐创作等场景。其中,多款模型在权威第三方 AI 模型评测机构 Artificial Analysis 榜单中位列全球第一。 相比过去主要围绕语音识别或语音生成等单项能力展开竞争,StepAudio 3 将能力进一步延伸至语音理解与生成、实时推理、任务执行和音频创作的全栈能力,让 AI 不仅能够“听”和“说”,也能够理解声音背后的语义与情绪,并参与更完整的交互和内容生产过程。 其中,面向实时语音交互场景的 StepAudio 3 Realtime 支持原生全双工对话,可以在持续交流过程中判断何时回应、何时等待,并处理临时打断和连续反馈。在 Artificial Analysis Conversational Dynamics 榜单中,该模型以 98.9% 的综合得分排名全球第一。 与传统实时语音模型主要追求低延迟和自然对话不同,StepAudio 3 Realtime 还进一步加入了语音推理和任务执行能力。模型能够同时理解语义、语气、情绪及环境声音,并支持推理与语音生成并行;Tool Call 和长任务则可以异步执行,在任务运行期间不打断当前对话。其在 Artificial Analysis Speech Reasoning 榜单中同样位列全球第一。 在语音识别方面,StepAudio 3 ASR 将高精度识别与大语言模型的上下文理解和知识能力结合,不仅要解决“听清楚”,也进一步提升对专业术语、人名、地名、方言及复杂上下文的理解能力。 该模型支持中文、英文、方言、中英混说、长音频和专业领域等多类场景,并针对低声、快速语音、含糊连读以及背景音乐等复杂输入进行优化。在 Artificial Analysis 非流式语音识别准确性榜单中,StepAudio 3 ASR 的 WER(词错误率)为 1.7%,并列全球第一。WER 越低意味着转写错误越少,该成绩意味着模型在第三方综合测试中的语音识别准确率已处于全球第一梯队。 除实时交互和语音识别外,此次发布也进一步拓展了语音生成模型的能力边界。 StepAudio 3 TTS 面向真人级语音生成,在音色、语调、节奏、停顿和情绪表达之外,还能够生成笑声、迟疑、重复、改口等真实交流中常见的副语言表现。该模型采用流式生成架构,可实现生成与播放同时进行,满足实时语音应用需求。 StepAudio 3 Gen 则进一步将人声、音效、环境声和背景音乐等原本分散的生成环节整合到在一起。用户可以通过自然语言描述角色、场景和剧情,一次生成包含多种声音元素的完整音频,并控制角色音色、情绪以及不同声音出现的时间与顺序,广泛适用于影视、动画、游戏、广播剧、有声书和短视频等内容生产场景。 面向音乐创作的 StepAudio 3 Music 不再局限于“一句话生成一首歌”,而是支持歌曲创作、清唱配乐、歌曲翻唱以及基于 ABC 记谱法的多轮交互创作。用户可以通过歌词、清唱、参考歌曲等不同形式与模型共同完成编曲和作品迭代,使 AI 更深入参与实际音乐生产流程。 过去一年,语音大模型正从单项的语音识别和生成能力,逐渐走向实时交互、声音理解与内容创作的融合竞争。随着 StepAudio 3 系列发布,阶跃音频模型的产品版图,已经全面覆盖了听、说、理解、推理和创作。 目前,StepAudio 3 系列五款模型均已上线阶跃星辰开放平台。
近日,大晓机器人联合南洋理工大学S-Lab等机构发布并开源统一多模态世界模型框架Puffin-World。作为面向空间智能与具身智能的成果,Puffin-World首次在一个统一多模态框架中,将物理、几何和外观定义为三种原生的三维世界状态,并贯通重力场感知、自由视点空间仿真、三维世界生成与重建以及闭环探索,预测机器人行动后世界将处于什么状态。 Puffin-World同步开源代码、模型和Puffin-16M数据集,包括1500万组视觉—语言—相机三元组和100万条具有挑战性的旋转轨迹,并开放覆盖28个公开数据集、约4450万张图像的绝对相机位姿标注,为机器人仿真、合成数据生产与具身智能训练提供可复现、可扩展的技术底座。 针对机器人训练来说,需要的并不是一段视觉上逼真的视频,而是能够支撑感知、定位、规划和行动的环境信息:当前相机处于什么姿态,重力方向是否稳定,场景结构如何延续,机器人移动后将看到什么。图像只是世界状态的一部分,物理方向、空间几何和视觉外观共同构成机器人真正需要的训练环境。 统一构建三种原生状态——物理、几何与外观 Puffin-World从三维世界状态本身出发,将其建模为三种相互关联的原生状态: 三种状态共同构成从“世界如何存在”到“世界如何被交互”的完整表达。模型生成新视角时,不仅要回答画面应该是什么样,还要保证该画面在物理方向和三维结构上成立。 为统一绝对方向和跨视角运动,Puffin-World提出Omni-Camera相机表示,将重力锚定的绝对相机信息与基于射线的相对几何结合起来。模型先从参考图像中精确理解相机的横滚角、俯仰角和视场角,再通过物理传播机制,将参考视角中的重力信息传递至后续视角。 即使相机经历连续旋转和长轨迹移动,整个生成过程也拥有一个稳定的物理参照系。地平线不会随意漂移,场景的上下关系不会在运动中失真,生成视角与目标相机轨迹也能保持一致。 Puffin-World还在同一次生成过程中联合输出RGB外观和深度几何,使生成结果能够直接用于三维重建,而不必在视频生成之后再依赖独立的深度估计模块补充空间结构。由此,世界生成与世界重建不再是前后割裂的两个步骤,而成为同一个状态预测过程。 一个模型完成四件事,从理解世界走向闭环探索 Puffin-World可以在一个模型中统一四类过去往往需要不同系统分别完成的任务。 第一,单图理解相机物理信息。输入一张图片,模型能够结合地平线、垂直结构和场景构图进行空间推理,预测相机相对于真实物理世界的横滚角、俯仰角和垂直视场角,同时生成场景语义描述。模型不仅识别“图中有什么”,还理解“当前视角以怎样的姿态看到了它”。 第二,自由视点空间仿真。除文字描述外,用户还可以明确指定相机方向和视场角。模型据此生成符合目标机位的画面,使文生图从内容控制进一步走向精确的空间控制。 第三,三维世界生成与重建。模型可以从文字、单张图像或少量参考图像出发,按照指定相机轨迹生成多个新视角,并同步预测每个视角的外观和深度。不同视角随后可以汇聚为具有一致空间结构的三维世界。 第四,闭环自校准探索。当相机姿态偏离重力方向时,模型可以先感知当前物理状态,再推理需要执行的修正动作,并生成动作执行后的目标观察,由此形成“状态感知—动作预测—结果生成—再次校准”的闭环,高效扮演World Action Model (WAM)角色。技术报告还展示了模仿式世界探索能力,即从同一初始视角出发,按照给定相机轨迹扩展并探索新的三维世界。 这四类能力并非四个模型的简单拼接,而是由同一套视觉、语言、相机和世界状态表征共同支撑。任务的变化不再依赖切换系统,而由输入内容、相机条件和视图角色决定。这种统一性,使Puffin-World更接近机器人从感知、推理到行动的完整工作链路。 1600万核心数据与4450万开放标注,扩大世界模型训练底座 世界模型能否理解复杂空间,很大程度上取决于训练数据是否同时具备视觉内容、场景语义、绝对相机信息和多样化运动。为此,团队构建了Puffin-16M数据集,包含两个组成部分。 Puffin-Cam-15M提供1500万组视觉—语言—相机三元组,覆盖室内、室外、真实和合成等多种场景,并包含不同分辨率、宽高比、相机姿态和视场角。它不仅告诉模型图像中有什么,还告诉模型这张图像是在怎样的相机观测条件下形成的。 Puffin-Traj-1M则提供100万条具有挑战性的旋转轨迹,覆盖连续俯仰、横滚、偏航、复合运动以及360度环视等复杂情况,重点补足传统三维数据集在大幅旋转和长轨迹探索方面的不足。 与主要描述视角之间相对变化的数据不同,Puffin-16M进一步引入相机相对于重力和真实世界的绝对方向。模型不仅学习“相机从上一帧移动了多少”,还要理解“相机当前在世界中处于什么方向”。 除自建数据集外,团队还利用Puffin-World精准的物理世界感知能力为28个公开数据集补充绝对相机位姿标注,覆盖约4450万张图片,包括ImageNet、CC12M、Objects365、ScanNet、DL3DV和GPIC等。标注内容包括横滚角、俯仰角和视场角,可用于研究不同视觉数据中的机位偏差,也可为相机条件生成、物理世界理解和空间智能训练提供大规模监督。 更重要的是,Puffin-World同步开放代码、模型和数据集。开源的不只是一个算法实现,而是一套从数据、标注、训练到评测的完整技术链路,使研究机构和产业开发者可以围绕机器人仿真、合成数据、虚拟现实、三维内容生产与具身智能开展后续开发。 四项SOTA,从相机理解到三维生成 Puffin-World的统一能力在四项Benchmark中取得SOTA成绩。 在相机到真实世界理解任务上,Puffin-World在Stanford2D3D、MegaDepth、TartanAir和LaMAR四个公开基准上取得最佳或并列最佳的中位误差,并在大多数AUC指标上领先。 其中,在Stanford2D3D上,Puffin-World对横滚角、俯仰角和垂直视场角的中位误差分别为0.29度、0.53度和1.62度,显示出较强的绝对相机理解能力。 在相机可控生成基准Puffin-Cam-Bench上,模型生成结果的上方向、纬度和重力方向中位误差分别为0.84度、1.26度和0.79度,FID为75.93,均优于参与比较的通用图像生成模型和已有相机可控生成方法。这意味着Puffin-World不仅能够生成质量较高的图像,还能让生成画面准确服从指定的相机状态。 在Puffin-Traj-Bench上,Puffin-World取得18.00的PSNR、0.613的SSIM和0.288的LPIPS;生成轨迹的横滚角、俯仰角和视场角中位误差分别为0.80度、1.10度和2.96度。其中,PSNR、LPIPS以及三项相机控制误差均取得最优结果。 在RealEstate10K三维世界生成测试中,Puffin-World取得17.22的PSNR、0.595的SSIM和0.318的LPIPS,三项视觉一致性指标均优于对比方法。 这些结果表明,Puffin-World并非只在单一任务上提高图像质量,而是在相机物理理解、灵活空间控制、几何一致性生成和三维重建之间建立了相互支撑的统一能力。 从“生成一段看起来合理的视频”,到“预测一个具有物理、几何和外观一致性的世界状态”,Puffin-World推动世界模型从视觉内容生成进一步走向可感知、可校准、可探索和可重建的三维环境。这也是世界模型真正进入机器人训练与具身智能应用所需要完成的一次范式转变。
新品尚未发货,我们继续整理了一些发布会中未提及的细节,不妨一起来看看有没有你感兴趣的。
9 月 10 日凌晨,Apple 召开新品发布会。推出了新一代的 iPhone 18 Pro 系列、Apple Watch Series 12、Apple Watch Ultra 4 以及 AirPods 5 系列。
9 月 10 日凌晨,Apple 召开新品发布会。推出了新一代的 iPhone 18 Pro 系列、Apple Watch Series 12、Apple Watch Ultra 4 以及 AirPods 5 系列。
上周,Apple公布了今年秋季发布会的时间和主题,这场名为「Surpriseandshine」的发布会将于北京时间9月10日凌晨一点在ApplePark举行。与过去两年的秋季发布会不同,今年的「科技春 ...
北京时间9月10日凌晨,Apple一年一度的秋季特别活动即将拉开帷幕,我们会在Keynote讲演环节中见到新一年度的iPhone、AppleWatch等多个新品。除了备受期待的iPhone18Pro系 ...
今夜,Anthropic没有任何预热,直接甩出了Claude Opus 5.5。这是Claude 5.5系列首款模型!Opus 5.5不仅性能追平了Fable 5.1,成本还要比上一代Opus 5低40%,输出速度狂飙30%。