全部 今日 本周 本月

GAIR Paper 108 | CVPR 2026 冠军奖论文:4K 参数撬动 VLA 泛化,空间才是真正的瓶颈!

机器人在新场景下失灵,根源不是不懂物理,而是空间表征错了——用极少参数校准这一层,就能打开通往原生世界动作模型的路。 作者丨张 璐 编辑丨齐铖湧 让机器人真正理解世界,需要更大的语言模型、更逼真的视频生成,还是别的什么? 雷峰网小编在中山大学与 X-Era AI Lab 团队的研究中f x了一个意外的答案:很多时候,机器人在新场景下失灵,不是因为它不懂物理,而是因为它"看到的空间变形了"。 CVP

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

WAIC 2026探营:蚂蚁集团展示面向智能体商业的三层布局

7月17日,2026世界人工智能大会在上海开幕。记者探营蚂蚁集团展区发现,在AI走向真实场景落地、智能体开始参与商业协同的新阶段,蚂蚁系统展示了面向智能体商业时代的三层AI布局:以“阿福”“阿宝”为代表的AI应用,以AI支付、支付宝AI开放平台和“碰一下”商家Agent构建的智能体商业生态,以及大模型、具身智能、数据能力和安全可信能力等技术基座。 记者了解到,这组三层能力建立在蚂蚁20多年在用户入

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

用于探索、净化与模型合并的谱重接线

强化学习已成为大语言模型的标准后训练方法,但密集的全参数更新造成两个部署相关瓶颈:推理性能受抑(通常表现为测试时Scaling的过早饱和),以及通过多领域训练或模型合并整合多种能力时产生的干扰。我们发现这些更新中与推理有效的成分主要集中于基础模型的谱空间中,由此催生了子空间对齐重接线(SAR)——一种保留该谱核的后编辑方法

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

UniVR:在视觉空间中思考以实现统一的视觉推理

直接从原始视觉数据中学习广泛的世界知识是智能的基本能力。我们提出UniVR,首次同时从纯视觉演示中学习复杂推理、细粒度物理动力学和长期规划。其核心是VR-GRPO,一种具有互补全局和步骤级奖励的强化学习范式。该方法在整个推理过程中强制逻辑一致性和物理一致性,无需任务特定的启发式或图像‑文本对。为了训练和评估UniVR,

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

不追制程、不靠HBM、不复制GPU,东方算芯首颗AI芯片有哪些新招数

AI算力仍在狂奔,但芯片的竞争维度却发生明显的分化。 过去几年,AI芯片的发展几乎遵循着同一条路径:更先进的制程、更大的GPU集群、更高的算力。 但推理时代的到来,开始改变这套游戏规则。模型不再只追求训练速度,更关注推理成本、Token吞吐和部署效率等指标。与此同时,能源、制造工艺和供应链的制约也在日益凸显。 当堆算力越来越难、提升效率成为新的竞争方向时,国产AI芯片是否还有另一种可能? 东方算芯

芯片 AI 摘要 · 单一来源
雷锋网 阅读 →

VideoChat3:面向高效通用视频理解的完全开源 Video MLLM

视频理解在运动分析、长视频、流式交互等方向取得进展,但当前开源模型仍存在泛化能力有限、计算成本高、关键组件未完全开源等问题,制约了可复现性和社区发展。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Moonix AI 眼镜标准版 7 月 17 日全球同步发售,主打 14.9 克轻量化设计

2026 年 7 月 17日 讯 —— 新锐 AI 穿戴硬件品牌 Moonix(莫奈)正式宣布,旗下首款产品 Moonix AI 眼镜标准版将于今天全球同步发售。 这款自 4 月硅谷发布以来以" 14.9 克极致轻薄"引发行业震动的 AI 眼镜,历经两个多月的准备迎来正式发售,标志着 AI 眼镜正式从极客圈层走向大众消费市场。 四大镜框系列同步上市,2299 元起 此次正式发售的 Moonix A

产品发布 AI 摘要 · 单一来源
雷锋网 阅读 →

SEED:面向智能体强化学习的自进化同策略蒸馏

大语言模型作为交互式智能体处理长时任务时,基于结果的强化学习存在稀疏轨迹级奖励与 token 级策略学习之间的监督缺口。SEED(自进化同策略蒸馏)将已完成的同策略轨迹转换为训练时的后见技能和可区分的细粒度信号。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

BadWAM:世界-动作模型"想"对但"做"错时

世界-动作模型(WAM)正成为具身控制的基础:它们不仅预测动作,还学习将动作生成与未来世界预测相结合的表示。这种耦合通常被视为鲁棒性、可解释性和安全性的来源,因为机器人动作原则上可以根据想象未来进行检验。然而本研究揭示这一假设存在脆弱性。我们提出BadWAM,这是一个用于建模和评估"世界-动作漂移攻击"的统一框架——这是一种新型的WAM特定对抗攻击,利用微小视觉...

机器人 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

并发图像理解与生成:自修正耦合马尔可夫跳过程

人类认知不分离理解与生成,论文将此耦合机制引入AI系统。现有Masked Diffusion Model采样器无法检测和修复同一步骤内跨模态矛盾,导致文本与图像生成不一致。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

行业首个!中国一汽大模型入驻阿里云百炼,面向全行业开放

7月15日,中国第一汽车集团有限公司(以下简称“中国一汽”)与阿里云智能集团联合宣布:由中国一汽基于千问自主研发的行业大模型已正式入驻阿里云百炼平台,面向全行业开放。作为业内首个实现商业化服务的大模型,它将中国一汽沉淀的行业know-how转化为标准化服务,让全行业企业都能低门槛调用专业AI能力。 据介绍,该汽车行业大模型由中国一汽依托研发、生产、制造、供应链全链条的高质量数据集训练而成,历经八轮

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

DeepMind 联合 Isomorphic 发布 AI 生物韧性方案

Google DeepMind 与 Isomorphic Labs 发布 bioresilience 方案,用前沿 AI 做病原监测、疫苗与疗法设计及疫情响应,一年内已建 15+ 政府/生物安全合作;Isomorphic 向亚洲传染病研究捐 700 万美元。

研究 AI 摘要 · 单一来源
@GoogleDeepMind 阅读 →

月之暗面发布 Kimi K3:2.8 万亿参数开源旗舰

Moonshot 于 7/16 发布 Kimi K3:约 2.8 万亿参数 MoE、100 万 token 上下文、原生多模态、常开推理(thinking mode),主打长程编程/Agent;含 K3 Max 与 K3 Swarm Max 两版,开源、权重 7/27 释出,GDPval-AA v2 得 1687 列第三。

大模型 AI 摘要 · 单一来源
@Kimi_Moonshot 阅读 →

DeepSeek工资待遇登上热搜,清华姚班晒实习工资日薪5500元;3万内双冠王!美家中央空调再出新品;国行苹果AI通过备案,接入千问、百度

要闻提示 1.国行苹果AI通过备案,接入千问、百度 2.DeepSeek工资待遇登上热搜,清华姚班晒实习工资日薪5500元 3.美的美享家·美家中央空调:3万元以内健康性能双冠王 4.美团、青桔、哈啰共享单车调价,业内人士称行业已进入存量竞争阶段 5.马云现身纽约百元平价餐厅,行踪引发世界杯观战猜想 6.星纪魅族中国区 CMO 万志强官宣离职,将做“有趣且有意义”的事 7.小米宣布MiMo端侧模型

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

国产大芯片厂商“必修课”:从云豹智能看DPU赛道现实考题

国内DPU厂商云豹智能6月30日向深交所递交创业板IPO材料,成为创业板第四套上市标准下首家申报的DPU芯片企业,被市场视作“国产DPU第一股”。而随着招股书披露经营数据,市场出现两类争议声音:连续三年归母净利润亏损和营收高度依赖单一大客户。 创业板第四套上市标准的落地,彻底打破了上市必须盈利的限制,精准适配高端芯片这类前期重投入、暂未盈利的硬科技企业。破解芯片“卡脖子”是国家核心战略任务,目前数

芯片 AI 摘要 · 单一来源
雷锋网 阅读 →

2026世界人工智能大会聚焦AI治理,奇安信展示AI+安全双轮驱动布局

7月17日至20日,2026世界人工智能大会(WAIC 2026)暨人工智能全球治理高级别会议将在上海开幕。本届大会以“智能伙伴 共创未来”为主题,聚焦人工智能创新发展与安全治理双向协同,将AI安全与全球治理提升至核心战略层面。奇安信携系列AI安全产品亮相上海世博展览馆H1展区,并参与圆桌会议、行业研讨等多个环节,集中展示其在AI安全领域的技术积淀与实战能力。 AI安全治理成大会核心主线 本次大会

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

行业首个!中国一汽大模型入驻阿里云百炼,面向全行业开放

7月15日,中国第一汽车集团有限公司(以下简称“中国一汽”)与阿里云智能集团联合宣布:由中国一汽基于千问自主研发的行业大模型已正式入驻阿里云百炼平台,面向全行业开放。作为业内首个实现商业化服务的大模型,它将中国一汽沉淀的行业know-how转化为标准化服务,让全行业企业都能低门槛调用专业AI能力。 据介绍,该汽车行业大模型由中国一汽依托研发、生产、制造、供应链全链条的高质量数据集训练而成,历经八轮

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

专访 Ψ₀ 团队:用对方法,30小时真机数据也能练模型|RSS 2026

机器人Scaling,不一定先拼数据量 作者丨邓哲敏 编辑丨齐铖湧 2026 年 7 月 13 日,RSS 2026 于悉尼正式开幕。从会场展示来看,如何突破机器人数据瓶颈几乎成为今年具身智能研究的一条主线:有人继续扩大数据规模,有人寻找新的数据来源,也有人探索生成模型带来的数据增量。 来自南加州大学 PSI Lab 的 研究团队展示了论文 Ψ₀,从另一个角度展开思考:如果手里的真机数据短时间内无

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

不改造门店机器人直接上岗,蚂蚁灵波智慧药房获WAIC 2026“镇馆之宝”

2026世界人工智能大会(WAIC)将于7 月 17 日正式拉开帷幕。作为大会展览板块的最高荣誉,日前揭晓的十大“镇馆之宝”已率先成为各方关注的焦点。其中,蚂蚁集团的“基于蚂蚁灵波跨本体具身大模型的机器人智慧药房”,与中科曙光“曙光8000—全国产十万卡AI超集群”等硬核科技成果一同登榜。 “镇馆之宝”由大会组委会从技术含量、市场前景、可复制性和社会价值等维度综合评选,旨在表彰具有行业突出贡献及领

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

Boogu-Image-0.1: 提升开源统一多模态理解与生成能力

Boogu-Image-0.1是一个开源统一多模态理解与生成模型系列,包含Base、Turbo、Edit、Edit-Turbo四个变体,在高质量文生图、快速推理、指令编辑和中英双语文字渲染方面表现优异。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

一汽解放J6E大客户定制版批量交付,挚途L2++智驾系统成“快递神车”技术杀手锏

商用车智能驾驶赛道,正从概念比拼转向量产交付能力的较量。 近日,一汽解放J6E大客户定制版正式启动下线交付。这款在快递市场已积累良好口碑的战略车型,此次针对头部物流企业运营痛点推出定制版本,引发行业关注。 此次定制版最受关注的技术配置,是搭载了挚途科技自主研发的L2++级干线组合辅助驾驶系统。 挚途科技于2019年由一汽解放发起成立,是国家专精特新“小巨人”企业、国家高新技术企业。公司全栈自研的“

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

穿越无人之海:斯年智驾驶出港口,奔向万里通途

过去几年,斯年智驾最广为人知的标签,一直是港口无人驾驶。相比Robotaxi、城市NOA等更容易引发关注的话题,港口无人驾驶在自动驾驶行业里相对沉默。 在很多人看来,这是一门封闭场景生意,不仅市场规模有限,并且项目周期漫长、交付过程繁琐。即便技术能够跑通,也很难讲出一个令人兴奋的增长故事。 因此,当自动驾驶行业经历多轮资本热潮与寒冬时,港口无人驾驶始终处于一个略显边缘的位置。 但最近,斯年智驾完成

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

告别"随机抽卡",天工短剧工作台:让AI短剧制作第一次真正拥有导演思维!

当下,AI短剧行业已告别“野蛮生长”,正式迈入精品化、规模化的全新阶段。 然而,当大多数创作者还在“AI盲盒式”创作时,三个残酷的现状早已浮现: 创作过程不可控:依赖 AI“抽卡”随机生成,容易出现角色变脸、站位漂移、前后镜头缺少叙事逻辑。 质感产能难平衡:全自动生成容易有 AI 机械感,手动精修又难以支撑规模化交付。 团队管理难统筹:多人创作缺少标准化工具,项目进度、算力成本和复盘数据难以统一管

企业动态 AI 摘要 · 单一来源
雷锋网 阅读 →

给机器人造一座「数据工厂」,小米 Robotics-U0 如何破解具身智能最难的一道题?

世界各地,有不少人正在给机器人当“幼教”。 在印度的一些工厂里,有工人头戴摄像头完成装配、分拣和搬运,将第一视角画面和完整操作过程记录下来;特斯拉 Optimus 的训练场里,也有工作人员佩戴装有多枚摄像头的头盔和背包,在固定场地内反复拿杯子、擦桌子、拉窗帘;一些数据公司付费邀请普通人拍摄自己叠衣服、洗碗和整理房间的过程。 他们在做的,都是把人类早已习惯的动作重新示范、拆解和记录,让机器人从观察、

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

权威报告:阿里AI编程市场份额第一,超第二至第五名总和

7月16日消息,国际权威咨询机构IDC发布2025年中国AI编程市场份额报告,报告显示,阿里以47.6%的市场份额位居第一,超第二名至第五名总和,持续领跑中国AI编程市场。 AI编程是全球大模型应用落地最快的领域之一,也是全球顶尖模型创业公司和科技公司竞争的核心战场。IDC报告显示,2025年中国AI编程市场规模为3.99亿元人民币,预计到2026年底将快速增长至11.73亿元人民币。阿里凭借其核

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

ICML 2026 的 AI4S 现场:工具、合著者,还是创始人?

“AI4S在科学社区里是被低估了,但在AI社区,人们有时又高估了它的能力。” 作者丨周蕾 编辑丨岑峰 ICML 2026 的最后一天,一个主题为“AI Scientists —— Tools, Co-authors, or Founders?”的 workshop,让在场研究者们讨论起了有关 AI for Science 的焦虑。 其实这个 workshop 的主题,本身就带着一层追问:当 AI

研究 AI 摘要 · 单一来源
雷锋网 阅读 →

OpenAI 一夜重置全员额度,800 万开发者集体「续命」

Codex负责人72小时三连击,额度福利吃到饱 作者丨高允毅 编辑丨马晓宁 如果说最近最受全球开发者欢迎的男人,那必定是OpenAI核心产品负责人Thibault Sottiaux(大家习惯叫他Tibo)。就在今天凌晨,他又给大家充值了。 他在推特上宣布,“Codex和ChatGPT Work的活跃用户达到800万。我们将再次为所有人重置使用额度。同时继续不设5小时速率限制,让大家探索GPT-5.

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

GigaWorld-Policy-0.5:更快更强的AutoResearch赋能WAM

World Action Models(WAM)通过联合建模动作和未来视觉观察来改进机器人策略学习。现有WAM在推理时显式生成未来视频,计算开销大,阻碍实时闭环部署。GigaWorld-Policy以动作为中心,训练时利用未来视觉动态,推理时仅解码动作。

机器人 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Ring-Zero:将 Zero RL 扩展至万亿参数规模用于涌现推理

无人类标注数据的可验证奖励强化学习(即 Zero RL)已成为激发链式思维推理的有效范式,但现有研究受计算限制主要集中于小模型,其大规模训练的动态特征和涌现能力尚未被充分探索。为在该前沿取得突破,研究团队旨在激发模型的高质量推理行为,但发现简单扩展往往面临可读性差、Token 冗余和缺乏自适应推理等问题。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

PolicyShiftGuard:策略自适应图像防护栏的基准与改进

图像防护栏通常在固定安全策略下训练评估,将安全性视为图像内在属性。实际部署中同一图像在不同产品可能有不同限制。研究策略自适应防护栏场景,模型需判断图像是否违反当前策略并泛化到未见过的策略定义。提出PolicyShiftBench基准,包含265张图像的2000个策略判别实例。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →