全部 今日 本周 本月

fable-method:Fable工作流——Claude Fable 5的运行机制提炼为通用技能,配合评估机制保证效果

Fable工作流将Claude Fable 5的核心机制提炼为任何模型都能运行的技能,配合评估机制保证效果。思考/行动/验证。

大模型 AI 摘要 · 单一来源
GitHub Trending 阅读 →

全场景数智移动重塑产业未来!中力第八届 629 创新发布大会盛大启幕

6月29-30日,中力股份第八届629新产品、新技术、新模式创新发布大会,以“从物料搬运到数智移动”为主题在浙江安吉盛大举行。四海宾朋齐聚,行业精英荟萃,共同见证中力以全场景数智移动解决方案,共绘智能物流的全新版图,开启工业搬运的数智新纪元! 璀璨启幕:“质变下的改变” 驱动行业新变革 作为物料搬运行业一年一度的创新盛事,中力 629 已走过八载深耕之路,每一届都成为行业迭代的关键注脚:首届 62

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

FableCut:零依赖浏览器视频编辑器,支持AI代理驱动——JSON时间轴、MCP+REST、实时重载UI

一款零依赖的浏览器端视频编辑器,支持AI代理操控,提供JSON时间轴、MCP+REST接口及实时重载UI界面。

产品发布 AI 摘要 · 单一来源
GitHub Trending 阅读 →

大道至简,阿里与清华论文揭示扩散大模型推理能力,入选 ICML 杰出论文

7月5日,阿里巴巴与清华大学合作的论文 The Flexibility Trap: Rethinking the Value of Arbitrary Order in Diffusion Language Models(灵活性陷阱:重新审视扩散语言模型中任意顺序生成的价值)入选AI顶会ICML杰出论文(Outstanding Paper),杰出论文是ICML最高荣誉,代表当年最具影响力的研究工作

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

海康机器人移动机器人下线突破20万台,推动行业驶入规模化应用快车道

2026年7月6日,随着一台叉取机器人走下产线,海康机器人正式宣布,其移动机器人全品类累计下线突破20万台。 从 2024年5月第10万台下线至今,海康机器人仅用两年时间便完成第二个十万台的跨越。根据《移动机器人产业联盟》最新统计,其2025年移动机器人市占率位居全球第一。在制造业智能化转型的背景下,中国移动机器人产业正从示范应用加速迈向规模化普及的新阶段,而海康机器人20万台下线的速度变化,则代

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

登顶多项全球 SOTA!大晓全开源首个「统一具身基模型」ACE-Brain-0.5

近日,大晓机器人正式开源新一代统一具身基模型 ACE-Brain-0.5,面向 Physical Agentic AI 这一新范式,推动具身智能走向真实物理世界中的自主执行。Physical Agentic AI 指能在真实物理世界中围绕目标自主感知环境、理解任务、规划、行动,并在交互反馈中持续调整和进化的智能体。作为 ACE-Brain-0 的重大升级,ACE-Brain-0.5 以空间智能为底

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

全场景数智移动,重塑产业未来!中力第八届 629 创新发布大会盛大启幕

6月29-30日,中力股份第八届629新产品、新技术、新模式创新发布大会,以“从物料搬运到数智移动”为主题在浙江安吉盛大举行。四海宾朋齐聚,行业精英荟萃,共同见证中力以全场景数智移动解决方案,共绘智能物流的全新版图,开启工业搬运的数智新纪元! 璀璨启幕:“质变下的改变” 驱动行业新变革 作为物料搬运行业一年一度的创新盛事,中力 629 已走过八载深耕之路,每一届都成为行业迭代的关键注脚:首届 62

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

DataComp-VLM:视觉语言模型开放数据集改进方案

DataComp for VLMs(DCVLM)建立了综合基准,用于评估视觉语言模型中的数据整理策略,表明数据混合而非过滤可显著提升大规模模型性能。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Agentic 范式下的视频画质优化:火山引擎的新路径

用户刷视频时,对画质的判断往往发生在几秒之内。同样是短视频、直播、AIGC视频,有的画面清晰、稳定、有质感,人物的眉眼、物品的纹理、运动中的细节都足够自然;有的则模糊、压缩痕迹重,动作一快就闪烁、发虚,让人只想很快划走。 过去,平台解决这些问题的方式相对明确:在生产端做基础美化和编辑;在服务端用超分、去噪、锐化、去压缩等算法,把模糊、发虚的部分逐段修回来;在客户端则通过播放控制和端侧后处理增强,把

行业 AI 摘要 · 单一来源
雷锋网 阅读 →

OrbitQuant:面向图像和视频 Diffusion Transformer 的数据无关量化

OrbitQuant 通过归一化旋转基实现 Diffusion Transformer 的高效训练后量化,无需跨时间步和模态重新校准。

硬件 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

打破末端配送壁垒,佑驾创新正式发布四轮足机器人

7月6日,佑驾创新(2431.HK)正式发布「Combo」全链路无人物流闭环方案,由其旗下曜行动力打造的四轮足式机器人同步亮相。依托自动驾驶底层技术与物理AI能力,佑驾创新首次以“无人车+机器人”打通物流转运到上门配送的完整链路,直击行业长期存在的“最后一米”难题。 本次方案发布,既是曜行动力首款具身智能产品的首秀,也是佑驾创新向全场景物理AI科技企业战略升级的关键一步,助力公司在万亿级赛道抢占发

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

清华火神队成功卫冕RoboCup 2026世界冠军,加速进化构筑全球具身智能“通用底座”

【韩国仁川,2026年7月5日】 今日,2026年RoboCup(机器人世界杯)在韩国仁川正式落下帷幕。在备受瞩目的人形机器人项目中,中国战队清华火神队搭载加速进化 Booster T1,成功卫冕 Large 组世界冠军。继去年在巴西打破中国战队 28 年冠军荒后,火神队在面对全球顶尖强队的针对性挑战下再次登顶,证明了其在具身智能算法领域的领先水平。与此同时,本届赛场传递出一个更具产业风向标意义的

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

ai4s-research/open-science:开源 AI 研究工作台,本地优先、模型无关,基于 Tauri + MCP(macOS & Windows)

Open Science — 面向科学家的开源 AI 工作台,Claude Science 的开源替代方案。本地优先、模型无关、可复现,基于 Tauri + MCP + agent skills 构建。

大模型 AI 摘要 · 单一来源
GitHub Trending 阅读 →

synthetic-sciences/openscience:开源AI科研工作台

专为科学研究设计的开源AI工作平台

研究 AI 摘要 · 单一来源
GitHub Trending 阅读 →

vLLM 拆解 Qwen3-Omni 实时语音服务的流水线优化

vLLM 团队分享如何高效部署阿里 Qwen3-Omni:它由多模态 Thinker、Talker 到 Code2Wav 多阶段组成,每层瓶颈不同,需逐层优化才能在实时场景榨出性能。

大模型 AI 摘要 · 单一来源
@vllm_project 阅读 →

谷歌为什么做不好「AI 编程」?

谷歌,去年凭借大模型能力反超逆袭,出尽了风头,甚至一度被投资人喊出“市值能到10万亿”。但奇怪的是,谷歌在AI编程这一关键领域一直籍籍无名。 强大如谷歌,为何在AI coding(AI 编程)上瘸了腿? 更令人惊讶的是,不止谷歌。纵观中美互联网巨头,在AI编程上都表现平平。Cursor、Claude Code、Codex、智谱、MiniMax……这些程序员圈子里耳熟能详的产品中,来自互联网大厂的寥

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

生数科技发布 Vidu S1,推动视频生成迈向“实时交互”新时代

7月3日,在2026全球数字经济大会人工智能融合应用发展论坛,生数科技创始人朱军发表题为《通用世界模型,推动数字世界与物理世界统一的新范式》的主题演讲,并正式发布面向实时交互场景的新一代模型——Vidu S1 实时交互模型。大会期间,北京软件和信息服务业协会(BSIA)正式发布《2025年北京市数字经济标杆企业评价报告》,生数科技凭借在技术创新与产业应用方面的突出表现,成功入选“新模式新应用标杆企

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

场景至上,实效为王:NAVIAI 人形机器人多领域应用场景领跑!

2026年被业界广泛称为人形机器人“商业化落地元年”,而我们认为,真正跑通的应用场景才是打破“伪落地”质疑的唯一标尺。 浙江人形凭借全栈自主可控的产品体系,已让领航者NAVIAI人形机器人在工业、服务、教育、数采等多领域真正“上手干活”,率先实现了从实验室技术验证到多领域规模化商用的关键跨越。 应用领域 01——工业制造中的“精工巧匠” 浙江人形深耕真实场景,以多源、高质数据体系筑基,自研可泛化、

机器人 AI 摘要 · 单一来源
雷锋网 阅读 →

算力之外的博弈:ICML 2026 透露了哪些学术硬通货?

告别盲目刷榜,28页 PPT 带你摸透 ICML 新风向。 作者丨陈淑瑜 编辑丨岑峰 ICML 2026 的投稿量从去年的 12107 篇直接飙升至 23,918 篇,几近翻倍。 然而,最终的接收率却牢牢钉在 26.56%,与去年几乎持平。 这一数据传递出一个明确的信号:并非竞争变得盲目激烈,而是学术评审标准经历了一次深刻的“重新校准”。 为了拆解这一趋势,我们制作了一份 28 页的深度分析 PP

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

AI基础设施的下一个千亿市场,为何藏在网络里?

过去六年,国产GPU公司一路站上AI风口,估值不断刷新,DPU却被忽略了。 这并不符合产业现实。 2020年英伟达完成收购Mellanox后,就已经明确了“GPU+CPU+DPU”的三芯战略。过去几年,英伟达也持续强化网络能力,黄仁勋在2026年CES展示“六芯组合”时,其中四款都与网络相关。 一个越来越清晰的趋势开始浮出水面:AI基础设施的瓶颈,正在从算力本身转向网络与调度。 尤其Agent时代

芯片 AI 摘要 · 单一来源
雷锋网 阅读 →

EvoPolicyGym:交互环境中的自主策略演化评估

自主智能体在固定预算内通过迭代编辑评估策略改进,研究表明成功的策略演化需要任务特定机制与反馈约束的协同优化。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

AgenticSTS:面向长周期 LLM Agent 的有限内存测试平台

该研究提出一种有限契约方法用于长周期 LLM Agent,通过类型化检索组装新鲜提示词,可隔离分析记忆组件,在复杂决策任务中展现更优性能。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

多分辨率流匹配:分阶段采样实现免训练扩散加速

MrFlow结合低分辨率生成与像素空间超分辨率及噪声注入,加速文生图扩散模型,实现最高25倍加速,且无需训练或运行时修改。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

向混合注意力模型演进

FlashMorph将混合层选择形式化为预算约束优化问题,通过可变形模型和线性化正则化提升Transformer的长上下文效率。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

AnyGroundBench:视觉-语言模型视频定位专用领域基准

视觉-语言模型在专业时空视频定位任务中面临领域适应挑战,暴露出零样本泛化和上下文学习能力的局限性。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →