来自 Twitter · Hacker News · GitHub 的 AI 行业动态
Fable工作流将Claude Fable 5的核心机制提炼为任何模型都能运行的技能,配合评估机制保证效果。思考/行动/验证。
6月29-30日,中力股份第八届629新产品、新技术、新模式创新发布大会,以“从物料搬运到数智移动”为主题在浙江安吉盛大举行。四海宾朋齐聚,行业精英荟萃,共同见证中力以全场景数智移动解决方案,共绘智能物流的全新版图,开启工业搬运的数智新纪元! 璀璨启幕:“质变下的改变” 驱动行业新变革 作为物料搬运行业一年一度的创新盛事,中力 629 已走过八载深耕之路,每一届都成为行业迭代的关键注脚:首届 62
一款零依赖的浏览器端视频编辑器,支持AI代理操控,提供JSON时间轴、MCP+REST接口及实时重载UI界面。
7月5日,阿里巴巴与清华大学合作的论文 The Flexibility Trap: Rethinking the Value of Arbitrary Order in Diffusion Language Models(灵活性陷阱:重新审视扩散语言模型中任意顺序生成的价值)入选AI顶会ICML杰出论文(Outstanding Paper),杰出论文是ICML最高荣誉,代表当年最具影响力的研究工作
2026年7月6日,随着一台叉取机器人走下产线,海康机器人正式宣布,其移动机器人全品类累计下线突破20万台。 从 2024年5月第10万台下线至今,海康机器人仅用两年时间便完成第二个十万台的跨越。根据《移动机器人产业联盟》最新统计,其2025年移动机器人市占率位居全球第一。在制造业智能化转型的背景下,中国移动机器人产业正从示范应用加速迈向规模化普及的新阶段,而海康机器人20万台下线的速度变化,则代
近日,大晓机器人正式开源新一代统一具身基模型 ACE-Brain-0.5,面向 Physical Agentic AI 这一新范式,推动具身智能走向真实物理世界中的自主执行。Physical Agentic AI 指能在真实物理世界中围绕目标自主感知环境、理解任务、规划、行动,并在交互反馈中持续调整和进化的智能体。作为 ACE-Brain-0 的重大升级,ACE-Brain-0.5 以空间智能为底
6月29-30日,中力股份第八届629新产品、新技术、新模式创新发布大会,以“从物料搬运到数智移动”为主题在浙江安吉盛大举行。四海宾朋齐聚,行业精英荟萃,共同见证中力以全场景数智移动解决方案,共绘智能物流的全新版图,开启工业搬运的数智新纪元! 璀璨启幕:“质变下的改变” 驱动行业新变革 作为物料搬运行业一年一度的创新盛事,中力 629 已走过八载深耕之路,每一届都成为行业迭代的关键注脚:首届 62
DataComp for VLMs(DCVLM)建立了综合基准,用于评估视觉语言模型中的数据整理策略,表明数据混合而非过滤可显著提升大规模模型性能。
用户刷视频时,对画质的判断往往发生在几秒之内。同样是短视频、直播、AIGC视频,有的画面清晰、稳定、有质感,人物的眉眼、物品的纹理、运动中的细节都足够自然;有的则模糊、压缩痕迹重,动作一快就闪烁、发虚,让人只想很快划走。 过去,平台解决这些问题的方式相对明确:在生产端做基础美化和编辑;在服务端用超分、去噪、锐化、去压缩等算法,把模糊、发虚的部分逐段修回来;在客户端则通过播放控制和端侧后处理增强,把
OrbitQuant 通过归一化旋转基实现 Diffusion Transformer 的高效训练后量化,无需跨时间步和模态重新校准。
7月6日,佑驾创新(2431.HK)正式发布「Combo」全链路无人物流闭环方案,由其旗下曜行动力打造的四轮足式机器人同步亮相。依托自动驾驶底层技术与物理AI能力,佑驾创新首次以“无人车+机器人”打通物流转运到上门配送的完整链路,直击行业长期存在的“最后一米”难题。 本次方案发布,既是曜行动力首款具身智能产品的首秀,也是佑驾创新向全场景物理AI科技企业战略升级的关键一步,助力公司在万亿级赛道抢占发
【韩国仁川,2026年7月5日】 今日,2026年RoboCup(机器人世界杯)在韩国仁川正式落下帷幕。在备受瞩目的人形机器人项目中,中国战队清华火神队搭载加速进化 Booster T1,成功卫冕 Large 组世界冠军。继去年在巴西打破中国战队 28 年冠军荒后,火神队在面对全球顶尖强队的针对性挑战下再次登顶,证明了其在具身智能算法领域的领先水平。与此同时,本届赛场传递出一个更具产业风向标意义的
Open Science — 面向科学家的开源 AI 工作台,Claude Science 的开源替代方案。本地优先、模型无关、可复现,基于 Tauri + MCP + agent skills 构建。
专为科学研究设计的开源AI工作平台
vLLM 团队分享如何高效部署阿里 Qwen3-Omni:它由多模态 Thinker、Talker 到 Code2Wav 多阶段组成,每层瓶颈不同,需逐层优化才能在实时场景榨出性能。
谷歌,去年凭借大模型能力反超逆袭,出尽了风头,甚至一度被投资人喊出“市值能到10万亿”。但奇怪的是,谷歌在AI编程这一关键领域一直籍籍无名。 强大如谷歌,为何在AI coding(AI 编程)上瘸了腿? 更令人惊讶的是,不止谷歌。纵观中美互联网巨头,在AI编程上都表现平平。Cursor、Claude Code、Codex、智谱、MiniMax……这些程序员圈子里耳熟能详的产品中,来自互联网大厂的寥
7月3日,在2026全球数字经济大会人工智能融合应用发展论坛,生数科技创始人朱军发表题为《通用世界模型,推动数字世界与物理世界统一的新范式》的主题演讲,并正式发布面向实时交互场景的新一代模型——Vidu S1 实时交互模型。大会期间,北京软件和信息服务业协会(BSIA)正式发布《2025年北京市数字经济标杆企业评价报告》,生数科技凭借在技术创新与产业应用方面的突出表现,成功入选“新模式新应用标杆企
2026年被业界广泛称为人形机器人“商业化落地元年”,而我们认为,真正跑通的应用场景才是打破“伪落地”质疑的唯一标尺。 浙江人形凭借全栈自主可控的产品体系,已让领航者NAVIAI人形机器人在工业、服务、教育、数采等多领域真正“上手干活”,率先实现了从实验室技术验证到多领域规模化商用的关键跨越。 应用领域 01——工业制造中的“精工巧匠” 浙江人形深耕真实场景,以多源、高质数据体系筑基,自研可泛化、
告别盲目刷榜,28页 PPT 带你摸透 ICML 新风向。 作者丨陈淑瑜 编辑丨岑峰 ICML 2026 的投稿量从去年的 12107 篇直接飙升至 23,918 篇,几近翻倍。 然而,最终的接收率却牢牢钉在 26.56%,与去年几乎持平。 这一数据传递出一个明确的信号:并非竞争变得盲目激烈,而是学术评审标准经历了一次深刻的“重新校准”。 为了拆解这一趋势,我们制作了一份 28 页的深度分析 PP
过去六年,国产GPU公司一路站上AI风口,估值不断刷新,DPU却被忽略了。 这并不符合产业现实。 2020年英伟达完成收购Mellanox后,就已经明确了“GPU+CPU+DPU”的三芯战略。过去几年,英伟达也持续强化网络能力,黄仁勋在2026年CES展示“六芯组合”时,其中四款都与网络相关。 一个越来越清晰的趋势开始浮出水面:AI基础设施的瓶颈,正在从算力本身转向网络与调度。 尤其Agent时代
自主智能体在固定预算内通过迭代编辑评估策略改进,研究表明成功的策略演化需要任务特定机制与反馈约束的协同优化。
该研究提出一种有限契约方法用于长周期 LLM Agent,通过类型化检索组装新鲜提示词,可隔离分析记忆组件,在复杂决策任务中展现更优性能。
MrFlow结合低分辨率生成与像素空间超分辨率及噪声注入,加速文生图扩散模型,实现最高25倍加速,且无需训练或运行时修改。
FlashMorph将混合层选择形式化为预算约束优化问题,通过可变形模型和线性化正则化提升Transformer的长上下文效率。
视觉-语言模型在专业时空视频定位任务中面临领域适应挑战,暴露出零样本泛化和上下文学习能力的局限性。
AI 代码黑盒工具,通过被动决策图追踪每次提交与 Agent 提示词的关联,支持漂移检测、DLP 审计、证据驱动风险评估和签名溯源,一行命令离线运行。
vLLM 社区通过 day-zero 适配 + 对 kernel/调度/serving 的持续优化,一个月内将 DeepSeek V4 推理的 token 成本降低 5 倍,展示开源社区的迭代速度。
xAI 宣布 Grok Build 现已内置于 Railway 的沙箱环境,开发者可在 Railway 平台直接调用 Grok 做 AI 辅助构建。