来自 Twitter · Hacker News · GitHub 的 AI 行业动态
可视化代码仓库表示通过提升结构理解并降低问题解决中的 token 消耗,增强基于 LLM 的编码 Agent 能力。
一种多智能体系统监控框架,通过实时检查识别资源约束下的错位行为,在多种条件下有效检测错位类型。
AI审稿系统存在展示层面的漏洞,容易被突出亮点而非解决弱点的策略所欺骗,为对抗性重新包装攻击提供了新的攻击面。
LoSoNA 评估大语言模型在群聊中通过定向提示场景推断和适应隐含本地对话规范的能力。
RepFusion 将多模态大语言模型作为扩散 Transformer 的噪声表示编码器,用于文生图任务,表现优于传统训练新去噪器的方法。
6月15日,健康AI应用"蚂蚁阿福"宣布“拍皮肤”功能升级:可识别皮肤病种类从50种增至100多种,覆盖99%的线上就医常见皮肤问题。同时,阿福还上线了“医生把关”这一新服务:用户获得阿福的解答后,可选择邀请三甲医院的医生对阿福的分析结果进行复核并补充意见。这也是国内首个落地"AI问答+医生把关"协作模式的AI应用,为AI与医生的合作提供了可行路径,打开了“AI+医生”赛道的想象空间。 阿福的测试
一场赛事真正的流量争夺,往往不只发生在直播间,也发生在赛后几分钟的短视频分发链路里。谁能更快把进球、争议判罚、庆祝名场面切出来,谁就更有机会吃到热搜红利。 三分钟高光全网飞,人工剪辑为什么跑不赢热搜? 进球哨音响起的那一刻,观众的第一反应不是回味,而是打开社交平台——有没有人已经把这一刻切出来了?等五分钟还没看到,热情就凉了。仍靠传统回放的团队,往往已经错失第一波流量。 这要求直播和短视频必须同时
自动音视频问答系统通过实体锚定视频脚本和线索引导问答生成,提升跨模态推理和时间一致性。
Pythagoras-Prover 通过课程训练和增强形式化技术,引入计算高效的 Lean 定理证明器,以克服验证数据稀缺和证明搜索代价高昂的局限性。
预训练语言模型可通过灵活的层程序化执行策略动态执行层,相比标准固定深度推理提升准确率并降低计算开销。
司南:个性化 AI 任务总控 Skills 系统 /COMPASS: Personal Alignment Skills OS for AI Agents
雷峰网获悉,6 月 15 日海洋具身智能公司世航智能宣布完成超 10 亿元 A 轮融资,为目前全球海洋机器人领域规模最大的单轮融资。 雷峰网了解到,该轮新投资方包括上河动量基金、新加坡淡马锡旗下 Vertex Growth、中信集团农业产业基金、誉尊资本、上市公司大洋电机;老股东金沙江创投、祥峰中国、华映资本、长石资本等全部大比例超额追投。本轮融资将主要用于核心技术研发、全球化市场拓展及产业链生态
SelectiveRM:从点对点拟合噪声偏好,转向带选择机制的分布对齐,重构奖励模型的训练目标。 作者丨潘黎铖 在大语言模型对齐研究中,一个看似自然、却值得重新审视的问题长期存在: 一方面,RLHF、RLAIF、GRPO等方法不断推动模型对齐能力演进;另一方面,奖励模型训练阶段却普遍默认一个前提——收集到的偏好标注能够准确反映真实人类偏好。 但现实并非如此。无论是人工标注、众包反馈,还是LLM-a
机器人不仅要看得见,还要看得远、看得稳、看得全。 作者丨高景辉 编辑丨马晓宁 当全球具身智能公司都在ICRA 2026的展台上比拼 DEMO 时,一个棘手的问题却被众人所忽视:机器人至今没有一双真正好用的眼睛。 这是整个行业心照不宣的卡点。所有人都在说大模型、VLA带来了通用智能的曙光,但落地时却卡在了最原始的环节——机器人看不准三维世界,做不了精细操作,速度永远赶不上人类。为了弥补传感器的缺陷,
要闻提示 1.网件反诉TP-Link:宣称 “美国公司” 是虚假宣传,本质仍是中国企业 2.百度搜索疑似调整AI结果权重,网页链接重新优先 3.只能第一!余承东:鸿蒙彻底告别安卓、华为突破封锁麒麟芯全面回归 4.携程被罚 1000 万:未落实数据出境安全评估要求、违法出境个人信息 5.山姆客服回应极速达买到临期商品:可以在订单中备注“不要临期” 6.机器人伴侣U1内置养成系专属情感大模型,仅限成人
SelectiveRM:从点对点拟合噪声偏好,转向带选择机制的分布对齐,重构奖励模型的训练目标。 作者丨潘黎铖 在大语言模型对齐研究中,一个看似自然、却值得重新审视的问题长期存在: 一方面,RLHF、RLAIF、GRPO等方法不断推动模型对齐能力演进;另一方面,奖励模型训练阶段却普遍默认一个前提——收集到的偏好标注能够准确反映真实人类偏好。 但现实并非如此。无论是人工标注、众包反馈,还是LLM-a
一种智能体强化学习方法,通过细粒度决策点和程序级优势缩放优化分支决策与信用分配,提升多轮工具使用能力。
陪你睡觉的机器人来了。 作者丨姚单 编辑丨董子博 雷峰网·鲸犀获悉,家庭柔性机器人公司弘火智能「SoulX」已完成天使轮融资,由高瓴创投投资,向阳资本担任独家财务顾问。本轮融资将用于首款睡眠安抚机器人MoYa的量产和推广。这款产品预计2026年年内在北美率先上市。 SoulX创始人郑潜为哈工大机器人背景出身,后在浙大控制学院深耕神经科学,是外骨骼、脑机接口领域的连续创业者。这次创业,郑潜组建了一支
一个统一的相机运动克隆框架,使用网格运动视频作为表示,并整合多模态扩散Transformer以增强视频生成控制。
近日,百度文心正式发布新一代OCR模型PP-OCRv6,一次性推出Tiny、Small、Medium三档模型,支持 50 多种语言,覆盖浏览器端、嵌入式设备到服务器等主流场景。公开结果显示,PP-OCRv6再次刷新OCR领域评测纪录,综合性能位居全球第一。 其中,PP-OCRv6 Tiny的尺寸仅1.5MB,可直接部署于本地浏览器环境,单图预测最快仅需 97 毫秒。用户数据无需上传云端即可完成OC
机器人不仅要看得见,还要看得远、看得稳、看得全。 作者丨高景辉 编辑丨马晓宁 当全球具身智能公司都在ICRA 2026的展台上比拼 DEMO 时,一个棘手的问题却被众人所忽视:机器人至今没有一双真正好用的眼睛。 这是整个行业心照不宣的卡点。所有人都在说大模型、VLA带来了通用智能的曙光,但落地时却卡在了最原始的环节——机器人看不准三维世界,做不了精细操作,速度永远赶不上人类。为了弥补传感器的缺陷,
大语言模型正从对话系统演变为具备增强推理能力和持久工作环境的集成 AI 同事。
6 月 15 日,由巴西里约市政府旗下 IT 公司 IplanRIO 推出的“官方”开源模型Rio-3.5-Open-397B ,全球走红,被奉为拉美开源大模型的新势力。不到 24 小时,这场所谓 AI “黑马神话”就宣告反转,该模型被指控称是“套壳”阿里千问 Qwen 3.5 和Nex N2 Pro 的权重混合版本。目前,IplanRIO 已在开源社区 Hugging Face 公开致歉,承认“
中国互联网公司的AI竞争中,腾讯真的慢了吗? 从大模型竞争开始,腾讯并不是走的最快的,但到场景落地,腾讯变得尤为激进。春节前对于元宝的大规模投入,再到“养虾”热潮,腾讯反应变得很快,积极的投入其中,这也让外界看到了腾讯的另一面。 互联网公司中,做产品一直腾讯最擅长的事情,在AI浪潮中,腾讯各个业务线的AI产品相继上线,CodeBuddy、ima、再到今年的WorkBuddy,已经在各个场景落地,并
用户依赖执行追踪记录来观察智能体行为、诊断故障和确保问责,但这些记录会暴露关键公式、阈值和策略等私人程序化技能。为量化风险并评估保护,研究者构建了包含75个专业长时任务和154个跨七领域技能的基准CapTraceBench,并推出RedA工具。
多数组织仍手动管理合同,搜索 PDF 中的续约日期和付款条款,效率低且易出错。传统 OCR 只识别文本,无法解析付款条款的差异、续约条件和跨修订的终止条款。LlamaParse 旨在抽取结构化信息。
长期支持者 Matt 与 Lisa Sonsini 向 UC Berkeley 捐赠 1350 万美元,将大幅扩展该校将实验室研究落地产业的成熟模式。
Anyscale Compute团队详解PD disaggregation技术难点,称在AMD MI325X上成功验证Ray Serve + vLLM的可行性。
斯坦福体育场迎来2万余人,3600名毕业生参加Wacky Walk及颁奖,Sundar Pichai发表演讲庆祝2026届毕业。
在提示栏附加技能,智能体每次生成都会使用,可从链接、已保存技能或仓库拉取。