来自 Twitter · Hacker News · GitHub 的 AI 行业动态
他认为大众往往通过抽象符号了解模型,而非亲自体验,导致对模型意义的误解。
Datacurve(YC W24)正在构建软件工程领域的权威评测标准,或成为AI代码能力的标杆测试集
充值$100-299赠20%、$300-999赠25%、$1000以上赠30%,每账户限一次优惠,鼓励开发者把握窗口期
模型托管于美国数据中心,数据全程私密、不用于训练,支持Claude、Codex App、OpenCode三种方式启动
出口管制指令覆盖所有外国国籍用户,包括Anthropic海外员工,全面暂停这两款模型访问,其他Claude模型正常运行,Anthropic就服务中断致歉
展示如何构建自定义会议助手,从单一提示即可查找Webex会议、回顾历史摘要、搜索未解决跟进事项并创建准备简报;会后自动总结讨论、识别待办并起草后续消息。
本文介绍在AWS上开发经济高效、可扩展的智能文档处理管道,利用Amazon Bedrock的BDA服务提取文档内容,由Strands Agent协调处理任务,Amazon Bedrock知识库支持跨文档上下文理解。
探索Rocket Close如何结合Strands Agents、大语言模型、Amazon Bedrock及MCP工具构建解决方案,涵盖技术栈设计考量、经验教训及商业影响。
AgentPerf 是人工智能分析公司推出的业界首个 Agentic AI 基准测试,NVIDIA Blackwell Ultra NVL72 平台在测试中提供领先性能,每兆瓦可运行 20 倍的 Agent。
近日,上交所发布公告,将于 2026 年 6 月 15 日召开上市审核会议,审议燧原科技科创板首次公开发行申请,这家国内 AI 算力芯片企业正式迎来上市关键节点。 燧原科技自成立以来始终深耕算力芯片领域,历经八年发展,已成为国内专注云端AI芯片自主研发的领军企业。2023-2025 年,燧原科技营业收入从 3.01 亿元增长至 9.90 亿元,三年营收复合增长率达到 81.32%,增长势头十分强劲
N-GRPO 是 GRPO 框架内的一种新型探索策略,通过语义邻居混合增强大语言模型的数学推理能力,在保持语义一致性的同时注入多样性。
今年高考季,小米大家电也迎来了一场特殊的“考试”——带着四项核心技术,接受行业权威专家委员会的鉴定。 近日,中国制冷学会、中国节能协会共同在湖北武汉组织召开小米大家电系列科技成果鉴定会。由小米智能家电(武汉)有限公司主导研发的四项关键技术——制冷剂动态调节与虚拟感知融合、出风形态重构的舒适送风、全温域宽频高能效控制、多智能体强化学习的多联机节能——经专家委员会鉴定,全部达到「国际领先」水平。 至此
TreeSeeker 是一个推理时框架,采用树结构搜索结合分支返回控制来管理深度搜索中的探索与利用,通过系统化的试错决策提升性能。
WeaveBench 提供综合基准用于评估多界面计算机智能体,揭示了长时序任务编排的重大挑战,并指出传统性能评估方法的局限性。
HYDRA-X提出统一多模态模型,在单一Vision Transformer内整合图像和视频分词,通过因果时序注意力和分层压缩解决时空重建与语义感知问题。
VIA-SD引入多层级推测解码框架,通过模型内路由机制利用轻量子模型验证中等置信度token,从而降低验证成本,显著提升推理速度。
通过引入二元验证器过滤教师信号,SG-OPD 在标准在线策略蒸馏基础上提升了数学推理任务的表现。
一种多模态图像融合方法利用预训练图像分词器的1D标记接口,通过选择性标记编辑增强全局外观一致性同时保留局部细节。
智能已经学会了很多事。 它会推理,会生成,会在海量信息里迅速找到方向。 屏幕之内,一切都在加速。 可屏幕之外,支撑现实世界运转的任务,仍然必须有人到场,必须有人判断,必须有人行动。 所以今年,ATEC向一个更接近未来的问题,发出追问: 如果智能的下一步,不再只是理解世界,而是开始进入世界,开始承担任务—— 那么,我们该对它抱有怎样的期待? 或者说,如果用一场赛事去回应我们的期待,这场赛事应该长什么
让你的 AI 智能体像最懒的高级开发者一样思考。最好的代码是你从未写过的代码。
SpatialClaw 是一个免训练框架,以代码作为动作接口,使视觉-语言模型能够进行灵活且有状态的空间推理,在多种 3D/4D 空间推理任务上表现优异。
多智能体框架通过共享 MLLM 策略和角色专项训练方法,减少视觉推理中的幻觉并实现高效并行处理。
UniCM:揭示极端 El Niño 和 La Niña 背后的跨洋盆信号。 作者丨郑佳美 编辑丨马晓宁 在全球气候风险越来越难以用单一事件解释的今天,气候预测行业正面临一个明显转向:预测对象不再只是某一次 El Niño 或某一个海温指数,而是整个海洋和大气系统中多个气候模态的联动变化。 过去,很多预测方法更擅长处理 ENSO 这样的核心模态,却较难同时理解印度洋、大西洋和太平洋副热带区域之间的
EvoArena基准测试和EvoMem记忆范式通过建模渐进更新和结构化记忆演化,解决LLM智能体在动态环境中的挑战,在演化任务上取得性能提升。
FORT-Searcher 通过识别并缓解数据合成过程中的四个捷径风险,为深度搜索智能体创建抗捷径的训练数据。
近日,大晓机器人开悟世界模型(Kairos)同时在 RoboTwin 2.0、LIBERO-Plus、WorldModelBench Robot、DreamGen等全球针对世界模型视频生成和状态预测的权威具身智能评测中均实现第一,超越 Cosmos3、PI、MotuBrain、being-H0.7、Abot、Fast-WAM、Wan2.2等全球主流世界模型 。凭借首创的原生统一世界模型架构——“多
稳定性,正在成为大模型落地的关键命题。 作者丨郑佳美 编辑丨马晓宁 当 AI 模型从“单次完成任务”走向真实世界部署时,真正的挑战不再只是参数规模和单点性能,而是模型能否在变化中保持稳定。 它要在持续出现的新类别中不遗忘旧知识,要从大规模真实数据中获得更强的泛化能力,要在多客户端、数据分布不断变化的环境下继续学习,也要把图像、视频和 3D 等不同视觉经验组织成统一理解。 这种变化也体现在 CVPR
要闻提示 1.微软中国Azure研发遭“一锅端”:超200人受影响,最高补偿N+7 2.钉钉官宣换帅:无招卸任CEO,92年技术极客陈宇森接任 3.智界称法拉利前首席设计师加盟,法拉利高管质疑:设计师姓甚名谁? 4.李书福卸任极氪董事长 5.曾经落地近90万的神车!路虎揽胜极光L跌至17.98万 6.曝字节豆包手机硬件负责人林夕离职 7.OpenAI拟大幅降价,与Anthropic展开用户争夺 8
PS-SR:兼顾速度、细节与稳定性,让低清画面更可信。 作者丨郑佳美 编辑丨马晓宁 在生成式 AI 进入视频生产链之后,视频增强正在从后期修补工具,变成内容生产、内容分发和机器视觉理解中的基础能力。 现实需求已经不只是让画面变清楚,而是要在电商直播中看清商品质感,在工业巡检中识别裂纹和仪表读数,在远程协作中保留设计细节,在文博数字化中尽量还原影像纹理。 随着 4K 级高清内容逐渐成为视频平台、智能
过去半年,OpenClaw 掀起的“龙虾热”让AI社区陷入一种集体亢奋:AI替你写代码、回邮件、甚至接管设备,仿佛“取代人”的倒计时已经开始。英伟达黄仁勋的那句“迄今发布过的最重要软件之一”的评论,更是为这场狂欢添了一把火。 但当泡沫稍稍退去,IoT行业的沙滩上留下的却是尴尬的裂痕。 某公司实验室的邮件误删、某公司的源代码泄露,以及工信部于今年3月发布的关于防范OpenClaw(“龙虾”)开源智能