来自 Twitter · Hacker News · GitHub 的 AI 行业动态
Result 是一个覆盖创业全流程的平台,帮助用户从创意到产品落地、公司注册、财务管理、报税和营销。Y Combinator 对其正式发布表示祝贺。
GarryTan 表示 Fable 5 是他见过的最大模型能量,但未透露具体参数或性能数据。
OmniCap-IF首个综合基准,用于评估全模态视频描述的指令跟随能力,揭示了多模态推理中显著的性能差距及格式-内容权衡问题。
推出名为CoVEBench的新基准测试,用于评估组合式视频编辑能力,解决了现有模型在处理复杂多步骤编辑任务时保持时空内容方面的局限。
SWE-Explore引入了一个基准测试,通过要求在代码行数限制内提供相关代码区域的排序列表来评估编码智能体的仓库探索能力,结果表明智能体式探索优于传统检索方法。
随着微信正式面向开发者提供AI生态接入能力,滴滴作为首批合作伙伴,已与微信团队合作将核心网约车服务融入微信AI Agent。未来,用户通过微信内AI交互,即可直接唤起滴滴快车、专车、特惠等服务。 当用户在微信中产生出行需求,只需说一句“帮我叫一辆滴滴去机场”,“我要打滴滴回家,要特惠快车或者快车”即可根据行程距离、时效需求与个人偏好,自动推荐最优车型,一键唤起叫车服务,全程不跳转,极速出发。 据了
Agents' Last Exam (ALE) 是一个评估AI智能体的基准测试,聚焦长期、有经济价值的现实世界任务,涵盖13个行业集群、1000+任务,揭示了基准测试表现与实际部署之间存在显著差距。
作者|吴思梦 编辑|岑峰 2026年6月3日,计算机视觉与模式识别顶级会议(CVPR)在美国丹佛举行。在大会特邀演讲环节,前 DeepMind 蛋白质设计团队核心成员、2024年诺贝尔化学奖获奖项目 AlphaFold 核心研究员,Latent Labs 创始人兼 CEO Simon Kohl 发表了题为“Programmable Biology:Generative AI for Molecul
SlimSearcher是一个通过帕累托高效轨迹过滤和自适应奖励塑造来提升深度研究代理效率的框架,在保持准确性的同时降低计算成本。
今年的数据中心采购出现了一个反常情况,CPU开始缺货了。 英特尔市场营销集团副总裁、中国区总经理郭威在发布会上给出了一组数字:2026年一季度,中国AI算力需求同比爆涨417%;与此同时,CPU与GPU的配比已经从过去的1:8,逐步走向1:4、1:2,部分场景甚至达到了1:1。 这不是宏观预测,是正在发生的现实。英特尔数据中心集团副总裁、中国区总经理陈葆立透露,某国内头部大模型厂商从去年到今年,C
Skill-RM提出统一奖励建模框架,将奖励计算作为结构化智能体任务处理,支持动态证据聚合和跨不同应用的一致评估。
提供AI编程智能体循环工程的实用模式、启动器和CLI工具,设计提示与编排智能体的系统。包含loop-audit、loop-init、loop-cost等工具。
要闻提示 1.国际宇航科学院对全球喊话:别擅自回复外星人!“这是全人类的决定” 2.TP-LINK全员转签遭近九成员工抵制,社保突停叠加百人离职,引发人心动荡 3.董事长被曝电梯亲密视频!胜宏科技回应:与生产经营无关 4.Kimi估值飙升至300亿美元,半年猛增6倍 5.微信新功能:朋友圈能搜索了 6.加入仅半年,字节前公关总监据传从理想汽车离职 7.再也不怕调休睡过头!苹果 iOS27 新增工作
人类心理测量问卷无法可靠预测LLM在真实交互中的行为,而基于生成的分析方法在理解模型对日常用户查询的响应方面具有更高准确性。
利用Replit的并行代理功能,在同一会话中生成移动应用、推广视频及pitch deck,提高原型迭代效率。
活动涵盖图像、视频及后期实操,提供AI算力积分,名额有限。
该开源模型具备256K上下文、64K最大生成长度,专为Agent工作流优化,支持推理、工具调用和结构化输出。
微软研究员Lorin Crawford等通过单细胞分析发现癌症个性化治疗新线索。
提出潜在空间记忆机制,增强视频生成模型对空间结构的建模能力。
用户可在v0平台上使用最新Fable 5模型,提升对话与创作能力。
基于Fortanix可信执行环境,语音通话数据全程加密,满足企业隐私需求。
用户可快速将视频适配不同宽高比,适配多平台发布需求。
通过持续关闭账本,实现月末零手动、条目自动过账,仅保留小规模调整的人工复核。
TITO确保训练评估与推理产生的token完全对应,单样本即可覆盖多轮轨迹,显著降低计算量并避免off‑policy漂移。
swyx 发现让 Claude Code 对 Fable 代码进行"review my code for issues"会产生强烈震撼,建议正式部署前先用 Fable Check 进行检查。
NVIDIA 发布科普视频,由 Amogh Dendukuri 详解 AI Grid(AI 网格)的定义,阐述分布式网络上优化推理的五大要点。
v0 新增密钥检测功能,可识别 prompt 中的敏感信息并自动转换为环境变量,提升开发安全性和工作流效率。
Mythos 和 Fable 的后训练将测试时计算用于解决超长任务(数十人时、数百美元每任务),首次实现有意义的 effort scaling,已在 Cognition Devin 上线,仅 1.4…
在 WWDC26 上,NVIDIA 机密计算技术联合 Apple 和 Google Cloud,首次将 Apple Intelligence 工作负载扩展至第三方数据中心,基于 NVIDIA Bla…
a16z 合伙人 Marc Andreessen 阐述两种 AI 发展路径:少数 God models 耗资数百亿,类比过去 20 年搜索格局;另一路径是长尾细分市场,AI 不会被少数模型垄断。