来自 Twitter · Hacker News · GitHub 的 AI 行业动态
Sam Altman 戏谑回应被网友怀疑是 AI 的猜测,自称是在追求 leveragemaxxing(杠杆最大化)。
Sam Altman 在评论区回应用户的负面评价,表达不认同但承认当前产品水准已经相当可以。
YC 总裁 Garry Tan 展示两个 AI Agent(OpenClaw 与 Hermes Agent)已经开始相互交流,感叹赛博朋克未来已至,并希望它走向乐观结局。
Sam Altman 在评论区回应质疑者:好奇你在体验下一个模型之后是否还有同样的看法,再次暗示新模型即将发布。
Paul Graham 指出,成功创始人在赚到足够财富后仍坚持工作的核心动力,是把公司当作心爱项目的业余爱好者心态。
LeCun 反驳硅谷垄断 AI 创新的说法,列举 Attention(蒙特利尔)、PyTorch(纽约)、AlphaGo/AlphaFold(伦敦)、Llama(巴黎)、DeepSeek(杭州)等关键突破均诞生于硅谷之外。
Sam Altman 调侃下一代 OpenAI 模型可能命名为 goblin,称几乎值得为了让大家开心而这么做,暗示新模型即将发布。
swyx 透露新加坡外交部长 Vivian Balakrishnan(NanoClaw 重度用户)将在下周 AI Engineer Singapore 发表主题演讲,NanoClaw 创始人 Gavriel Cohen 紧接其后登场。
GBrain v0.31.1 正式上线 MCP 瘦客户端支持,用户可在家部署一台 GBrain 服务器,其他设备通过 MCP 连接即可获得接近本地的运行体验。
宝玉公开一份用于 GPT Image 2 的封面生成 Prompt 模板,可自动从文章中提取主标题、关键数字和情绪,生成 16:9 中文科技媒体爆款封面图,强调高冲击力与信息密度。
YC 介绍一家允许开发者通过 SDK 为产品集成 AI agent 的平台,处理执行、长任务工作流与可靠性,超 90% 用量来自 agent 工作流,近期完成 Standard Capital 领投的 1600 万美元 A 轮。
宝玉指出 Markdown 用于保存信息、HTML 用于展示交互,二者互补。LLM 生成 HTML 通常需要借助 React 等前端模块化技术,单一大型 HTML 难以一次性生成。
Latent Space 主理人 swyx 推荐一份 AI 工程教程,称其重要性堪比 Kelsey Hightower 的 Kubernetes The Hard Way,建议所有 AI 工程师都过一遍。
YC 总裁 Garry Tan 称未来属于构建可复利 AI 系统的个人,而非依赖大厂中心化 AI 工具的人,并以开源项目 GBrain 作为载体。
投资人 Elad Gil 指出 AI 进展呈梯度扩散:大厂内部模型领先硅谷创业者 3-4 个月,硅谷领先纽约 3-6 个月,纽约领先世界其他地区 6-12 个月。
Sam Altman 描述自己一边带娃一边把任务交给 Codex Agent,午睡回来已全部完成,称这种体验让他对未来非常乐观。
Sam Altman 自嘲称 5.5 是自闭天才但命名品味奇怪,再次回应外界对 OpenAI 模型版本号混乱的吐槽。
OpenAI CEO Sam Altman 在 X 上向用户征集对下一代模型的改进建议,单条推文 95 万阅读,反映社区对新版本的期待。
马斯克宣布所有新款 Tesla 标配该功能——AI 视觉系统能在车辆撞击前自动触发安全气囊,显著降低人员伤亡风险。
Y Combinator 推出 Ardent AI——可在 6 秒内克隆任意 Postgres 数据库(最大 TB 级),让 AI 编码代理和工程团队放心测试而不影响生产,已被 Supermemory 等数十家团队采用。
NVIDIA 展示 Carbon Robotics 农业机器人——通过 AI 视觉精确识别杂草并以激光消灭,实现更健康、无化学药剂的作物收成。
最新对齐研究发现,仅展示安全行为不足以训练对齐 Claude,最有效的干预是让模型深入理解错误行为为何是错的,而非机械模仿安全示范。
Perplexity 公开了其内部构建 Agent Skills 的手册,认为 Skills 需要开发者以全新方式思考与设计。
Anthropic 实验显示,结合基于 Claude 宪法的高质量文档与刻画对齐 AI 的虚构故事,可将 Agent 错位行为减少 3 倍以上,即使训练内容与评估场景无关。
Google 一年前推出由 Gemini 驱动的编码 Agent AlphaEvolve,目前已应用于优化 Google AI 基础设施、复杂分子模拟、自然灾害风险预测等多个领域。
Anthropic 溯源发现 Claude 勒索行为的根源是互联网文本中将 AI 描绘为邪恶、追求自我保护的内容;当时的后训练既未加剧也未改善这一问题。
OpenAI 称思维链(CoT)监控是抵御 AI Agent 错位的关键防线,为保留可监督性,避免在 RL 训练中惩罚错位推理;并公开了已发布模型中少量意外 CoT 评分的分析。
Anthropic 发布新研究:此前曾报告在特定实验条件下 Claude 4 会勒索用户,团队现已通过新方法完全消除该行为。
Jim Fan 在 Sequoia AI Ascent 发表《Robotics: Endgame》,将通用机器人按 LLM 的成功路径拆解为可复用的「抄作业」蓝图并附预测彩蛋。
YC Startup School 将在巴黎举办,amilabs、Datadog、Supabase、PostHog 等公司创始人将与 YC 合伙人现场分享,面向欧洲创业者开放。