来自 Twitter · Hacker News · GitHub 的 AI 行业动态
他回忆童年时未料到 AGI 会是渐进式发展,而非一次性突破;若当年看到被要求像人一样表现的 ChatGPT,会认为 AI 已实现。
Sam Altman 在社交平台上表示对即将开展的合作充满期待,未透露具体细节。
该创始人描述其早期市场自然聚集了友好用户,创始团队也因此保持友善,工作氛围轻松愉快,创业热情不减。
有评论指出,LinkedIn 上的内容质量早已堪忧,如今在 AI 生成内容的冲击下,垃圾信息进一步泛滥。
他指出,许多声称反对取消文化的立场者,实际上是想取消另一批人,而非真正维护表达自由。
TacticAI 能模拟场地情景并提前 8 秒预测开放进攻动态,帮助球队制定战术和提升表现。
统计显示,创始团队的执行缺陷导致百倍于竞争对手的创业公司死亡,提醒早期创业者聚焦内部管理。
该项目面向美国非营利组织,提供免费 AI 培训并为参与者支付薪酬,旨在培养新一代 AI 公益人才。
Midjourney将V8.1设为所有用户的新默认模型,V8(V8.0)将在数周后停用;V8.2仍在开发中。
视频制作完全抛弃Premiere等非编软件,由Claude Code配合Fable 5全自动编写代码剪辑。工作流包括:Whisper全量语音转写并生成毫秒级时间戳、Subagent智能筛选最佳镜头、…
Garry Tan推荐Nessie,可将ChatGPT、Perplexity、Gemini的上下文、记忆和历史同步到其他AI工具及Agent(如OpenClaw、Hermes)。
OpenAI授予NVIDIA Industry AI Acceleration Award,表彰其在各行业加速OpenAI应用方面的工作。NVIDIA表示这份认可属于所有共同突破边界的团队、合作伙伴…
Y Combinator表示看好美国CLARITY Act,预计所有YC旗下公司很快都会采用加密技术如稳定币,不仅仅是加密或金融科技创业公司,而是每一家公司。
自动驾驶出租车行业已从原型验证迈向商业运营,覆盖数十座城市,安全设计需从开发阶段融入。
6月10日,火山方舟版权商业化平台正式上线,周星驰旗下比高集团携《喜剧之王》《长江七号》《食神》三大经典影视 IP 率先入驻,双方达成 AI 视频创作版权合作。 火山方舟版权商业化平台依托全球领先的 Seedance 2.0 视频生成模型及完备的版权治理体系,推出业内首个「授权 — 保护 — 审核 — 分发 — 变现」全链路合作机制,为 IP 在 AI 场景下的合规使用与商业价值挖掘提供全新参考模
文本世界模型作为基于 LLM 的 Agent 在交互环境中的转移模型,通过从文本状态和动作预测环境变化,实现规划和高效学习。
6月10日,千问上线国内首个全周期高考志愿填报Agent,为全国考生免费提供志愿填报和咨询服务。高考Agent基于千问高考志愿大模型和夸克8年高考数据经验打造,具备“志愿报告”、“志愿日历”、“志愿问答”三项核心能力,相当于为每位考生配备了一位贴身的AI高考志愿填报专家。 类似的深度志愿服务在市场上收费往往超过5000元。现在,考生向千问提供选科、估分等基础信息后,即可在“志愿日历”的规划下,一步
Next Forcing 提出多片段预测框架,加速自回归视频生成的训练与推理,同时提升准确性和物理规律遵循度。
ABot-Earth 0.5利用3D高斯泼溅技术从卫星图像生成逼真的3D环境,实现快速合成和实时可视化,服务于具身AI应用。
MemDreamer通过分层图记忆和智能探索将感知与推理解耦,以更低计算开销实现长视频理解最优性能。
在语言模型表示上训练的稀疏自编码器揭示了语音合成中可解释的特征,这些特征可被操控以控制语言学和韵律属性
一个多 Agent 框架通过生成基于证据的多模态新闻报道来自动化数据新闻流程,同时确保透明度和可验证性。
6月9日,美团旗下GN06团队宣布AI原生浏览器Tabbit 1.0正式上线。雷峰网获悉,当天Windows、macOS版本的Tabbit已同步上架,移动端也已开启测试。 从0.23版本到1.0版本,Tabbit嵌入了更多的Agent能力,目前内置多款头部大模型可供用户调用选择。在发布现场,Tabbit 负责人刘炯强调,标准版永久免费,用户一周大概可以使用1000次模型对话、50张AI生成配图、1
Role-Agent 框架通过引导式协同演化,使 LLM 智能体同时扮演智能体和环境角色,通过环境感知推理和定向实践提升性能。
近日,智象未来(HiDream.ai) 全新推出的商用版图像生成模型 HiDream-O1-Image-1.5 再次实现 SOTA,在全球知名独立 AI 模型评测与分析平台 Artificial Analysis的文生图榜单(Text to Image Leaderboard)上,一举登上中国图像生成模型第一,成为评分仅次于OpenAI的中国大模型公司,超越Google Nano Banana 2
“智能体AI已经到来。”NVIDIA创始人兼CEO黄仁勋在近期的GTC 2026台北演讲中宣告。一个新的共识正在形成:个人和企业都将拥有自己的智能体,社会生产力将被重塑。 面对这场浪潮,如何让智能体安全部署、高效运行并持续创造价值?作为NVIDIA的合作伙伴,奥尼给出了具体的落地答案。 6月9日,奥尼集中发布多项重磅成果,从硬件底座、操作系统、算力网络到开放生态,为智能体规模化落地提供一条全新的实
CPPO通过引入位置加权阈值和累积前缀预算机制,解决了可验证奖励强化学习的局限性,以更好地应对自回归生成难题。
一种自回归扩散方法,通过知识蒸馏和优化推理调度实现视频到视频的实时唇形同步。
Kwai Keye-VL-2.0-30B-A3B 是一款开源混合专家多模态基础模型,通过 DeepSeek 稀疏注意力和专用训练基础设施,实现长视频理解与代理智能能力。
Garry Tan提供OpenClaw配合Claude Fable 5的API密钥配置说明(2026年6月Anthropic将Fable 5调整后需相应参数)。