大模型突破与头部竞争
Anthropic Claude Opus 5与Kimi K3等顶级模型密集发布,在推理能力、设计生成与性价比上实现代际跨越,Opus 5更在IMO斩获满分;OpenAI与字节跳动的人才争夺同步升温,标志着基础模型竞赛进入技术与资源双重博弈的新阶段。
探索优质AI工具 · 追踪前沿模型 · 获取行业资讯
Anthropic Claude Opus 5与Kimi K3等顶级模型密集发布,在推理能力、设计生成与性价比上实现代际跨越,Opus 5更在IMO斩获满分;OpenAI与字节跳动的人才争夺同步升温,标志着基础模型竞赛进入技术与资源双重博弈的新阶段。
AI Agent正从对话辅助迈向自主执行,吴恩达开源桌面Agent OpenWorker实现跨工具任务自动流转;Thinking Machines Lab发布持续学习模型Inkling,强化学习先驱Sutton同期入局,加之语音协作新范式与Agentic RL训练优化,自主智能体商业化拐点临近。
黄仁勋、扎克伯格等25家机构联署公开信力挺开放权重,引发AI开源与闭源路线的新一轮论战;国产大模型持续开源跟进,显示开源已从模型层扩展至产业全栈,成为争夺全球AI领导地位、构建互操作生态的核心战略支点。
具身智能产业化进程提速,科沃斯开源其具身智能机器人,释放十四年硬件与数据积淀;新智具身联合复旦大学发布3万小时触觉数据集,旨在统一触觉“方言”补齐机器人“手感”,为具身智能规模化应用奠定感知基础。
前沿模型能力跃升触发深层安全焦虑,Opus 5因内部质疑其过强能力与潜在风险而暂缓发布;与此同时,可审计医疗影像模型CLEAR、端侧AI安全框架MoAI等研究从可解释性与终端隐私维度发力,系统构筑AI可信治理的技术防线。
大模型工程化落地面临效率瓶颈,腾讯E-GRM通过动态推理机制实现CoT自适应截断,显著降低计算开销;UC Berkeley与清华、腾讯团队分别从后训练多样性和Agentic RL rollout成本角度提出优化方案,Vibe Coding对上下文保持的反思亦凸显长程交互优化需求。
多模态大模型在垂直领域加速渗透,智象未来三个月融资超21亿元,跻身独角兽行列;清华镜像错觉3D生成系统入选CVPR,MonkeyOCRv2通过视觉记忆保留文档证据,显示AI在艺术创作、专业文档处理等场景的精细化应用能力持续提升。