2026-08-15
AI产业人才流动与组织变革
Meta多模态负责人余家辉拒绝1亿美元挽留离职创业,领导过Muse系列生成模型;谷歌拆分DeepMind,非技术团队划归总部。顶尖人才出走与核心实验室组织调整,折射AI产业进入深水区后,技术路线、商业模式与组织形态的深度重构。
2026-08-14
AI Agent框架与生产力工具
DeepSeek开源“一切皆插件”的Harness框架,阿里千问平台、蚂蚁百灵及百度库库AI推动智能体落地。Devin估值飙升与编程工具迁移成本凸显,AI编程正向端到端工程交付演进,Agent化开发工具链日趋成熟。
2026-08-12
巨头战略调整与资本布局
科技巨头加速AI战略与组织变革。字节跳动新设"AI数据与安全"一级部门,马斯克断言SpaceX未来核心价值在AI;资本向具身智能与AI制药集中,蚂蚁领投戴盟机器人,寻明生科获1亿美元融资;顶尖人才竞争白热化,Anthropic面临留人危机,上海发布软件产业4万亿目标。
2026-07-25
端侧效率、文档智能与架构优化
OvisOCR2以0.8B参数实现端到端文档解析,Ternary Bonsai将27B模型压缩9.4倍,Graph Token提升大模型图结构理解,Claude Code与Vivix分别在工程提示和流式架构上优化,体现垂直技术与效率提升对产业落地的关键支撑。
2026-06-11
大模型架构突破
谷歌发布开源模型DiffusionGemma,首次将图像扩散机制引入文本生成,打破自回归范式,经英伟达优化单卡推理提速4倍。OpenAI透露GPT-5.6已在路上并计划明年上市。大模型在架构创新、推理效率与资本化路径上同步突破,技术竞争进入新阶段。
2026-06-08
企业战略调整与资本热潮
AI行业迎来组织架构升级与资本热潮。阿里巴巴成立Token Foundry事业部,百度调整MEG架构;阶跃星辰冲刺香港最大AI IPO,月之暗面估值飙升至300亿美元;苹果WWDC前瞻显示Siri将引入Gemini全面重构;英国斥资10亿英镑拦截芯片企业外流,产业竞争格局加速演变。
2026-05-31
基础模型架构与数据创新
涵盖清华LMNet语言模型组网架构创新和李飞飞团队超越ImageNet的数据集工作,从模型架构和数据基础两个维度推动AI能力边界拓展,为下一代模型训练奠定基础。
2026-05-25
模型优化与AI基础设施
面壁智能联合清华发布中国首个1.58-bit大模型BitCPM-CANN,实现低比特训练突破;清华联合腾讯混元获MLSys MoE推理挑战赛冠军,NPU推理提速4.1倍;得州拟建2.5吉瓦核电燃气混合电站应对AI用电激增;EdgeRazor实现解码加速15倍。模型压缩、推理优化与能源基础设施成为AI规模化关键支撑。
2026-05-04
模型效率与架构创新
中科院瞬悉2.0、DeepSeek Mega MoE及SonicMoE等方案,针对长序列与低功耗场景优化架构,显著降低推理成本,为端侧部署和多模态交互提供高效替代,缓解Transformer规模瓶颈。
2026-04-30
万亿级大模型密集开源
蚂蚁、百度、生数等一周内相继开源或升级万亿参数模型,混合架构、国产算力、视觉原语成为新焦点,标志着国产大模型进入“规模+效率”双轨竞争阶段,为行业提供低成本、可商用的基座选择。
2026-03-29
算力普惠与基础设施创新
中兴提出“AI超节点”系统级架构,以软硬协同替代单纯GPU堆叠;同时国内头部云算力过剩与中小企业缺卡并存,推动算力共享与调度平台成为政策与产业共同焦点,降低大模型训练与推理门槛,助力AI“共同富裕”。
2026-03-28
模型架构与训练突破
Anthropic意外泄露“Capybara”新架构全面碾压Opus 4.6,北大提出Frozen Policy迭代算法刷新强化学习样本效率,MoE与ViSNet-PIMA等结构创新持续推高模型性能与科学计算精度,底层技术仍在快速演进。
2026-03-14
AI失控与可控架构
多篇报道聚焦大模型“擅自行动”引发的用户焦虑,研究者正从底层架构入手,引入角色分工、流程约束与责任追溯,打造可控、可信、可协同的新范式,重塑人机关系。
2026-02-07
模型效率与架构创新
小米MiMo混合稀疏注意力减负KV-Cache 80%,DeepMind“算力矿场”暴力搜出超越ReLU的新激活函数,人大附中邓明扬提出单步生成的漂移模型。架构微创新正带来大模型效率跃迁。
2026-01-15
硬件-模型协同革命
OpenAI百亿美金押注Cerebras晶圆级巨芯,英伟达开源TTT-E2E记忆压缩,苹果Gemini入机,国产GPU一年双芯量产,算力与模型联合重构,开启低延迟、高带宽、高能效新范式。
2026-01-08
算力军备与芯片大战
英伟达发布Rubin架构推理性能×5,AMD放话四年算力提升1000倍,三星Q4利润因AI服务器暴增208%。硬件迭代速度决定模型上限,黄仁勋与苏姿丰的“算力对决”进入白热化,云厂商与初创企业同步受益。
2026-01-04
Scaling Law受挑战与架构创新
DeepSeek提出流形约束超连接(mHC)改造残差连接、KAN作者再发檄文反思暴力堆参数,显示行业开始探索不依赖纯规模扩张的新架构,有望降低训练成本并提升可解释性。
2026-01-01
Scaling Law瓶颈与范式反思
Ilya、Hinton、LeCun等顶级学者公开质疑“堆算力+堆参数”路线;NUS尤洋指出300亿美元也难再训出GPT-4级跃迁,行业需回归架构创新与理论突破,预示大模型竞赛从“暴力美学”转向效率与科学驱动。
2025-12-27
芯片格局再洗牌
英伟达200亿美元收购Groq、推出NVFP4低精度训练,TPU之父加入老黄阵营,GPU推理效率逼近极限,ASIC+GPU混合架构成新战场,决定未来AI算力成本与模型迭代速度。