「大模型预训练」共找到 9663 篇相关文章
全球68%科研人压力爆表,高校AI人才集体大逃亡!
高校AI科研「内卷」加剧,经费缩水、压力增大。爱思唯尔数据显示68%科研人发论文压力暴增,面临时间与资源双重困境。杜克大学陈怡然教授分享看法,工业界崛起,高校面临转型。
WWDC 2025 让大家“失望”了?no!苹果在下一盘AI大棋
苹果WWDC 2025未推出预期AI应用矩阵,股价下跌引失望。但实则是深思熟虑之举,它开放端侧模型及工具,让开发者创新,规避风险,待AI成熟凭借优势“后发先至”。
为什么Cloudflare无法阻止Google为AI 模型爬取网站数据?
Cloudflare推出阻止AI爬虫抓数据功能,却对Google无效。因Googlebot身兼两职,Cloudflare难区分其请求目的。出版商流量因Google AI功能下降,网站主在被剥削和失去流量间两难。
当「变大」不再是唯一的路,又一国产模型开源了
2026年6月智谱开源GLM - 5.2,心洲科技前沿实验室Mind Lab开源Macaron - V1,基座升级至GLM - 5.2。它押注持续学习与群体智能,成绩优于基座,相关理念和工程路径获验证。
从Vibe Coding到Harness—— 一套大仓AI工程化实战
这是腾讯后端微服务与前端微应用大仓的 Harness 实战分享。介绍了 TAB 工程背景、Harness 组成部分,阐述阶段划分、Agent 演进等,还提及人工关卡、门禁脚本等要点,总结了经验与限制。
CVPR 2026 | 1000万段驾驶视频,教会模型如何估计相机位姿
Wayve的LA - Pose研究,不依赖百万级3D标注,从约1000万段未标注驾驶视频自监督学习‘潜在动作’,再用少量3D标注微调,转化为相机位姿估计能力,在多基准上提升精度且泛化能力强。
OVI:统一的音视频生成模型,声音与画面同步诞生
音视频生成领域以往多阶段架构易致音画不同步等问题。耶鲁大学团队提出 OVI 统一范式,采用双塔 DiT 架构与分块式跨模态融合机制,实现音画同步生成,不过目前有计算开销大、音频有局限等问题。
手机上实现AI视频实时生成,DiT模型上移动端
扩散变换器在视频生成任务性能强,但计算成本高,在手机上难实用。Snap提出创新优化法,加速视频生成,能在iPhone 16 Pro Max上每秒超10帧,不过也存在细节退化等局限。
中国AI芯片大突围,DeepSeek V3.1引爆算力革命
DeepSeek V3.1发布,是中国AI技术自主性的战略突围。它有6850亿参数,采用UE8M0 FP8适配国产芯片,具混合推理架构、Agent能力等。其发布或重塑AI产业格局,推动国产芯片发展。
节前重磅:开源旗舰模型新SOTA,智谱GLM-4.6问世
国庆前智谱AI发布新一代旗舰模型GLM-4.6并将开源,它在多方面提升,如编码、上下文长度等,评测性能佳,token消耗降低。经实测,其代码、研究、开发等能力强,成全球开源AI领域重要力量。