「大模型裁判」共找到 9214 篇相关文章
114B参数、6B激活,Sand.ai刚刚把全球首个千亿MoE视频生成模型开源了
Sand.ai团队开源全球首个千亿MoE视频生成模型MAGI - 2 - preview,总参数114B,单次前向激活约6B,成本低效果好。该模型解决了视频生成Scaling难题,架构、系统设计出色,开源将改变行业规则。
全球首个全链式空间天气AI预报模型“风宇”!国家卫星气象中心牵头,联合南昌大学、华为共同研发
当前太阳活动高发,传统空间天气预报难满足需求。2025年7月26日,国家卫星气象中心牵头联合研发的“风宇”模型发布,它是全球首个全链式空间天气AI预报模型,提升了我国空间天气预报能力。
手术刀式去噪突破LLM能力上限,从头预训练模型下游任务平均提高7.2% | 中科院&阿里
中科院计算所与阿里Qwen等团队联合提出RefineX框架,通过程序化编辑任务实现预训练数据精炼。它将专家指导结果蒸馏为删除程序,训练优化模型。用其净化数据训练模型,下游任务平均提高7.2%。
VEGA-3D:释放视频生成模型中的隐式3D知识,重塑3D场景理解与具身交互
华中科技大学与百度联合提出VEGA - 3D,释放视频生成模型隐式3D知识。它将视频生成模型作‘潜在世界模拟器’,用自适应门控融合机制,提升场景理解等任务表现,无需额外3D标注数据。
全球最强编码模型 Claude 4 震撼发布:自主编码7小时、给出一句指令30秒内搞定任务,丝滑无Bug
Anthropic 首届开发者大会发布 Claude 4 系列,含 Opus 4 和 Sonnet 4 两型号,编码、推理能力强。Opus 4 处理长任务出色,是最佳编码模型;Sonnet 4 经济高效,被 GitHub 等采用。Claude Code 工具也正式发布。
用得越多、失业越快?GitHub 大改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!
当地时间3月26日,GitHub宣布自4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练改进AI模型,但用户可手动退出。它称此举因模型需更多数据,还拿微软等挡枪,却遭开发者吐槽。
生数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务
生数科技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。生数科技双轨布局,Vidu与MotuBrain同根。
半年研发、1周上线,1秒200行代码爆发?美团研发负责人:靠小团队奇袭,模型和工程能力突破是核心
美团基础研发平台工程效率负责人程大同在访谈中解答了美团 AI Coding Agent 产品 NoCode 的相关问题,包括模型性能优化、产品定位、用户画像、使用边界等,还谈及与 CatPaw 的关系及未来规划。
训具身模型遇到的很多问题,在数据采集时就已经注定了丨鹿明联席CTO丁琰分享
具身智能创企鹿明机器人联席CTO丁琰,分享具身智能数据采集现状、困境及新兴采集方式UMI。他强调具身模型问题多源于数据采集,还介绍鹿明产品FastUMI Pro,及其数据采集、模型训练生态。
顶级视频模型半衰期只有 30 天,但生成式媒体 infra 公司的收入却在一年增长了 60 倍
文章聚焦生成式媒体 infra 公司 fal.ai,其借统一 API 和云端平台让开发者高效调用多模态模型。深入分析其成功因素,如早期押注生成式视频、优化算力和成本、构建生态等,还探讨用户使用模式与行业发展趋势。