「M12/M3比率」共找到 327 篇相关文章
教AI「择偶生娃」,复刻自然演化!上交校友提名最佳论文
Sakana AI受自然演化启发提出全新模型融合进化方法M2N2,引入‘择偶机制’让AI‘竞争、择偶、繁衍’。此研究获GECCO 2025最佳论文提名,M2N2表现优于其他算法,还避免‘灾难性遗忘’。
超越GPT-4o!华人团队新框架让Qwen跨领域推理提升10%,刷新12项基准测试
加拿大滑铁卢大学与TikTok新加坡的华人团队提出全新训练框架General - Reasoner,让Qwen系列大模型跨领域推理准确率提升近10%,在多项基准测试中超越GPT - 4o。该框架有全领域推理数据集和生成式答案验证器两大创新。
华人女学霸AI杀疯!本科最难数赛12题全对,自主证明首次公开
24岁华人女学霸Carina Hong初创打造的AxiomProver,在2025 Putnam数学竞赛拿下满分,其自主生成的Lean证明也公开。该竞赛是北美本科生数学竞赛天花板,人类满分罕见。此外,GPT - 5.2 Pro数学表现也很强,引发“奇点将近”之感。
10亿天价挖角惨遭12人连环拒,小扎钞能力失灵!OpenAI系初创0人卖身
Meta为从OpenAI前CTO初创公司挖人,开出10亿美元天价,却遭12人拒绝。同时,苹果AI团队一月内流失4员大将。此外,Meta的Llama 4发布遇挫,小扎豪掷重金重组AI部门,其AI豪赌回报成疑。
从MiniMax到DeepSeek:为何头部大模型都在押注「交错思维」?
昨日推特博主公布国内几大开源模型在 mini - SWE - agent 测试成绩,MiniMax 新一代大模型 M2 表现最佳。其采用的「交错思维」技术成亮点,解决了状态漂移问题,正成高性能 Agent 模型标配。M2 既强又省,还给出使用最佳实践。
一次汇报,资源投入暴涨数十倍:快手大模型推荐以 1/12 成本突围,技术负责人亲历的革新故事
InfoQ 专访快手科技副总裁周国睿,他分享了快手大模型推荐技术投入挑战、决策过程等。如汇报后资源投入涨数十倍,以 1/12 成本突围。还阐述推荐系统变革、技术押注及未来推荐系统突破点等观点。
4秒出百万面!突破千万面精度+12K高清贴图,手握数亿的3D生成公司下一局怎么打?
影眸科技旗下Hyper3D受英伟达青睐。该司完成数亿元融资,发布全新模型Hyper3D Rodin Gen - 2.5,引入类LLM的Thinking机制,4秒生成百万面级模型,还突破千万面精度,搭配12K原生3D贴图模型。
苹果春季新品奔着龙虾来了!AI性能暴涨8倍,8499元起
苹果发布MacBook Pro M5系列、MacBook Air M5笔记本,8499元起,还更新了显示器。新款MacBook Pro搭载M5 Pro和M5 Max芯片,AI性能大幅提升,提示词处理速度快4倍,图像生成速度快8倍,存储、续航等方面也有优化。
模型的自我进化,可能真的开始了。
昨天Hermes Agent更新支持原生Windows,安装简单。它调用量超OpenClaw成榜首,与MiniMax M2.7组合迭代快,能长程干活、自主迭代解bug,还可复刻文档风格样式,两团队正合作后训练项目。
突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端长时记忆
机器之心发布文章介绍,大模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的大模型长时记忆框架。