M1模型」共找到 8552 篇相关文章

算法论文8

语言反思>强化学习:伯克利新架构碾压传统RL

大型语言模型下游任务优化依赖强化学习,但计算成本高。伯克利等机构论文提出GEPA新型优化器,将LLM执行轨迹转化为诊断信号,用语言反馈替代标量奖励,仅用传统方法1/35计算量,性能最高提升19%。

深度学习自然语言处理
产品应用8

Leogra AI:BVP 投资的欧洲版 Harvey,给每位律师配一位协作 Copilot

本文介绍瑞典法律AI公司Legora,其获1.5亿美元C轮融资,估值18亿。它让律师与AI并行工作,产品覆盖审查等环节。文中还阐述法律科技变革,以及其商业模式、竞争风险、团队文化和全球化策略等。

海外独角兽
新闻资讯8

4位图灵奖得主布道,2大冠军机器人登台,“AI春晚”果然又高又硬

智源大会堪称“AI春晚”,规格高看点多。4位图灵奖得主分享观点,长跑冠军天工和拳击冠军宇树G1机器人秀技能。大会还发布“悟界”系列大模型,RoboOS 2.0与RoboBrain 2.0开源,多方探讨下一代AI发展路径。

量子位
推荐文章8

刚刚!北大校友Lilian Weng最新博客来了:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。

机器之心
产品应用8

正式版发布!DeepSeek-V4-Pro-0813

8月13日晚,DeepSeek-V4-Pro-0813正式版发布。此次升级将Agent维度提升至无短板的第一梯队,具备1M+384K长任务能力,接口双兼容,技术创新多。还公布评测对比、价格并发设定,给出实战代码案例与启示。

机器学习AI算法工程
开源动态8

英伟达&MIT等推出Long-RL,长视频训练速度翻倍

英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。

机器之心
推荐文章8

算力基建金铲子:光模块如何驱动万亿级AI算力市场!

AI大模型训练让光模块成为决定AI集群性能的算力底座。2025年全球光模块市场规模预计达235.5亿美元,中国厂商主导全球市场。未来市场增长围绕1.6T商业化、CPO技术落地及车载通信等新场景展开。

芯师爷
新闻资讯8

硅谷这一夜,属于中国机器人!图灵奖得主、英伟达大牛全来了

美西4月28日,具身智能全球性峰会GEIS在硅谷落幕。中国公司魔法原子发起,图灵奖得主演讲,英伟达等科学家对谈。会上发布世界模型Magic - Mix、灵巧手H01和人形机器人MagicBot X1三款产品,展现全栈自研实力。

新智元
产品应用7

我用 GLM-5.2 读 148 万字资料:一天读懂一个知识

作者用 GLM-5.2 处理 148 万字 Transformer 资料,它生成可打开的 HTML 阅读页,将内容排成理解路线。GLM-5.2 在评测榜单中进入第一梯队,主打 1M 上下文,还分享了使用该模型处理资料的具体做法。

AI产品自由
算法论文8

NeurIPS 2025 Spotlight | 选择性知识蒸馏精准过滤:推测解码加速器AdaSPEC来了

大型语言模型推理延迟高、开销大,推测解码可加速但依赖草稿与主模型一致性。佐治亚理工等团队提出 AdaSPEC 蒸馏法,过滤难学 token,提升草稿模型与目标模型对齐度,实验显示能提升接受率和推理速度。

机器之心