上纬新材」共找到 5119 篇相关文章

算法论文8

强化学习也遇到了“天花板”?Andrej Karpathy构建了一个算法

大神Karpathy肯定强化学习(RL)价值,指出其比监督微调更具扩展性,但存在渐进式学习低效、背离人类学习机制的局限。他提出“第二天性”范式算法,还面临泛化等挑战。

AI寒武纪
算法论文8

扩散LLM推理范式:打破生成长度限制,实现动态自适应调节

随着扩散大语言模型成为热门,但其推理时存在预设固定长度的限制。香港中文大学 MMLab 等提出 DAEDAL,赋予模型根据问题自主调整回答长度的能力,在性能和计算效率有提升。

机器之心
新闻资讯7

独家丨前毫末智行CEO顾维灏创业,成立机器人公司

AI科技评论独家消息,前毫末智行CEO顾维灏成立「紫星勤行」,布局酒店服务机器人赛道。他是老百度人,曾深度参与百度Apollo项目,毫末智行曾获多轮融资,现他在赛道寻可能。

AI科技评论
产品应用8

刚刚,MiniMax模型接管「音乐圈」!20秒出歌Cover全风格

4月10日,MiniMax带来重磅更线Music 2.6模型并发布专属Music Skills,核心功能Cover翻唱可自由进行风格置换。Music 2.6在速度、音乐性和音质改进明显,还开放三个Music Skills套件。

机器之心
开源动态7

把任何文档变成Claude的技能,这个开源工具火了。

Claude出Skills,类似插件让其有自定义可调用功能。开源工具Skill Seekers能把网站文档转换成可使用技能。介绍了Skills特点及Skill Seekers功能原理、特点等,效率提升显著。

开源AI项目落地
算法论文8

极简RL范式:一半算力刷1.5B模型推理SOTA

过去为提升中小参数量模型推理能力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定超参训练方案,在两主流1.5B模型SOTA,节省2倍算力,消融实验还揭示部分技巧会致性能退化。

深度学习自然语言处理
算法论文8

「有望成为Transformer杀手」,谷歌DeepMind架构MoR实现两倍推理速度

谷歌DeepMind发布架构MoR,有望成Transformer杀手。它统一实现参数共享、自适应计算,兼顾性能与效率。实验显示其推理吞吐量提升,降低计算需求,但能否取代Transformer存疑。

机器之心
算法论文8

机器人需求驱动导航SOTA,成功率提升15%!浙大&vivo联手打造

浙江大学和vivo人工智能实验室团队在ACM MM 2025发表框架CogDDN。它模拟人类认知,将“双过程理论”用于机器人需求驱动导航,实验中表现优于单视角SOTA方法,为智能机器人技术发展奠基。

量子位
新闻资讯7

Grok最模型吃Cursor「加餐」,马斯克:Coding实现巨大改进

马斯克在X透露,xAI的Grok基础模型V9 - Medium(1.5T)完成训练,预计2 - 3周后发布,训练加入大量Cursor数据。同时,xAI的AI编程代理工具Grok Build进入早期Beta测试阶段。

量子位
新闻资讯7

独家丨盛大挖角代季峰,筹建 AGI 公司对标 DeepSeek

AI 科技评论独家消息,盛大网络挖角清华副教授代季峰筹备 AGI 公司,对标 DeepSeek,正招募核心团队。代季峰学术成果颇丰,项目或融合脑科学与 AI 架构,“旧互联网 + 学术”组合有挑战也值得期待。

AI科技评论