科大讯飞」共找到 5075 篇相关文章

算法论文8

腾讯AI Lab首创RL框架Parallel-R1,教模型学会「并行思维」

腾讯AI Lab等机构研究者首创Parallel - R1框架,通过强化学习让模型掌握并行思维。它解决了RL训练的冷启动和奖励设计难题,在多数学基准上提升准确率,还揭示模型思维策略变化及并行思维的‘脚手架’作用。

机器之心
算法论文8

计算所 x 上交论文:只用双人数据,也能生成多人动画丨CVPR 2026

中国学院计算技术研究所与上海交通学团队提出多人物动画生成框架MultiAnimate,引入身份标识与空间关系建模方法,用双人数据训练,能扩展到多人动画生成,优于现有方法。

AI科技评论
算法论文8

模型训练的不稳定性有望彻底解决,MIT新研究用谱正则化替代层归一化

MIT团队创造Lipschitz Transformer,用谱正则化替代层归一化,认为或解决训练不稳定根本原因。他们对比多种方法权衡,发现Muon + 奇异值裁剪推动权衡边界,且工作完全开源。

AGI Hunt
算法论文8

逐个token太慢!模型原生并行出token,CMU、英伟达新作Multiverse

卡耐基梅隆学(CMU)和英伟达研究者提出Multiverse,这是能实现原生并行生成的新型生成模型。它解决了现有并行生成模型缺乏连贯性等问题,通过多方面协同设计构建推理模型,还开源了生态系统。

机器之心
算法论文8

Nature重磅:图灵预言的AGI早已实现,人类却不敢承认!

《自然》杂志新评论文章称,UCSD研究团队系统论证AI已真正“通用”。当前语言模型如GPT已展现广域人类级智能,已达专家水平,研究团队还驳斥了对AGI的十异议。

新智元
新闻资讯7

Cursor滑跪开源技术报告:Kimi基模这样微调能干翻Claude

Cursor放出Composer 2技术报告力证‘自研’,基于Kimi K2.5经持续预训练和异步强化学习,测试表现好。同时,杨植麟分享Kimi团队最新思考,认为模型要规模化,断言模型训练进入第三阶段。

量子位
新闻资讯7

Meta将推出闭源模型,并砸数千亿美元打造超算集群

Meta正在酝酿转向,扎克伯格宣布砸数千亿美元建超算集群,还考虑将强AI模型Behemoth从开源转闭源。此前Meta一直高举开源旗,如今因模型内部表现不佳等因素动摇开源信仰。

AGI Hunt
开源动态7

这个开源模型的UI审美碉堡了~

当下流行基于模型生成HTML源码可视化文本内容,网页审美对模型很难。早期用Claude 3.7,后有DeepSeek V3 0324等。Tesslate开源基于Qwen微调的模型,尺寸全,审美佳,想象空间

探索AGI
产品应用8

AI 时代的 MySQL 数据库运维解决方案

文章指出模型与MySQL数据库运维结合能改变传统管理方式,提供完整的MySQL模型运维系统构建路径,涵盖知识库建设、模型选择与调用策略设计、MCP Server开发及监控与优化闭环建立,可提升运维效率与准确性。

阿里云开发者
算法论文8

模型外挂“三维物体知识库”来了,幅增强机器人长程自主操作能力

现有视觉语言模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。

DeepTech深科技