多任务操作」共找到 5615 篇相关文章

开源动态8

谷歌最新「0.27B」Gemma 3开源!身板小却猛如虎,开发者直呼救命稻草

大模型时代开发者算力焦虑严重,谷歌Gemma 3系列另辟蹊径。新成员Gemma 3 270M参数规模小但性能强,如在IFEval测试表现突出,有小体积强架构、省电等亮点,适用于场景。

新智元
新闻资讯8

斯坦福意外用AI生成超强CUDA内核,性能比人类专家优化得还要好!翻倍碾压原生PyTorch,华人主创

斯坦福团队意外发现AI生成的内核性能超人类专家优化的,在常见深度学习操作上能让性能提升近400%。其方法是生成自然语言优化思想再转化为代码,还使用分支探索模式。

量子位
算法论文8

让LLM扔块石头,它居然造了个投石机

港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,个模型测试表现良好。

量子位
算法论文8

腾讯与中科院联合提出R-4B,一个能自动决定是否思考的模态大模型

模态大语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在评测中达SoTA,省资源且效果好。

深度学习自然语言处理
算法论文8

机器人高层指挥低层做,“坐标系转移接口”一次演示实现泛化学习 | ICML2025

美国东北大学和波士顿动力RAI提出HEP框架,首创“坐标系转移接口”,有极简高效分层结构、空间对称性自然泛化、创新型体素编码器等亮点。它基于分层策略和接口,提升机器人操作灵活性与泛化性,论文被ICML2025收录。

量子位
算法论文8

Meta超级智能实验室又发论文,模型混一混,性能直接SOTA

大语言模型训练依赖算力和时间,传统模型 Souping 采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。

机器之心
算法论文8

超越RAG,DRAG让LLM准确率飙升45.5%,问题越复杂能力越强

RAG技术虽能让LLM检索资料生成答案,但存在短板,听不懂话里有话。DRAG方法应运而生,有DRA和RSC两大法宝,经对比实验,它在任务上领先,准确率大幅提升,计算开销小。

AIGC开放社区
产品应用8

AI智能体加持,爆款视频产出速度提升了10倍,全民导演时代已来

Video Ocean在影像创作领域带来革新,通过AI Agent实现一人完成职能,将拍摄周期大幅缩短。它打造自动化创作生态,能快速批量生成爆款视频,覆盖种创作场景,操作简单,打破创作壁垒。

机器之心
算法论文8

大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO

本文介绍了大型语言模型稳定强化学习新路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在任务实验中显著优于GRPO。

机器之心
产品应用7

马斯克4000亿布局Agent :杀死 Cursor,Bot 有什么绝招?

马斯克花600亿美金买下AI编程产品Cursor俩月后,SpaceXAI发布Grok Bot。它定位特殊、可跨应用操作等,亮点是智能体云端协作,但产品力与生态有差距,定价高端。

鲸选AI