双模式策略优化」共找到 1997 篇相关文章

算法论文8

腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应长短链融合

日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。

InfoQ
算法论文8

Graph工程的尽头是,Ontology工程

15家机构联合发布图工程系统性综述,指出此前“XX工程”范式多优化单个智能体,而图工程能将智能提升到系统层面。论文还指出图工程语义局限,认为本体工程可作下一代系统智能语义地基。

PaperAgent
新闻资讯8

中国第一,直逼OpenAI!神秘「扫地僧」冲到全球前七

神秘中国AI「扫地僧」MopMonk以73.1%胜率杀入CyberGym全球前七,紧咬OpenAI。它用MiniMax M3为基座,靠结构化记忆、多Agent并行等策略提升漏洞挖掘执行力,示范开源基座极致利用之路。

新智元
8

实测最强的Cowork Agent模型M2.7,这是龙虾最好的模型搭子

实测MiniMax新发布的M2.7模型,解决了Agent的笨拙感,是国内最强的Cowork Agent模型。它技能命中率高,能自进化,对办公场景做了优化,还能解决生产效率问题,加强了人设保持能力。

开源AI项目落地
算法论文8

解决智能体手工构造难题! 浙大&腾讯提出 ReCreate,从零自动构建领域智能体

浙大、腾讯等机构研究者提出ReCreate框架,不依赖手工设计,让智能体自主构建。它从交互经验中找优化方向,有三重设计,实验显示能提升多领域任务通过率、降成本,未来或开启AI“自我制造”时代。

AI科技评论
开源动态8

腾讯混元世界模型HY-World 1.5开源,24 FPS的实时交互世界建模

腾讯混元世界模型HY - World 1.5开源,实现24 FPS实时交互世界生成。它采用双重动作表征等技术,解决了长程生成问题,还通过强化学习等优化,在多方面表现出色,为具身智能场景模拟奠基。

AIGC开放社区
新闻资讯7

18 天做出来的产品,一个月留存 1%。OpenAI 抄袭 Skills?

2025下半年科技行业重速度,OpenAI开发Sora安卓应用仅18天,国内产品也纷纷发布。但快也有问题,Sora 30天用户留存率仅1%。此外,OpenAI人才策略激进,还被指抄袭。做产品应兼顾快慢。

MacTalk
产品应用8

CUDA再见了!寒武纪亮出软件全家桶

在AI时代,竞争转向软件生态等综合实力。寒武纪亮出软件全家桶,其基础软件平台Cambricon NeuWare日趋成熟。在训推解决方案上成果显著,各组件如驱动、编译器等也有诸多优化和功能,加速产业智能化转型。

新智元
新闻资讯8

躲了科学家几十年的流体不稳定奇点,被DeepMind用AI找到了

谷歌DeepMind与多所高校合作,用物理知情神经网络(PINN)+高精度数值优化的方法,找到了流体方程里的不稳定奇点。这种奇点很“挑剔”,此前难寻踪迹,此次发现为非线性流体动力学研究提供新范式。

量子位
算法论文8

提示工程死亡?不,它刚刚重生为计算科学:一篇讲透Prompt设计的科学基础

大型语言模型在多步推理任务中受挫,因Transformer架构有计算深度限制。本文建立提示设计理论框架,揭示提示是信息选择器,优化提示可使推理性能提升超50%,将提示设计从试错艺术变为可计算科学。

深度学习自然语言处理