动态策略进化」共找到 1793 篇相关文章

算法论文8

CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」

新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略

新智元
新闻资讯8

「部署态」元年,这家公司就把落地方案卷到了七种

在4月17日上海举办的大会上,智元拿出四大全新机器人产品、六大AI模型、七大标准化生产力解决方案及全栈生态技术体系。其创始人认为具身智能正从“开发态”向“部署态”进化,2026年是元年。

机器之心
算法论文8

2026!开年关键词:Self-Distillation,大模型真正走向「持续学习」

2026 年刚开始,大模型领域研究者达成默契,arXiv 论文高频出现 Self-Distillation。传统强教师依赖范式难适配模型持续进化,Self-Distillation 成破局点。MIT 等机构发布三项研究成果,均用信息差实现模型自驱动升级。

AINLPer
产品应用8

美团龙猫LongCat技术升级!新注意力机制解码速度快10倍,还能处理1M超长文本

美团龙猫LongCat系列发布全新稀疏注意力机制LoZA,重点解决长文本任务难题。它在MLA机制基础改造,计算复杂度降至线性,处理128K上下文解码快10倍,性能不缩水,后续还计划支持动态稀疏比例。

量子位
开源动态7

DeepSeek悄悄开源LPLB:用线性规划解决MoE负载不均

昨天,DeepSeek 在 GitHub 上线新代码库 LPLB 解决 MoE 负载不均。它利用线性规划算法优化专家并行工作负载分配,能处理动态波动,但也存在忽略非线性成本等局限,对 MoE 架构训练加速有参考价值。

机器之心
新闻资讯8

Ilya交卷!黄仁勋砸50亿押注SSI,首个模型疑本周发布

Ilya Sutskever创立的SSI或本周发布首个重磅模型,引发圈内关注。英伟达砸50亿美元合作,提升其算力。该模型基于测试时训练架构,能边学边进化,或终结大模型“预训练时代”。

新智元
开源动态8

LeRobot v0.5.0 正式发布

LeRobot v0.5.0正式发布,是规模最大的一次发布。在硬件上支持更多机器人,策略模型新增6种,数据集处理优化,还推出EnvHub,代码库也全面升级,此外社区与生态建设也有进展。

Hugging Face
推荐文章8

Karpathy:LLM渴望的不是生存,而是你的点赞

Andrej Karpathy指出人们对‘智能’理解肤浅,动物智能与LLM智能源于不同优化压力。动物智能源于自然选择,而LLM智能来自统计模拟、强化学习微调等,两者在多层面有差异,LLM受商业进化影响大。

AI寒武纪
产品应用7

从0到1:天猫AI测试用例生成的实践与突破

本文阐述天猫技术团队在AI赋能测试领域的实践,讲述智能测试用例生成落地路径。介绍业界现状与天猫业务特性,给出实施策略,展示应用效果,还指出问题并对未来发展做了展望。

阿里云开发者
产品应用7

比Vibe Coding强100倍!字节 Trae 2.0 携“上下文工程”登场:一句话,从需求干到上线!

字节跳动的AI编程助手Trae发布2.0版本,新增SOLO模式,支持端到端开发流程。上下文工程热度攀升,能解决AI代码落地问题。Trae迭代快,从基础问答进化为智能体系统。

AI前线