探索与利用」共找到 7130 篇相关文章

产品应用7

这家意大利公司想让机械臂飞上太空,在轨道上打印航天器

Caracol是意大利工业级增材制造公司,以机器人手臂为支撑,配合自研挤出头软件生产工业部件。其产品能大幅缩短生产周期、降低成本,2025年融资、收购、扩产,还参太空项目,探索具身智能。

DeepTech深科技
新闻资讯7

The Batch: 844 | AI 天气预测加速推进

美国国家飓风中心 Google 的 Weather Lab 合作,利用新模型预测风暴。该模型能比传统方法更准确预测风暴形成、路径和强度,最长提前 15 天,测试表现优于 Google 之前的 GenCast 模型和 ENS 模型。

DeeplearningAI
新闻资讯7

世界模型的GPT时刻:距离物理AGI出圈,还有多远?

InfoQ《极客有约》X AICon 直播栏目探讨物理 AI 下一个战场。嘉宾认为世界模型未出圈,生成加重建是折中探索。还讨论了其定义、升温原因、数据结构、技术范式、评测标准等,也提及挑战未来格局。

AI前线
算法论文8

阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning

阿里清华研究发现,训练大语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。

深度学习自然语言处理
算法论文8

训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD

清华大学THU-IDM团队慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,预测难度,开销低、动态适应且平衡探索利用,在多任务表现佳,降本增效,有新范式。

量子位
算法论文8

最大的开源GraphRag:知识图谱完全自主构建|港科大&华为

香港科技大学KnowComp实验室香港华为理论部提出AutoSchemaKG框架,可自主构建知识图谱,无需预定义模式。该系统利用大模型提取知识三元组并归纳模式,构建了ATLAS系列知识图谱,经测试表现优异。

量子位
算法论文8

Meta超级智能实验室又发论文,模型混一混,性能直接SOTA

大语言模型训练依赖算力和时间,传统模型 Souping 多采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果稳健性,在排行榜获 SOTA 成绩。

机器之心
推荐文章8

刚刚,Cursor又分享了数百Agent并发协作的最佳实践

Cursor分享数百Agent并发协作最佳实践,讲述单个Agent局限,介绍从多方面探索协同方法,如规划者执行者分工,还展示多个实验成果,总结模型选择等经验,指出多智能体协同仍待优化。

PaperAgent
算法论文8

自搜索强化学习SSRL:Agentic RL的Sim2Real时刻

本文由多机构联合完成,引入自搜索强化学习SSRL。它利用结构化prompt和format reward提取模型world knowledge,降低幻觉。还探索Sim2Real有效性,验证SSRL训练模型在真实场景泛化性,且所有训练数据等已开源。

机器之心
新闻资讯7

首钢园具身智能持续进化!他山科技携手图灵奖顶尖学者激活数字科创“触觉引擎”

当具身智能成下一代AI核心战场,他山科技签约图灵奖得主理查德·萨顿教授,通过“机器人幼儿园”模式探索进化路径。其自主研发触觉感知技术,萨顿强化学习理念结合,为具身智能发展提供新思路。

首钢园