学习型集成」共找到 1945 篇相关文章

新闻资讯7

Base44 现在每天增 40 万美金 ARR,华人团队做了一个 AI 学习相机很有意思

被 Wix 收购的 AI Coding 产品 Base44 发展迅猛,每天新增约 40 万美金 ARR。同时,行业对 AI Coding 产品利润存质疑,a16z 反驳后又遭 Cline 批判。此外,还提到华人团队做的 AI 学习相机有创新点。

投资实习所
算法论文8

一个省略号提示+强化学习搞定大模“过度思考”,中科院自动化所新方法:从强制推理到自主选择

中国科学院自动化研究所联合鹏城实验室提出AutoThink方法,用省略号提示和多阶段强化学习,让推理大模依题目难度自主切换思考模式,解决过度思考问题,在多数据集验证有效。

量子位
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁大模探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模性能,展现强大泛化能力。

量子位
算法论文8

斯坦福英伟达推出测试时强化学习:微调开源模胜过顶级闭源模,仅需几百美元

斯坦福、英伟达等提出TTT - Discover方法,基于开源模gpt - oss - 120b,在测试阶段引入强化学习更新模权重。它采用熵目标函数和PUCT启发机制,解决分布外问题,成本低且表现优,但目前适用于连续奖励场景。

量子位
算法论文8

“神经-符号”融合规划器性能显著超越o1:借鉴人类运动学习机制|中国科学院磐石研发团队

中国科学院磐石研发团队提出新“神经 - 符号”融合规划器,融合神经与符号规划系统优势,借鉴人类运动学习机制构建双向规划机制,在规划覆盖率和效率上显著超越OpenAI o1,已加入“磐石·科学基础大模”。

量子位
开源动态7

强化学习+MCP=王炸?开源框架教AI在MCP中玩转工具解决任务,实测效果超越GPT!

科技公司OpenPipe提出全新开源强化学习框架MCP·RL,只需一个MCP Server地址,agent就能自动发现工具、生成任务,在闭环反馈中摸索出最优调用策略,实测在2/3的benchmark上达或超SOTA性能。

量子位
算法论文8

我在哪?要去哪?要怎么去?字节跳动提出Astra双模架构助力机器人自由导航

当今机器人导航系统在复杂室内环境面临挑战,字节跳动研发创新双模架构Astra,含Astra - Global与Astra - Local子模。经实验验证其性能佳,未来有广阔应用前景,但也存在需改进之处。

机器之心
算法论文8

揭秘LLM“思考”之谜:推理即“梯度下降”,元学习框架解构训练过程,还给优化提供新思路

上海AI Lab团队提出RaML框架,从梯度下降和元学习角度揭示LLM“思考”机制。通过实证验证推理轨迹作为参数更新的合理性,还对比不同训练策略,指出RaML为优化LLM性能提供新思路。

量子位
算法论文8

通义团队提出环境Scaling:自动构建环境,并自主学习和成长,可让30B比肩1T效果

阿里巴巴通义实验室团队论文提出通过程序化、自动化构建模拟环境,让语言模自主交互学习。基于此训练的AgentScaler模,数十亿参数就达万亿级模性能,为轻量级代理智能发展带来新可能。

深度学习自然语言处理
产品应用7

Ollama 推出免费搜索API + MCP集成:Cline、Codex一键接入网络搜索( + Qwen 搭建迷你搜索代理 )

Ollama推出免费Web搜索API,个人使用免费,本地和云端模均可调用,还出了MCP服务器。它能让开源模执行长期研究任务,还介绍了用其与Qwen搭建迷你搜索代理及MCP集成的方法。

AI进修生