后训练阶段」共找到 4158 篇相关文章

算法论文8

RAG外部检索是多余的,英伟达最新成果颠覆认知

英伟达INTRA论文指出RAG架构中检索器和生成器在不同表示空间工作,存在retriever - generator mismatch问题。INTRA让模型用注意力查询检索自身编码表示,训练量小,在多跳QA上超越多种检索基线。

PaperAgent
算法论文8

王兴兴署名,宇树机器人春晚之又进化了:单个策略就能学习各种极限动作

春晚上,宇树机器人展现高动态、高协同的全自主集群控制技术。现在,多机构提出 OmniXtreme 通用策略,可执行各种极限动作。该框架分两阶段,经测试在仿真和现实中表现出色,打破了泛化壁垒。

机器之心
新闻资讯7

利用Loop语言模型扩展隐式推理 | 直播预约

当前大语言模型依赖显式文本生成推理,未充分利用预训练数据。将介绍最新工作Ouro,Loop语言模型家族,核心创新多,虽参数少却性能优,还会讨论其推理轨迹及模型Scaling新可能。

深度学习自然语言处理
新闻资讯7

arXiv禁用AI,糊涂!18所高校联合发布首个AI科研评审平台

arXiv因AI生成论文泛滥,禁止接收未经同行评审的综述和立场论文。而18所高校联合发布的aiXiv平台,支持AI和人类共创科研成果,采用多阶段AI同行评审机制,引发对传统学术体系的反思。

新智元
算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在多基准测试表现出色。

机器之心
产品应用8

5小时通关《原神》主线!Lumine:AI玩家正式登场

Lumine能像人类一样理解游戏画面、推理并操作,以接近人类效率5小时通关《原神》蒙德主线,还能零训练玩《鸣潮》等。它是开放式研发方案,靠少量数据和显卡让模型成强大智能体。

带你学AI
算法论文8

无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」

清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率与通用性痛点。

机器之心
新闻资讯7

向英伟达发起挑战的 AI 芯片初创公司,估值快五百亿了!

人工智能芯片初创企业 Groq 完成 7.5 亿美元融资,投估值 69 亿美元。它试图打破英伟达垄断,产品是专用芯片,面向开发者与企业,成本低于竞品,创始人技术背景深厚,服务开发者数量增长快。

InfoQ
开源动态8

开源Agent新标杆:通义WebSailor多榜夺魁,挑战OpenAI高难度Agent基准BrowseComp

信息爆炸时代,传统搜索引擎难满足需求,开源Web Agent在极端复杂任务表现不佳。阿里巴巴通义实验室推出WebSailor,通过创新数据构造和训练方法,在BrowseComp等挑战上取得突破,缩小与顶级封闭系统差距。

机器之心
推荐文章7

我用了13年,与SEO前辈们出现在一起。白杨SEO从网站优化到AI搜索优化经历分享,百度SEO不放弃!

白杨SEO分享从网站优化到AI搜索优化经历,讲述入行缘由、职场项目,介绍自由职业业务,分析百度SEO阶段与变化,建议别放弃,还给出对SEO未来看法,如回归国外、做新媒体SEO等。

白杨SEO优化教程