动态无偏学习框架」共找到 2992 篇相关文章

算法论文8

上海人工智能实验室让AI像科学家一样在探索中发明工具

上海人工智能实验室等团队提出推理时工具演化(TTE)框架,推动AI在科学领域从被动选工具到主动发明工具。它解决传统工具库问题,提升多学科推理准确率,赋予AI跨学科迁移能力。

AIGC开放社区
开源动态8

斯坦福开源复杂推理AI Agent,融合超10种工具

传统AI助手应对复杂任务能力有限,斯坦福开源OctoTools,这一复杂推理AI Agent融合11种工具。它在16项基准测试中准确率高,能应对多领域复杂场景,框架含工具卡片、规划器等构件。

AIGC开放社区
推荐文章8

《DeepSeek掘金》背后的故事——从行业寒冬到AI春潮,用腾讯IMA知识库重构价值

本文讲述《DeepSeek掘金》成书背后的故事。从行业寒冬到AI春潮,编委们因DeepSeek迎来职业转机。面对出版市场乱象,用腾讯IMA知识库完成创作,还打造四位一体学习方案,致敬梁文锋与DeepSeek理想主义。

AIGC开放社区
8

鹅厂实习生血泪贴:Agent/RAG黑科技,真相竟是这样!

腾讯实习生分享鹅厂项目实战经验,介绍Agent/RAG黑科技。先讲RAG原理、优化方法及评估流程,还提及文档解析;再阐述智能体定义、历史、原理、分类、评估框架与实践案例,助读者快速入门。

腾讯技术工程
算法论文8

无需SFT也不用RL,样本级推理优化神器SLOT来了,准确率轻松+10%

西湖大学MAPLE实验室开发的SLOT方法,无需SFT和RL,让模型推理时“临时学习”具体问题。它简单易实现,计算开销小,能使模型准确率大幅提升,还无需额外资源,在各规模模型上效果显著。

机器之心
开源动态8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5,提供长文本推理后训练“配方”,含数据合成管线、强化学习方法和智能体架构。通过三大“法宝”重塑模型能力,效果显著,相关代码已开源。

AINLPer
开源动态7

最好的 DeepResearch 平替开源了

ROMA是元代理框架,以递归分层结构解决复杂问题,有并行问题解决、透明开发等优势。它通过计划 - 执行循环处理任务,介绍了安装选项、技术栈,还有预构建代理展示功能。

GitHubStore
新闻资讯8

Anthropic 反杀 OpenAI,LLM 企业市场新格局

Menlo Ventures 报告显示,Anthropic 超越 OpenAI 成企业 LLM 市场新王者。代码生成成杀手级应用、强化学习成扩展路径、Agent 时代到来支撑其胜利。企业重性能,支出从训练转向推理。

AI工程化
算法论文8

快慢Reasoning综述!

大型语言模型在复杂推理任务中有‘无差别计算’缺陷,阻碍其在多场景应用。本文提出双层效率优化框架,梳理两类前沿技术,通过实验揭示瓶颈,为轻量化推理指明路径。

深度学习自然语言处理
新闻资讯7

突发!OpenAI新模型Astra吓瘫奥特曼:暂停训练两周,GPT-6训练一并冻结

OpenAI宣布暂停内部最强大模型强化学习,Astra模型暂停训练两周,GPT - 6也暂停。原因包括Hugging Face安全纰漏和Astra网络攻击能力越线。还采取物理隔离、严格监控、打击作弊等措施,或有营销意图。

AI寒武纪