多领域推理」共找到 6403 篇相关文章

算法论文8

英伟达笑到最后!训练2000步,1.5B逆袭7B巨兽,Scaling真来了

英伟达团队提出ProRL训练法,将强化学习扩展到超2000步。用此方法训练的15亿参数模型媲美70亿参数的Deepseek - R1 - 7B,在任务中表现出色,解决了熵崩溃和训练不稳定问题。

新智元
开源动态8

PaddleOCR3.0全面开源!文档解析PP-StructureV3:PDF秒变高质量结构化文件!

在大模型与RAG技术发展下,结构化数据愈发重要。飞桨团队打造PP - StructureV3并随PaddleOCR3.0全面开源,它能将文档精准转为结构化文件,有精度高、能力等优势,还介绍了使用方式。

开源星探
推荐文章8

从数据到决策:AI 驱动的 Quick BI 架构设计与实践

阿里云智能集团瓴羊高级技术专家王璟尧,介绍阿里云 Quick BI 从传统 BI 到 AI 驱动的智能 BI 的进化,解析领域大模型与 BI 引擎协同设计等技术权衡,为行业提供可复用技术范式。

InfoQ
开源动态8

SGLang支持GPT-OSS:从Day 0支持到性能增强

SGLang宣布重大更新,聚焦openai/gpt - oss - 120b模型深度性能优化与新功能。预填充和解码阶段吞吐量显著提升,支持GPU,有推测解码等功能,还支持智能体应用程序,且不损害模型推理能力。

GiantPandaLLM
算法论文8

从繁杂技巧到极简方案:ROLL团队带来RL4LLM新实践

当前RL4LLM领域发展快但存在标准、结论不一及机制解释不足等问题。阿里巴巴淘天集团和爱橙科技联合高校基于ROLL框架研究,评估关键技术组件,提出简化算法Lite PPO,在基准上表现佳。

机器之心
新闻资讯8

大模型七连发,外国人馋透了!阿里云栖大会全栈升级够狠

阿里在2025云栖大会全栈升级,发布七款通义新模型,从基础大模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,模型开源且表现出色。

机器之心
推荐文章7

将思维链(CoT)引入具身世界,哪种路径能真正打通机器人「知行合一」?

文章围绕将思维链(CoT)引入具身智能领域展开。介绍CoT从语言层面到成为机器人行为核心认知机制的转变,分析分层架构与端到端模型两种技术路径,还阐述自变量机器人统一架构的优势和能力。

AI科技评论
开源动态9

刚刚,Kimi K3开源!3万亿模型权重全球开放

2026年7月27日,Moonshot AI开源全球首个3万亿参数级模型Kimi K3。它不仅参数量大,还在领域表现出色,能与顶尖闭源模型媲美。其架构创新、训练独特、推理成本低,有望改变全球大模型格局。

新智元
开源动态8

全模态RAG突破文本局限,港大构建跨模态一体化系统

香港大学黄超教授团队开源模态智能处理系统RAG - Anything,突破传统RAG技术单一文本局限,整合模态文档解析等核心能力,解决现有RAG系统痛点,具备方面技术亮点,有便捷部署方式和场景应用模式。

量子位
算法论文8

新范式来了!新能量模型打破Transformer++扩展上限,训练扩展率快35%

研究训练新能量模型 EBT,为输入和预测分配能量值,模拟思考过程。它有跨模态、跨任务通用性,训练扩展率比 Transformer++ 高 35%,推理性能提升 29%,还在任务中表现出色,是扩展模型能力新范式。

机器之心