DeepSeek 671B」共找到 1380 篇相关文章

算法论文8

Learning from peers!让LRM互相「传纸条」的新协作方式大幅提高准确率和效率

当前主流大模型如QwQ - 32B存在“前缀主导陷阱”,推理开头出错会使准确率暴跌。研究者受“同伴互助”启发提出LeaP框架,设计三种路由策略,实验显示小模型能借此超越大模型,开创了多种可能性。

深度学习自然语言处理
新闻资讯7

王田苗三问具身大牛:大模型还在「拨号上网」,机器人靠什么拿下真实订单?| WRC 2026

在2026世界机器人大会的圆桌论坛上,王田苗向具身智能头部企业CXO抛出尖锐问题。嘉宾围绕量产卡点、大模型应对物理世界不确定性及产业终局生态展开讨论,并就商业化落地节奏达成共识。

AI科技评论
新闻资讯7

5Y News | AI-native投资管理公司GIM完成数千万美元A轮融资

近日,AI-native智能投资管理公司GIM完成A轮数千万美元融资,由弘毅投资旗下金涌投资和B Capital联合领投。公司沿着垂域大模型和自进化智能体系统两条主线建设资管基础设施,已进入实战阶段。

五源资本 5Y Capital
新闻资讯7

AI四小龙,估值破万亿

中国AI四小龙估值破万亿,DeepSeek、智谱、MiniMax、月之暗面各有不同定价逻辑。它们估值暴涨受技术、港股窗口、国家大基金入场等因素影响。当下,它们面临算力和场景问题,未来发展各有挑战。

芯师爷
新闻资讯8

浪潮发电,海水制冷:新一代AI算力中心在海上诞生

2026 年美国初创公司 Panthalassa 获 1.4 亿美元 B 轮融资,计划将 AI 算力搬到海上,用海浪发电、海水冷却。陆地算力困境下,创业者将目光投向深海与外太空,Panthalassa 与 Starcloud 分别代表海洋与太空路径。

DeepTech深科技
新闻资讯7

OpenAI 关键九问:2026 AI 战局升级后迎来叙事反转

文章围绕OpenAI提出九个关键问题并给出判断。虽受Gemini影响,面临竞争,但作者对其2026年叙事反转有信心,还分析了用户增长、业务布局、技术突破等方面情况。

海外独角兽
开源动态8

刚刚,百度最新开源神作:PaddleOCR-VL-1.5上线了

1月29日百度开源新一代文档解析模型PaddleOCR-VL-1.5,参数仅0.9B,在OmniDocBench V1.5评测中综合性能全球第一,精度达94.5%。它支持异形框定位,解决真实文档解析难题,在多场景表现出色。

MacTalk
新闻资讯7

对话范浩强:10亿融资之前,我们手搓了5000元“丐版硬件”

原力灵机是具身智能新秀,9个月连融3轮获阿里数亿投资。其创始团队多出自旷视,从To B工业场景切入物流行业。公司发布开源三件套,还将开源基座模型,强调创业要穿越周期,谨慎慢跑。

量子位
算法论文7

又一推理新范式:将LLM自身视作「改进操作符」,突破长思维链极限

Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在数学任务中提升准确率,还训练8B模型让推理方法更适配,减少训练与部署的不匹配。

机器之心
产品应用8

文心X1.1三大能力狂飙,海内外实测还挺惊艳!

9日WAVE SUMMIT深度学习开发者2025大会上,文心大模型X1.1发布,事实性、指令遵循、智能体能力显著提升,多项测试表现佳。它能做到知识一致,精准遵循指令,智能体解决问题出色,代码、数学、多模态能力也有进化,得益于迭代式混合强化学习训练框架。

新智元