8B大模型」共找到 8163 篇相关文章

新闻资讯7

拉响紧急警报后,奥特曼再遭暗讽:孤注一掷,或将死无全尸!

在纽约曼哈顿的峰会上,Anthropic的CEO Amodei预言AI将使50%初级白领岗位被取代,提出「企业 - 政府 - 社会」应对模型。他警告行业风险,暗讽OpenAI和奥特曼,还表示Anthropic走B端差异化路线。

新智元
新闻资讯7

奥特曼急了!OpenAI稳坐三年的王座,刚刚被Anthropic踹下去了

2026年5月Ramp数据显示,Anthropic企业市占率34.4%首超OpenAI的32.3%。Anthropic靠按量计费和AI Agent吸金,但也面临利益错配、体验下滑、成本上涨等问题,大模型竞争进入B端深水区。

新智元
产品应用8

微软深夜发布SambaY架构,Phi-4min加速10倍推理

微软基于Phi-4-mini版本,针对特定推理任务微调出Phi-4-mini-Flash-Reasoning 3B模型,将其扩展到200064 tokens。采用新型SambaY架构,支持64K token上下文长度,运行快10倍,有诸多优点。

PaperAgent
算法论文8

罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!

Meta、OpenAI、xAI联合发表成果CharacterFlywheel,聚焦在生产环境提升社交型AI对话能力。团队基于LLaMA 3.1迭代15个版本,7/8的A/B测试显示正向提升,介绍了架构、数据管道、奖励模型等内容。

PaperAgent
新闻资讯8

国产具身智能创全球新纪录!以30%成本跑赢 Figure AI 45%效率,聪明的具身大脑成关键

自变量机器人在「夹爪方案挑战1248件/小时物流分拣」直播中,以双机械臂+夹爪方案,成本降70%,分拣效率提超45%,准确率达98%。其依托WALL - B模型,展现出强大泛化能力,探索出具身智能新路径。

量子位
算法论文8

无需训练,直接「算出」最强AI!理想汽车发现端侧Scaling Law

理想汽车基座模型MindVLA团队与国创决策智能技术研究所联合发布论文,提出面向端侧大语言模型的「硬件协同设计扩展定律」,解决大模型部署在端侧设备的难题,实现软硬协同设计,提升模型性能和研发效率。

新智元
开源动态8

首个开源实现100%可复现的稳定RL训练框架来了!2次结果完全重合

SGLang团队联合slime团队开源实现100%可复现的稳定RL训练框架。基于Qwen3 - 8B重复实验结果完美重合。SGLang在批次不变算子基础上实现确定性推理,性能有下降但有提升空间,还给出使用方法和未来规划。

量子位
开源动态8

伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开

开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。

新智元
开源动态8

DeepSeek-V3.1震撼发布,全球开源编程登顶!R1/V3首度合体,训练量暴增10倍

DeepSeek正式上线DeepSeek-V3.1,作为首款「混合推理」模型,将开启智能体新时代。它参数共671B,具强大智能体能力,编程击败Claude 4,训练量大幅扩增,在多方面测试表现出色,稳坐编程开源第一王座。

新智元
算法论文7

无需外部数据!AI自问自答实现推理能力进化

卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。

量子位