成本性能」共找到 6933 篇相关文章

新闻资讯7

Karpathy:大模型交互的第三种范式来了?这是不是夸大其词

Anthropic 上线 Claude Tag,可让团队在 Slack 与 Claude 协作,写 PR、数据分析等任务,有多人协作、积累上下文等特点。Karpathy 认为这是大模型 UI 第三次大改,但评论区有质疑,不过有大咖背书或‘数字员工’。

AI工程化
算法论文8

超越RAG和DAPT!华人团队新研究引热议:即插即用、无需改变原参即可让模型化身领域专家

华人团队提出比DAPT和RAG更方便、本更低的方法,即“Memory Decoder”预训练记忆模块。它像“领域知识插件”,即插即用、不改原参,让Qwen、Llama等模型领域专家,还降低困惑度。

量子位
新闻资讯7

MiniMax 技术闭门会分享:长上下文是 Agent 的 Game Changer

MiniMax 7月10日举办M1技术研讨会,探讨模型架构创新等领域。会议围绕RL否赋予模型新力、预训练价值等展开,指出长上下文是Agent的Game changer,混合架构将主流,还分享了混合架构推理实践及M1相关问答。

Founder Park
开源动态8

英伟达开源深度研究引擎:企业级数据不出门,研究自动做

NVIDIA推出AI-Q Blueprint,将深度研究流水线打包Agent Skill,解决企业级数据处理难题。它让企业数据不出门,代理框架可派任务并获报告,还支持多种认证模式,代码库可本地部署,专为深度研究打磨。

AIGC开放社区
开源动态8

工业级 LLM 数据工程:北京大学 DCAI 团队 DataFlow 框架的架构设计与实践

2026 年大模型研发从‘模型中心’向‘数据中心’演进,数据语义密度与工程精度突破关键。北京大学 DCAI 团队推出 DataFlow 框架,解决数据准备难题,其技术报告登顶 Hugging Face。该框架有多种特性,实验验证其提升模型性

InfoQ
算法论文8

其实,扩散语言模型在最终解码之前很久,就已确定最终答案

随着扩散语言模型(DLM)发展,它自回归(AR)模型有力替代。但实际推理慢于 AR 模型。研究者发现早期答案收敛现象,提出 Prophet 策略,实验显示其在保持高质量生时显著加速推理。

机器之心
开源动态8

KTransformers入选计算机系统顶会、与主流框架合作,趋境&清华让「异构」为推理新范式

KTransformers由趋境科技与清华团队联合研发,是高性异构推理框架。其论文入选SOSP 2025,还与SGLang合作。它有算子优化等创新,让CPU与GPU协同,推动推理架构融合,已广泛复用的底层框架。

量子位
新闻资讯7

生物制造的"ChatGPT时刻"到了吗?|5Y Talk

2026年油价飙涨,凸显石油化工对生活的影响,生物制造或替代方案,AI正加速其进程。恩和科技创始人Cheryl与五源资本合伙人Ted对话,探讨SAION AI平台特性、行业竞争格局、核心技术及未来发展等问题。

五源资本 5Y Capital
新闻资讯8

腾讯AI战略大升级:组织架构重组与混元世界模型1.5发布

2025年12月17日,腾讯宣布两项重大举措,一是重组AI组织架构,立新部门并任命首席AI科学家;二是发布混元世界模型1.5,实时生可交互3D虚拟世界,应用场景广泛,或引领行业进入‘AI原生’新阶段。

MCP Lab
新闻资讯7

刚得诺奖的果被做芯片了

莫纳什大学科学家用刚获诺奖认可的MOF制造超迷你流体芯片。此芯片不同于传统芯片,记住电压变化形类似大脑神经元的短期记忆,或新一代计算机范例。此前MOF被认为‘无用’,如今证明或只是未找到适用场景。

量子位