依赖项优化」共找到 1813 篇相关文章

算法论文8

合成数据>人工数据,绝对性能暴涨超10个点!仅需任务定义,高效微调大模型

为解决基础模型在专业领域表现不佳、依赖人工标注数据的难题,北大、MIT等机构提出「合成数据强化学习」框架。该框架仅需任务定义,能生成合成数据微调模型,在多领域基准上性能提升显著,代码已开源。

新智元
开源动态8

MiniMax-M1:全球首个开源超长上下文大模型,超越DeepSeek-R1,推理成本仅1/4

MiniMax-M1是全球首个开源超长上下文大模型,刷新三记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。

深度学习自然语言处理
算法论文8

无需标注和奖励模型!仅靠自信度RL,16个样本训练20步,效果飙升21%!

论文提出RLSC,让大语言模型用自身答案置信度作奖励信号,摆脱人类标注依赖。它以模型自信度内部信号替代多数投票外部信号,小成本提升模型数学能力,还让模型学会快推理,不过也存在安全隐忧。

深度学习自然语言处理
8

半年4轮融资、总额5亿元!西湖大学教授押注具身智能「GPT时刻」

具身智能通用大脑公司西湖机器人半年完成4轮融资,总额5亿。其由顶尖团队创立,有先发技术优势,落地两首创底层技术架构,打通技术链路,已拿下近亿元订单,将推动具身智能GPT时刻到来。

机器之心
算法论文8

一个场景吃掉700MB显存!3DGS存储焦虑怎么解?这篇综述划了五个方向

过去三年,3D Gaussian Splatting(3DGS)成实时3D场景重建与新视角合成“默认答案”,但场景拓展后有显存、带宽和功耗限制。香港科大等联合发布综述,从底层数据流组织技术版图,给出优化建议和未来方向。

量子位
新闻资讯8

OpenAI曝出第一颗芯片叫「辣椒」!AI自己设计,9个月流片

OpenAI首颗自研芯片Jalapeño问世,9个月从白纸到流片,创行业最快纪录。该芯片专为大模型推理设计,由其AI参与设计优化,有望降低推理成本,提升用户体验。OpenAI欲做全栈AI公司。

新智元
新闻资讯7

伏曦量子完成天使及天使+轮融资,五源资本、启盈同创等跟投

近日,伏曦量子宣布完成天使及天使+轮融资,由全球动力电池行业龙头领投,多家机构跟投。该公司由赵琦博士创立,定位是帮助产业客户理解和使用量子算力,其核心价值是优化算法,让问题可在近期硬件测试。

DeepTech深科技
新闻资讯8

刚刚,Fable-5之下,智谱开源的GLM-5.2拿下AI编程第一!

智谱开源的GLM - 5.2在AI编程领域成绩斐然,在Arena获全球第二、Design Arena全球第一,八基准测试表现亮眼。经多方面实测,它在长程任务中优势明显,标志国产开源模型进入开发者工作流和硬核工程阶段。

量子位
开源动态8

读完这篇,你就搞懂 DeepSeek v4 了

2026年4月24日,DeepSeek全新系列模型DeepSeek - V4预览版上线并开源,评分接近‘闭源三巨头’。该模型强在1.6T参数+1M上下文,还有从attention到kernel的系统级重构与优化,在架构和工程层面均有创新。

腾讯技术工程
推荐文章7

任务自适应 Harness:从 Trace 到多 Coding Agent 的协作记忆

作者为AI Coding准备的端到端方案未落地,后在Routa目找到新落点。基于ACP协议的Agent Trace可记录关键行为,用于分析优化。还介绍了Feature Explorer、Kanban Harness及任务自适应Harness,探讨多Agent协作记忆。

phodal