设计团队」共找到 4444 篇相关文章

产品应用8

DeepSeek-V3.2-Exp:用稀疏注意力打破长文本效率瓶颈

在NLP领域,处理长文本时传统注意力机制效率低。DeepSeek团队推出DeepSeek-V3.2-Exp模型,引入稀疏注意力机制,在保持性能同时提高长文本处理效率,降低计算复杂度,在多基准测试中表现良好。

CourseAI
产品应用7

快手提出强化学习创新框架RLEP,突破大模型推理瓶颈

OpenAI等模型用强化学习提升推理能力,但面临训练不稳定等挑战。快手Klear团队提出RLEP框架,引入经验回放技术,分经验收集和回放训练两阶段,还采用优化策略,提升大模型训练效率和性能。

AIGC开放社区
开源动态8

字节Seed新方法!开源8B代码模型:自己筛数据训练自己,同量级SoTA,还能超越百亿级对手

传统code大模型依赖人工筛选数据,成本高、效率低。而Seed - Coder团队让LLM自己筛选数据训练自己,打造8B参数轻量级开源代码模型,性能超百亿级对手,不过也存在通用和数学能力短板。

深度学习自然语言处理
新闻资讯7

人才黑洞!UC伯克利系主任都加入A社了

UC伯克利EECS系主任Jelani Nelson暂离大学,加盟Anthropic预训练团队。他算法课播放量超2100万,研究聚焦大规模数据高效处理,这正是A社所需,此前他还在谷歌兼职。

量子位
算法论文8

TRM思考奖励模型上线,大模型推理质量终于能量化了 | ICML‘26 Oral

大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。

量子位
算法论文8

刚刚,Gemini攻克「宇宙弦」终极难题!AI科学家最优雅解法震撼物理学

Google Research团队用Gemini Deep Think + 树搜索框架,攻克理论物理领域宇宙弦引力辐射功率谱精确解析解难题。AI探索600条候选路径,找出6种解法,最优雅的格根鲍尔方法让物理学家拍案叫绝。

新智元
产品应用8

告别碎片化日志:一套方案采集所有主流 AI 编程工具

在AI编程工具普及的当下,有效采集和分析AI代码生成数据成重要课题。该文介绍一套基于MCP架构的多AI工具代码采集方案,支持多种工具和操作系统,有轻量化、用户无感等特点,已和Aone合作。

阿里云开发者
推荐文章7

我的AI OS搭建思路

作者黄益贺分享AI OS搭建思路。其系统以Claude Code为框架、Kimi K2 Thinking为模型,通过Skill和自定义命令满足工作需求,设计三层文件夹体系处理信息,供大家参考搭建。

newtype AI
算法论文8

Adobe 新研究:不用再「喂」训练数据,VLM 靠和自己玩游戏变聪明

Adobe 等机构研究人员提出「Vision-Zero」,借鉴 AlphaGo 自迭代方式,设计让 VLM 自我学习框架。此框架以类似「谁是卧底」游戏训练,不依赖标注数据,在多任务超越有标注的 SOTA 方法。

Founder Park
算法论文8

比思维链准43%!逻辑脑+大模型直觉,推理可靠性大幅提升

中德研究团队发布成果,给大模型外挂「逻辑脑」,结合答案集编程与LLM,构建神经 - 符号框架,提升空间推理准确率,让AI能说清逻辑、跨任务迁移,迈向更可靠的通用推理。

新智元