双层效率优化框架」共找到 2277 篇相关文章

开源动态8

Kimi K2官方技术报告出炉:采用384个专家,训练不靠刷题靠“用自己的话再讲一遍”

Kimi K2官方技术报告公开称霸全球开源模型的秘籍,介绍其训练过程及“秘密配方”,包括MuonClip优化器、大规模Agentic Tool Use数据合成等技术亮点,还提及后阿里通义Qwen3更新击败Kimi K2。

量子位
开源动态8

7B模型“情商”比肩GPT-4o,腾讯突破开放域RL难题,得分直翻5倍

腾讯混元AI数字人团队提出RLVER框架,解决开放域RL在真实交互中的‘情商’优化困境。经其训练的Qwen2.5 - 7B模型在情感对话基准得分跃升,比肩顶级商用模型,团队还有诸多启发性发现。

量子位
产品应用7

马斯克Grok这个二次元「小姐姐」,攻陷了整个互联网

今天凌晨马斯克通知更新Grok APP,推出基于Grok 4大模型的「智能伴侣」功能,付费用户可优先用新「数字伴侣」头像。此外Grok还在游戏领域出击,开发者用提示词就能生成可玩游戏,效率大增。

机器之心
推荐文章7

当你感到AI编程无所不能时,也许正站在“愚昧之巅”——理性看待AI时代的软件开发与应用变革

文章分析AI时代软件开发、产品设计和内容营销的变化。赞同产品设计半开放式、加速MVP效率等;部分赞同VOC捕捉、SEO自动化等,但有待验证;不认同普通开发者被淘汰等过于乐观的预测。指出多数变化5年渐显。

宝玉AI
开源动态8

AI秒懂短视频,快手大模型Keye-VL理解力爆表!技术细节全开源

快手全新多模态大语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。

新智元
新闻资讯8

港科广等发布首个医学世界模型!精准模拟肿瘤演化,规划治疗方案

医学世界模型(MeWM)是创新AI系统,能模拟疾病演变、预测肿瘤变化,助医生术前评估治疗效果、优化方案。港科广等团队提出该模型,有肿瘤演变模拟等三核心贡献,在多方面实验表现佳。

新智元
开源动态8

DeepEval:LLM 应用评测不再玄学,让大模型评测像写单元测试一样简单

在大模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。

AI工程化
算法论文8

Tool-Star:赋予大模型结合多工具推理的能力

文章提出Tool - Star框架,旨在解决大模型多工具协作推理难题。它从数据端到训练流程优化,让模型调用多种工具,在复杂计算和知识型推理任务表现卓越,还探讨了未来多模态及多工具扩展方向。

PaperAgent
算法论文7

AI仅凭“自信”学会推理,浙大校友复刻DeepSeek长思维链涌现,强化学习无需外部奖励信号

UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能学会复杂推理。该方法无需外部奖励信号或标注数据,用模型自身置信程度作内在奖励信号,在多任务表现良好。

量子位
算法论文8

Qwen团队发布长上下文Reasoning模型QwenLong-L1,超越o3-mini

Qwen团队发布长上下文Reasoning模型QwenLong - L1。当前大模型处理长文本有训练效率低、过程不稳定难题。QwenLong - L1用分阶段强化学习等方法,实验中超越o3 - mini、比肩Claude,还在案例表现出色。

深度学习自然语言处理