后训练框架」共找到 5002 篇相关文章

开源动态7

R1一周年,DeepSeek Model 1悄然现身

2025年1月20日,DeepSeek发布DeepSeek - R1开启新开源LLM时代,其在Hugging Face获赞最多。一年,DeepSeek新模型Model1在GitHub现身,经Gemini分析或为DeepSeek - V4,还给出相关技术细节。

机器之心
算法论文8

SmartSearch:奖励驱动query精炼,让Agent中的RAG会“改错”

现有LLM搜索Agent忽视‘如何提问’致答案易出错。SmartSearch提出‘过程奖励+查询精炼’双机制,让Agent学会‘写不好就改’,代码已开源。经实验,它在六数据集全面领先,各机制缺一不可。

PaperAgent
新闻资讯8

AI 会取代你的工作吗?Anthropic 用 200 万对话告诉你答案

Anthropic发布Economic Index第四期报告,分析200万次Claude对话,提出“经济原语”框架。发现AI对高学历任务加速效果更好但成功率低,还揭示Claude.ai与API差异,引入“有效AI覆盖率”等。

宝玉AI
新闻资讯7

“心内推理”:一种动态多模态潜在空间推理范式 | 直播预约

当前多模态大模型推理效率低、稳定性不足。本次分享将介绍DMLR,它无需额外训练,仅在推理阶段生效,通过在潜空间优化潜在思考token、引入关键视觉信息,实现高效稳定的多模态推理。

深度学习自然语言处理
新闻资讯7

Mira公司内乱?CTO被开除,带团队回OpenAI,翁荔上推发言

Thinking Machines Lab创始人官宣与CTO Barret Zoph分道扬镳,任命Pytorch之父Soumith Chintala为新CTO。约1小时,OpenAI宣布Barret Zoph等回归。核心成员离开引关注,翁荔还发了意味深长的话。

机器之心
开源动态7

从组件到 OS 的跃迁,MemOS 深度拆解:构建企业级 Agent 的高性能记忆底座【上】

本文深入剖析开源记忆方案MemOS,它将记忆从“外挂组件”升为“系统资源”。介绍其设计理念、核心架构,分析记忆需加工、分层调度和治理的原因,还阐述记忆三态及流转,最展示MemOS Cloud的使用方法。

AI大模型应用实践
开源动态8

英伟达发布并开源Alpamayo:自动驾驶终于开始讲道理了|甲子光年

北京时间今天凌晨,英伟达在CES现场发布Alpamayo系列开源AI模型、仿真工具及数据集,旨在推动推理型自动驾驶汽车开发。其核心模型Alpamayo 1可展示决策逻辑,此次发布是英伟达在该领域开放程度最高的尝试。

甲子光年
开源动态8

告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent

现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。

量子位
新闻资讯8

Ilya重新定义AGI: 为什么ChatGPT离真正的AGI还很远

OpenAI前首席科学家Ilya在访谈中提出对AGI的新定义,还指出AI规模时代结束,未来拼想法和研究深度。他分析模型评测强但经济影响弱的原因,阐述人类价值函数作用,且SSI战略或调整。

花叔
产品应用7

Hexstrike AI在多个工具及模型上的渗透测试表现

文章围绕Hexstrike AI在多个工具及模型上的渗透测试展开。介绍测试环境,用不同难度靶机测试。分析Claude desktop+Sonnet 4.5、AIaW+Deepseek、Cursor+多个模型等组合表现,指出LLM辅助渗透测试任重道远。

AI与安全