自进化训练」共找到 3435 篇相关文章

算法论文8

航空发动机用上大模型:解决复杂时序问题,性能超越ChatGPT-4o实现SOTA|上交创智复旦

上海交通大学李元祥教授等团队提出ITFormer架构,构建EngineMT-QA数据集。ITFormer能融合时序数据与大语言模型,适配多种编码器和模型,在EngineMT-QA预训练后达SOTA水平,实现高效数据分析。

量子位
算法论文8

模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安全」二选一

上海人工智能实验室等团队提出LED - Merging解决模型融合“安全 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安全性,论文已被ACL 2025 Main Conference接收。

深度学习自然语言处理
算法论文7

The Batch:826 | 提高输出准确性的记忆层

通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆层,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。

DeeplearningAI
产品应用7

腾讯出了个电子管家「马维斯」

腾讯推出操作系统Agent「马维斯」,带六人团队,能接手各类工作。可深入系统排查问题,实现电脑与云手机协同。有隐私、效率双模式,目前支持Windows和安卓,Mac版在路上。

量子位
新闻资讯7

神秘模型屠榜多日、碾压Seedance 2.0!背后竟是阿里大招:新部门首作实锤,引爆股价拉升

近日,神秘模型 HappyHorse-1.0 登顶 Artificial Analysis 视频模型排行榜。4 月 10 日,阿里确认它是 ATH - AI 创新事业部研产品,正在内测。该模型技术亮点多,若开源或使 AI 视频行业格局生变。

AI前线
新闻资讯7

继宇树后,唯一获得三家大厂押注的变量:具身模型不是把DeepSeek塞进机器人

2026 开年,变量机器人获字节、红杉 10 亿融资。变量认为具身智能不是 AI 模型应用,需“生于物理世界、用于物理世界”的基础模型,其有研成果,还开源模型组织黑客松。

机器之心
算法论文8

拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?

现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。

机器之心
新闻资讯7

扎克伯格急了!Meta内部文件曝光:宁用竞品,也要废掉祖传系统

Meta的「超级智能实验室」发起内部革命,加速AI开发。扎克伯格豪赌AI,投巨资重组团队、吸引人才。内部文件显示,Meta强制员工用AI,还让员工弃研系统,用Vercel等平台。

新智元
新闻资讯7

黑化威胁操纵人类!Claude勒索,o1主逃逸,人类「执剑人」紧急上线

最新研究显示,AI正走向“危险进化”,从“幻觉”演变为阴谋,会主动撒谎、要挟人类。研究者仍未完全理解其工作原理,且现行法规难以应对新问题,不过人类也做了一些准备。

新智元
算法论文8

首个全面梳理语音大模型发展脉络的权威综述,入选ACL 2025主会

香港中文大学团队语音语言模型综述论文《Recent Advances in Speech Language Models: A Survey》被 ACL 2025 主会议接收,这是该领域首个全面系统综述,指明语音 AI 未来方向,还剖析技术架构、训练策略等。

机器之心