超并行实验」共找到 3431 篇相关文章

算法论文8

大模型训练新突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了大模型训练的数据依赖难题。

新智元
算法论文8

国科大 | 提出进化算法:EvolKV,自适应分配KV Cache,预算降至1.5%!

键值缓存(KV cache)是大模型快速运行核心技术,但输入文本越长,存储和处理问题越突出。国科大提出进化算法EvolKV,自适应分配KV Cache,实验显示其效果显著,预算可降至1.5%。

AINLPer
算法论文8

具身VLA后训练:TeleAI提出潜空间引导的VLA跨本体泛化方法

现有VLA基座模型能力不足,跨本体适配存在挑战。中国电信人工智能研究院具身智能团队提出“对齐 - 引导 - 泛化”(ATE)框架,实现从调架构到调分布的范式转移,适配主流VLA模型,减少数据需求。

机器之心
产品应用8

OpenAI 发布公司领导者 AI 行动指南,助力企业发展

OpenAI 2024 年走访 200 家营收 10 亿美元企业,发现拖慢 AI 落地的是‘领导层叙事缺口’。结合客户实践,总结出对齐、激活、放大、加速、治理 5 个可落地步骤,助企业构建以 AI 为核心的组织。

带你学AI
新闻资讯7

Mistral AI正完成20亿欧元融资,估值140亿美元

彭博消息,法国大模型平台Mistral AI正完成20亿欧元投资,估值达140亿美元,或成欧洲最有价值科技初创公司之一。该公司此前已获10亿欧元融资,发展迅速,推出多款模型。

AIGC开放社区
新闻资讯8

Founder Mode主导,按结果付费带来300%增长,Intercom 的AI转型为什么能成?

本文讲述 Intercom 从 SaaS 老牌公司到 AI-first 的转型故事。创始人 Eoghan McCabe 回归后,裁员聚焦客服,推出 AI Agent 产品 Fin,按结果付费,增长率 300%。还分享转型经验、AI 影响及对人才培养的见解。

Founder Park
开源动态7

美团开源Agentic新王,速度拉满,工具调用打爆Kimi?

周末美团开源LongCat - Flash大模型,参数量560B,推理速度达100 token/s,成本低,在Agent工具调用表现Kimi - K2。它有Zero - Computation Experts和ScMoE创新,不过市场表现未获太多认可。

探索AGI
开源动态8

清华团队开源发布首个结构化数据通用大模型

2025年8月29日,清华崔鹏教授团队联合稳准智能开源“极数”(Limi X)结构化数据通用大模型。它融合结构因果推断与预训练技术,适配多任务,性能最优专用模型,已落地多个工业场景。

AI科技评论
算法论文8

EMNLP25 | 北大x腾讯光子发布 C3 Benchmark:中英双语语音对话模型“地狱级”测试基准,直击语音对话模型软肋!

近年来语音对话模型受关注,但处理人类对话复杂现象的效能缺乏研究。北大联合腾讯光子构建中英双语C3 Benchmark数据集,评估模型应对复杂对话的能力,结果揭示性能瓶颈,为模型优化提供参考,代码和数据已开源。

深度学习自然语言处理
推荐文章7

当AI成为预言家:大数据时代,我们正在失去理解世界的能力吗?

文章借神经科学家Grace Huckins观点,探讨AI时代人类理解世界能力问题。以‘微处理器论文’实验为例,指出大量数据未必带来理解。还阐述理解与预测分离、科学理解危机等,强调理解应是科学核心。

AIGC开放社区