多模型策略」共找到 9929 篇相关文章

产品应用7

对话陈炜鹏:Loopit 有了 1500 万件作品之后,我们决定做自己的互动世界模型

Loopit 今年 2 月上线,已积累近 1500 万作品,北美数十万青少年成稳定用户。在此基础上,团队发布互动世界模型 Zing - 0.5,探索互动内容新形态。陈炜鹏认为模型与应用应结合,自研是为拓展产品边界。

Founder Park
算法论文7

DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO

文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。

机器之心
算法论文8

Qwen团队发布长上下文Reasoning模型QwenLong-L1,超越o3-mini

Qwen团队发布长上下文Reasoning模型QwenLong - L1。当前大模型处理长文本有训练效率低、过程不稳定难题。QwenLong - L1用分阶段强化学习等方法,实验中超越o3 - mini、比肩Claude,还在案例表现出色。

深度学习自然语言处理
开源动态8

Qwen紧追OpenAI开源4B端侧大模型,AIME25得分超越Claude 4 Opus

Qwen团队深夜开源两个端侧模型Qwen3 - 4B - Instruct - 2507和Qwen3 - 4B - Thinking - 2507,尺寸对端侧友好,支持256k上下文。后者在AIME25测评得分超Claude 4 Opus,两模型能力较前作均有提升。

量子位
算法论文7

POF|清华大学张宇飞团队:采用数据驱动湍流模型的三维增升装置模拟

传统RANS方法预测分离流动有挑战,数据驱动湍流模型泛化性能有局限。清华大学张宇飞团队研究其在复杂三维增升装置应用,验证SST - CND模型泛化能力及修正项迁移能力,证明其可用于真实工程流动问题。

力学与人工智能
产品应用8

九天大模型大变身:性能狂飙35%!还能一键P大象

7月26日,中国移动在2025世界人工智能大会发布「九天」基础大模型3.0,端到端技术全面升级,复杂推理能力提升35%,智能体调用效率提升21%,还推出代码、数学等专项大模型模态能力也焕新。

新智元
开源动态8

攻克结构化长文档检索难题!新框架让模型告别“结构性失明”

SEAL团队推出全新对比学习框架SEAL,通过带结构感知和元素对齐,将文档宏观层级结构和微观元素语义融入Embedding空间,提升模型对结构化数据的理解。在BGE - M3模型上提升了MRR@10指标,还开源了万级字数长文档数据集。

量子位
新闻资讯7

IROS 关键圆桌:到底应该模型驱动,还是数据驱动?

10月20日,美团在IROS大会期间举办学术年会,位嘉宾围绕具身智能商业化等议题展开探讨。圆桌嘉宾就第一性原理、软硬件体系、模型与数据驱动等话题各抒己见,还谈及机器人最终形态并勉励年轻人。

AI科技评论
算法论文8

挑战扩散自回归统治!字节提出视觉生成第三种路线,让模型像人类一样边画边改

五一期间字节商业化技术团队研发出新一代视觉生成模型,其底层架构是全新的第三条路——生成精炼网络GRN。它能让AI像人一样边画边改,解决了现有模型的问题,在项基准测试中刷新SOTA记录。

量子位
算法论文8

EMNLP2025 | 探究大语言模型的语言共享神经元提升低资源语言能力

论文提出BridgeX - ICL方法提升LLM低资源语言性能,通过三步实现优化。构建两类探测数据解决传统问题,识别重叠神经元,用HSIC选最优桥梁语言,在任务实验验证其有效,揭示语言机制规律。

深度学习自然语言处理