海外训练模型」共找到 8161 篇相关文章

新闻资讯8

独家|「中科第五纪」完成数亿元A轮融资,率先开启海外商业落地

AI科技评论独家消息,具身智能企业「中科第五纪」近日完成数亿元A轮融资,年内已完成三轮。该公司还收获海外数亿订单。其提出超少样本具身操作大模型等核心技术,形成完整技术体系。

AI科技评论
产品应用8

比英伟达早,比李飞飞强,大晓Kairos原生一体化世界模型定义物理AI新路线

大晓机器人发布 Kairos 开悟世界模型,其首创“多模态理解 — 生成 — 预测”原生一体化架构,采用跨具身渐进式训练体系和“以人为中心”的数据金字塔,还实现端侧部署,在四大权威具身智能基准上全面登顶。

机器之心
8

AI真的需要「像人类」那样思考吗?AlphaOne揭示属于大模型的「思考之道」

近年大模型在推理任务有进展,但缺乏推理节奏调控能力。伊利诺伊大学厄巴纳 - 香槟分校和加州大学伯克利分校研究提出 AlphaOne 框架,引入 α - moment 实现无需训练的推理调控,实验显示其能提升准确率和效率。

机器之心
算法论文7

ENG APPL COMP FLUID | 西北工业大学曹文博、张伟伟等:基于参数化神经网络求解器的层流翼型绕流代理模型

近年来,PINNs在流体力学中受关注,但在高维参数化与复杂流动问题中受限。西北工业大学曹文博团队基于TSONN构建层流翼型绕流参数化求解器,训练出强泛化能力的代理模型,为工程层流气动分析提供新方案。

力学与人工智能
开源动态8

阿里发布信息检索Agent,可自主上网查资料,GAIA基准超越GPT-4o | 模型&数据开源

阿里发布WebDancer信息检索Agent,能自主上网查资料。它具备多步推理等能力,采用四阶段训练范式,模型和方法已开源。在多个基准测试中表现优异,突显处理复杂任务的鲁棒性和有效性。

量子位
算法论文8

无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码

港中文(深圳)和上海交通大学团队提出 StreamBP 算法,通过线性分解和分步计算,将大语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最大序列长度为其 2.8 - 5.5 倍,代码已开源。

机器之心
算法论文8

单卡4090也能高质量视频编辑!西湖AGI Lab无训练框架FlowDirector来了

视频编辑门槛高、现有方法开销大且效果不佳。西湖大学AGI Lab团队提出无需训练的FlowDirector框架,可将基于流的视频生成模型改造成编辑工具,质量高、功能广、开销低,解决了时序、结构和编辑幅度问题。

机器之心
算法论文7

LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了

华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效性与模型能力有关。

机器之心
开源动态8

Kimi K2.5登顶开源第一!15T数据训练秘籍公开,杨植麟剧透K3

Kimi K2.5登上Hugging Face热榜榜首,下载超5.3万。它主打Agent能力,成绩超GPT - 5.2等闭源模型,性价比高。官方技术报告公开其用15T数据训练,还搭载Agent Swarm架构,团队还剧透了Kimi K3。

量子位
算法论文8

定位大模型「作弊」神经回路!新研究首次揭示:虚假奖励如何精准激活第18-20层记忆

此前学术界发现大模型用虚假奖励训练也能提升准确率,背后微观机制是黑盒。南科大等团队深度拆解,定位到关键记忆节点,发现‘困惑度悖论’,还能操控记忆,成果对评估、检测和去污染有意义。

量子位