领域大模型」共找到 9815 篇相关文章

开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源科学多模态模型Intern-S1。它融合多学科知识,首创跨模态科学解析引擎,在多学科任务上超越顶尖闭源模型,还支撑构建了多智能体系统。

机器之心
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现模型高效端到端长时记忆

机器之心发布文章介绍,模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的模型长时记忆框架。

机器之心
开源动态8

OPPO AI重磅发布:深度研究智能体,离“真正好用”还有多远?我们给模型做了一次全身体检

2025年,Deep Research成AI热点,OPPO AI Agent Team对模型评测。发布论文,开源评测基准FINDER和失败分类体系DEFT,揭示AI“装懂”“缺乏韧性”问题,还分析模型表现并给出发展建议。

深度学习自然语言处理
开源动态8

小米MiMo-V2-Flash开源:3090亿参数模型能否改写AI行业规则!

2025年12月16日小米开源旗舰模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。

MCP Server
算法论文8

单卡即可微调模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技学和香港中文学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
算法论文8

从少样本到千样本!MachineLearningLM给模型上下文学习装上「机器学习引擎」

新研究 MachineLearningLM 提出轻量可移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在多领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力,还指明未来研究方向。

机器之心
产品应用7

豆包模型2.0+Claude Skills,3步装好,终于有AI能帮我"看视频做笔记"了!火山引擎全系列可用!

传统视频总结工具只基于音频总结,内容浅显。而豆包模型2.0是多模态原生模型,能同时处理画面和声音。只需3步安装配置,就能让它真正“看”视频,输出详细笔记。

AI产品自由
算法论文8

百万规模数据集打造人形机器人通用模型,实现精细动作跨平台、跨形态动作迁移丨北联合发布

和人团队在通用人形机器人动作生成领域取得重突破,首创通用动作生成框架Being - M0,构建百万规模动作生成数据集MotionLib,研发文本驱动动作生成模型,实现人体动作向多类型人形机器人迁移,文章将发表于ICML2025。

量子位
开源动态8

× MBZUAI重磅开源!A₁:全透明高效 VLA 模型,机器人实时控制成本直降 76% 丨CVPR 2026 Findings

开放世界机器人操作被模型算力成本和推理延迟难题困住,中与MBZUAI团队推出全开源的A₁模型,其自适应推理方案降低推理延迟和骨干计算量,性能超主流基线,打破‘高性能=高成本’魔咒。

AI科技评论
算法论文8

一个模型统一4D世界生成与重建,港科One4D框架来了

港科研究团队提出 One4D 框架,可统一 4D 生成与重建,构造同步输出多模态的视频扩散模型,支持多种任务形态。其有 DLC、UMC 等亮点,用合成与真实数据混合策略训练,实验表现佳。

机器之心