大模型智能体」共找到 10587 篇相关文章

算法论文8

不靠英伟达,中科院在国产 GPU 上跑通 76B 类脑模型

过去模型依赖Transformer和NVIDIA GPU体系,硬件自主化难。中科院团队提出类脑模型SpikingBrain,在超长文本处理上百倍加速,在国产MetaX GPU平台稳定训练76B模型,开辟新道路。

AI科技评论
开源动态8

135 个项目、七趋势、三赛道:撕开模型开源生态真相,你会怎么卷?

在开发者会密集登场之际,5月27日蚂蚁集团开源团队发布《2025模型开源开发生态全景图》。展示135个项目、七趋势、三赛道,剖析开源生态现状与变化,揭示应用重塑和生态位博弈。

机器之心
开源动态7

不可思议!400B模型在iPhone上跑起来了

一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上模型交互级速度运行。

机器之心
算法论文8

十二顶尖模型决战华尔街与量化投资

文章解读重磅论文,该研究汇聚五家顶级AI厂商十二个模型,在标普500指数十一板块构建投资组合并测试。结果表明,混合智能策略是稳健收益最佳路径,未来量化投资是人机和量化模型三元融合。

AIGC开放社区
开源动态7

阿里达摩院开源多模态医学模型—灵枢

模型在医疗领域应用有医疗知识覆盖不足、幻觉风险高、推理能力欠缺三难题。阿里达摩院开源统一多模态医学模型灵枢,介绍其数据体系、清洗流程及四阶段强化训练方法。

AIGC开放社区
产品应用7

WAIC最强亮点:非Transformer离线AI模型规模量产,模型商业比我们想得更快

在WAIC上,RockAI推出非Transformer离线AI模型Yan 2.0 Preview,有视觉感知跃升和自主学习能力两提升。该公司走非Transformer路线,着重场景落地,通过“标杆战略”推动产品量产,未来构想构建“群体智能”世界。

AI科技评论
新闻资讯8

年复出,入局模型

国产模型领域黑马StartLux-V1.0-27B-Preview,参数量仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数量的DeepSeek-V4-Pro。其创始人陈年押注本地模型,公司专注该领域商业化。

量子位
开源动态8

阿里通义开源「推理+搜索」预训练新框架:小模型媲美模型,多个开放域问答数据集表现显著提升

阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在多数据集提升模型性能,小模型能媲美模型,还验证了训练方式、策略及奖励函数的效果。

量子位
开源动态8

商汤科技与南洋理工开源空间智能多模态SOTA模型

商汤科技与南洋理工学构建800万量级三维空间数据集,训练出开源SOTA多模态基础模型SenseNova - SI系列。该系列模型在多个权威测试中表现出色,部分超越GPT - 5,还展现出泛化等能力,且能赋能具身智能

AIGC开放社区
开源动态8

7B模型对标GPT-4o,全球首个医疗代码生成模型训练平台来了

研究团队发布全球首个医疗代码生成模型训练平台MedAgentGym,提供评估基准和训练生态,提升模型医疗代码生成与推理能力。经其训练的Med - Copilot - 7B达GPT - 4o相当水平,解决医疗AI编程瓶颈。

量子位