大模型评测」共找到 9240 篇相关文章

新闻资讯7

独家|RoboScience 机器科学完成10亿元融资,资金将用于强化 VLOA 模型与本体

AI科技评论独家消息,RoboScience机器科学近日完成10亿元A轮融资,将深化VLOA模型技术,推进自研机器人本体工程化与量产。其VLOA模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。

AI科技评论
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现模型高效端到端长时记忆

机器之心发布文章介绍,模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的模型长时记忆框架。

机器之心
开源动态8

Nanbeige4.2-3B:探索通用Agent小模型

模型越做越的当下,推理成本成了影响Agent规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。

AIGC开放社区
产品应用7

豆包模型2.0+Claude Skills,3步装好,终于有AI能帮我"看视频做笔记"了!火山引擎全系列可用!

传统视频总结工具只基于音频总结,内容浅显。而豆包模型2.0是多模态原生模型,能同时处理画面和声音。只需3步安装配置,就能让它真正“看”视频,输出详细笔记。

AI产品自由
开源动态8

× MBZUAI重磅开源!A₁:全透明高效 VLA 模型,机器人实时控制成本直降 76% 丨CVPR 2026 Findings

开放世界机器人操作被模型算力成本和推理延迟难题困住,中与MBZUAI团队推出全开源的A₁模型,其自适应推理方案降低推理延迟和骨干计算量,性能超主流基线,打破‘高性能=高成本’魔咒。

AI科技评论
开源动态8

小红书hi lab首次开源文本模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
推荐文章8

阿里云CIO首次系统复盘:模型落地的RIDE方法论与RaaS实践突破

阿里云智能集团 CIO 蒋林泉分享模型落地实践,介绍了阿里云在翻译、智能外呼等场景的应用案例,提出 RIDE 方法论,包括重组组织、识别机会、定义指标和推进执行,还分析了翻译和 Agent 模式的要点。

InfoQ
开源动态8

AI秒懂短视频,快手模型Keye-VL理解力爆表!技术细节全开源

快手全新多模态语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。

新智元
算法论文8

用「进化+压力测试」自动生成的竞赛级编程题,各家模型谁更hold住?

北京学与通用人工智能研究院联合提出 UniCode 框架,构建进化式评测系统,能自动生成高质量算法题目与抗污染测试用例。通过对 19 个前沿模型测试,展现高挑战性与强判别力,为代码能力评估开辟新路径。

机器之心
新闻资讯7

刚刚,智谱正式成“全球模型第一股”,开盘涨超3%!10位董事7个清华背景,专家:国内IPO抢收“确定性”,OpenAI们豪赌“无限性”

今日,智谱在港交所挂牌上市,成“全球模型第一股”。其有技术、产品、商业化优势,但未盈利,研发投入高。专家认为其上市早,国内厂商上市为求确定,而OpenAI等是扩展无限。

AI前线