AI模型性能」共找到 13755 篇相关文章

新闻资讯8

月吞100万亿Token!AI中转站OpenRouter赚爆了

OpenRouter宣布完成1.13亿美元B轮融资,估值达13亿美元。它每周处理25万亿个tokens,全球用户超800万。其提供AI推理统一控制层,解决企业多模型管理难题,开源模型崛起使其价值凸显。

新智元
新闻资讯7

直播预约 | 迈向用于演绎推理的诚实语言模型

本次讲座聚焦迈向用于演绎推理的诚实语言模型。当前语言模型难诚实推理,输入不足会产生无根据答案。为此制定多步骤任务,提出强化学习方法ACNCHOR,稳定学习过程、提高推理性能

深度学习自然语言处理
算法论文8

治好多模态近视和走神!上海大学去偏干预显著提升模型性能

多模态大模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海大学与南开大学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。

AIGC开放社区
新闻资讯7

阿里巴巴大模型品牌统一为千问

今天,阿里巴巴AI总称和核心品牌统一为千问,涵盖基础与专业领域模型,千问APP是C端旗舰应用。今年除夕开源千问3.5,多款中小型模型上榜,春节用户下单近2亿次,DAU大增成国民级助手。

千问Qwen
产品应用7

模型都一样了,AI Agent 真正的差距在 Harness 层!

如今各平台接入模型趋同,AI Agent 差距体现在 Harness 层。以天工超级智能体为例,其有约束先行、任务并行编排等亮点,还提供 Skill 粒度新思路,且云端运行降低使用门槛。

探索AGI
开源动态8

SVG性能比肩GPT/Claude,腾讯开源3B模型HiVG,让Token「懂几何」

腾讯混元团队开源仅3B参数的HiVG,它是面向SVG生成的层次化分词框架,减少63.8% token数量,多项指标超越GPT-5.2等闭源模型及8B级开源模型,还在人类评测中表现出色。

量子位
新闻资讯8

AI Spot 学术分享会丨ICLR 2026 深度推理专场

当大模型走向深度推理,ICLR 2026 汇聚全球顶尖成果。OpenMMLab 等联合发起 AI Spot ICLR 2026 学术分享会,5 月 14 日 19 点直播,聚焦模型‘慢思考’,嘉宾将解读四大核心技术。

OpenMMLab
开源动态8

AI装进数据库:PostgresML和Korvus的新思路

当下机器学习应用开发流程复杂,开源数据库Postgres带来惊喜。PostgresML团队让AI模型跑在数据库中,介绍了PostgresML和Korvus两个关键项目,二者结合降低复杂度,让‘在SQL里跑AI’成工程现实。

AI工程化
产品应用7

WAIC最强亮点:非Transformer离线AI模型已大规模量产,大模型商业比我们想得更快

在WAIC上,RockAI推出非Transformer离线AI模型Yan 2.0 Preview,有视觉感知跃升和自主学习能力两大提升。该公司走非Transformer路线,着重场景落地,通过“标杆战略”推动产品量产,未来构想构建“群体智能”世界。

AI科技评论
新闻资讯7

真热AI!米哈游5亿成立新公司

米哈游全资成立上海米哈游无定谷科技有限公司,注册资本5亿,经营范围涉及人工智能等领域。米哈游在AI领域布局已久,有自研大模型,创始人蔡浩宇也有相关创业动作,旗下游戏还与马斯克的AI女友互动。

量子位