「元数据性能」共找到 4617 篇相关文章
突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度
在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。
无需训练,如何提升黑箱VLM?CARPRT用「类别感知」给出答案
近年来,视觉 - 语言模型(VLMs)改变图像理解范式,但零样本分类性能对 Prompt 敏感。墨尔本大学 TMLR 小组提出 CARPRT 方案,以“无训练、黑箱适配、类别专属权重”解决提示词语义适配不足问题,已被 ICLR 2026 接收。
又一个开源 AI Agent 杀到!II-Agent,号称“全球最强”,击败 Genspark 和 Manus,跑分直逼人类
AI Agent 赛道迎来新成员 II-Agent,由 Intelligent Internet 团队打造且将开源,获前 Stability AI CEO 站台。它性能强、可扩展,GAIA 跑分亮眼,团队认为未来是 Agent 群的天下,还计划为多领域构建开源 Agent。
ICML 2025 Spotlight|华为诺亚提出端侧大模型新架构MoLE,内存搬运代价降低1000倍
华为诺亚和北大研究人员提出端侧大模型新架构MoLE。它解决传统MoE显存开销大、传输延迟高问题,推理时将专家输入改embedding token,用查找表替代矩阵运算,实验显示性能与MoE相当,大幅降推理延迟。
GPT-6来了,立摘ASI坐标系今日金牌!
OpenAI 正式发布 GPT - 6 Astra,在多项测试中表现优异。近期 Anthropic、谷歌也有新模型发布。马斯克、Altman 对 AI 发表看法。新智元决定做 ASI 坐标系,相关官网 9 月 7 日上线,现征集需求。
Agentic-Native 增长:Zilliz 如何用 AI Agent 支撑超线性业务扩张|AICon 深圳
2026年AICon深圳站8月21 - 22日举办,聚焦多关键方向,邀50+头部企业专家。Zilliz联合创始人郭人通将分享用AI Agent支撑业务扩张,介绍落地案例、关键实践及对数据基建新要求。
让大模型自己写代码、自己进化,GIM和港大这篇ACL主会,把量化因子挖掘重做了一遍
香港大学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能体探索体系,让大模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。
字节跳动发布SeedFold,蛋白质结构预测相关多任务超越谷歌AlphaFold 3,揭示大模型缩放新秘诀
字节跳动Seed团队推出新一代折叠模型SeedFold,在多个蛋白质相关任务性能上超越谷歌AlphaFold 3。该研究为有效缩放生物分子基础模型提供新思路,推出加宽模型、线性三角注意力等方法。
Yann LeCun离开Meta后首篇论文?使用了宇树机器人做研究
伯克利、纽约大学等团队发表论文,提出GenMimic方法,让机器人能零样本复现AI生成视频动作。Yann LeCun是共同导师之一。团队构建GenMimicBench数据集,经仿真和真实实验验证方法可行。
解放军总医院联合南大、吉大等机构,共同提出首个「脊柱诊疗大模型」SpineGPT
解放军总医院联合多机构研发首个脊柱诊疗大模型 SpineGPT。研究指出通用 LVLM 有‘认知鸿沟’,团队构建 SpineMed 生态系统,含 SpineMed - 450K 数据集与 SpineBench 评估基准,SpineGPT 表现超越开源模型。