能力显著向量」共找到 3756 篇相关文章

新闻资讯7

2026年OpenAI最看好的3个方向

OpenAI首席财务官与投资人聊2026年AI趋势,涉及多智能体登场、算力换收入、大模型能力突破等。还谈到对医疗、具身智能行业变革影响,破除AI泡沫说法,预测机器人行业前景等。

量子位
产品应用8

AI 医疗还在比进度,百川已在比高度

近一年来,AI医疗进入新阶段,众多企业和资本涌入。但当前主流医疗大模型有局限,落地难。百川Baichuan - M3聚焦医疗决策过程建模,三项关键评测达全球最优,或代表AI医疗重要转向。

AI科技评论
算法论文8

告别“一眼定生死”:Agent-as-a-Judge 开启 AI 评估的下半场

过去两年,LLM-as-a-Judge成评估界“黄金标准”,但面对复杂任务力不从心。论文《A Survey on Agent-as-a-Judge》指出,应从单一的大模型裁判进化为具备行动能力的智能体裁判,还阐述了其优势、发展阶段等。

深度学习自然语言处理
新闻资讯8

DeepSeek V4爆春节登场!四大杀招突袭全球编程王座,Claude危

据爆料,DeepSeek计划在2月中旬春节前后发布V4模型,剑指编程王座。其在编程能力、超长上下文代码处理、算法提升、推理能力上有突破,或延续高性价比路线,在受限硬件下靠算法取胜。

新智元
算法论文8

从过拟合到通用!ViMoGen开启3D人体动作生成新纪元

随着AIGC爆发,3D人体动作生成领域滞后,现有模型泛化能力有瓶颈。南洋理工大学等机构研究人员提出ViMoGen,从数据、模型、评估三方面重新定义通用动作生成路径,还能赋能具身智能。

机器之心
新闻资讯7

谷歌看了都沉默:自家「黑科技」火了,但为啥研发团队一无所知?

当科技圈为‘谷歌黑魔法’兴奋时,所谓‘并行验证循环’可能是AI生成的‘赛博跳大神’。它号称超越思维链,性能提升显著,但发帖者身份存疑,无可靠源链接,其真实性遭业内质疑。

新智元
开源动态8

即将开源 | 阿里云Tair KVCache Manager:企业级全局 KVCache 管理服务的架构设计与实现

阿里云Tair KVCache团队联合多团队将开源Tair KVCache Manager,介绍其架构设计与实现。该服务应对Agentic AI下KVCache存储挑战,解决传统模式难题,具备企业级管理能力,后续还会完善多方面功能。

阿里云开发者
新闻资讯7

智能体的记忆管理机制及其潜在风险 | 直播预约

大语言模型(LLM)智能体兴起,记忆机制是核心。本次报告将探讨记忆管理对其性能的影响及潜在风险,展示缓解关键挑战的策略,介绍新攻击范式,揭示安全漏洞,强调需重新审视与建模。

深度学习自然语言处理
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动化研究所、腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。

深度学习自然语言处理
开源动态8

170次搜索+50次反思:用GLM-4.7盘点2025 Agent行业趋势,结果太震撼!

作者给智谱新开源的GLM - 4.7布置调研2025年Agent赛道企业的任务,结果令人震撼。该模型进化显著,能整理详细企业信息,还能生成高审美PPT。国内有不少特色AI落地企业。

探索AGI