「模型优势」共找到 8428 篇相关文章

产品应用8

正式版发布!DeepSeek-V4-Pro-0813

8月13日晚,DeepSeek-V4-Pro-0813正式版发布。此次升级将Agent维度提升至无短板的第一梯队,具备1M+384K长任务能力,接口双兼容,技术创新多。还公布评测对比、价格并发设定,给出实战代码案例与启示。

机器学习AI算法工程
新闻资讯7

Anthropic 兄妹 Dario Amodei 和 Daniela Amodei 最新对话:Claude 为什么一直限速?

在 5 月 6 日 Anthropic 开发者大会上,兄妹 Dario Amodei 和 Daniela Amodei 对话,谈到 Claude 限速因 2026 年 Q1 增速年化 80 倍远超规划,还涉及开发者生态、模型训练、能力释放等话题,强调平衡发展与安全。

宝玉AI
算法论文7

谷歌研究院探索多智能体协调的扩展原则

谷歌研究院对180种智能体配置对照评估,得出‘AI智能体系统首批定量扩展原则’。发现多智能体协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。

InfoQ
新闻资讯8

AI for Health:从「实验室Demo」到「国民级健康伙伴」的范式跃迁 | GAIR Live 024期预告

医疗大模型正从“聊天工具”进化为“生命基础设施”,但面临诸多挑战。GAIR Live 024期圆桌将汇聚学术与产业顶尖智慧,探讨构建可信、高效、人机协同的医疗新范式,剖析核心议题,分享讨论精华。

AI科技评论
新闻资讯7

WASI 1.0:WebAssembly可能在2026年悄然普及

WebAssembly在Wasm 3.0和组件模型发布后进展巨大,预计WASI 0.3.0在2026年发布将使其成熟落地,可在多场景替代传统容器,还介绍了其优势、关键特性及标准化情况。

InfoQ
算法论文8

告别“一眼定生死”:Agent-as-a-Judge 开启 AI 评估的下半场

过去两年,LLM-as-a-Judge成评估界“黄金标准”,但面对复杂任务力不从心。论文《A Survey on Agent-as-a-Judge》指出,应从单一的大模型裁判进化为具备行动能力的智能体裁判,还阐述了其优势、发展阶段等。

深度学习自然语言处理
产品应用7

Human In the Loop竟然可以是个MCP?

文章基于阿里实践,阐述如何在大模型研发平台OpenLM及其他Agent平台,针对“Human In The Loop”场景做产品设计与研发。介绍用MCP实现人机回路的方案,还探讨人类回答及提示词倾向性等问题。

阿里云开发者
新闻资讯8

云计算一哥10分钟发了25个新品!Kimi和MiniMax首次上桌

亚马逊云科技CEO在re:Invent 2025上10分钟发25个新品,2小时近40个。围绕AI Agent,从算力到模型、平台、应用全面布局,还引入中国Kimi和MiniMax,构建全栈壁垒,助力企业用好AI。

量子位
算法论文8

NeurIPS 2025 Spotlight | 条件表征学习:一步对齐表征与准则

文章指出传统表征学习处理图片和商品信息时存在局限,针对性有监督训练成本高,多模态大模型使用成本也需考虑。为此提出即插即用的条件表征学习方法 CRL,实验显示其在下游任务表现优异。

机器之心
算法论文8

告别海量标注!浙大团队提出GUI-RCPO,让GUI定位在无标签数据上自我进化

浙大等机构研究人员提出GUI - RCPO,这是自我监督强化学习方法,能让模型在无标注数据上提升GUI grounding能力。其通过迁移思想,利用区域一致性自我提升,实验表明该方法有效且有泛化能力。

量子位