领域大模型」共找到 9815 篇相关文章

算法论文8

模型越聪明越“不听话”?MathIF基准揭示AI服从性漏洞

上海人工智能实验室与香港中文学研究团队发布论文,用MathIF基准揭示模型“聪明”和“听话”有矛盾,越擅长推理越易忽略指令,还分析了原因并给出让模型更“听话”的方法。

深度学习自然语言处理
新闻资讯7

谷歌技术报告披露模型能耗:响应一次相当于微波炉叮一秒

模型耗电舆论高,谷歌用数据还击。谷歌首席科学家称Gemini能耗低于预期,一年间能耗降至1/33,碳排放降至1/44。谷歌用更全面指标计算能耗,还从多方面优化使Gemini能耗降低。

量子位
开源动态8

百度开源视觉理解模型Qianfan-VL!全尺寸领域增强+全自研芯片计算

今天百度智能云千帆推出全新视觉理解模型Qianfan - VL并全面开源,含3B、8B和70B三个版本,基于自研昆仑芯P800计算。它特点多、性能优,应用场景广,未来还将推新产业级模型

量子位
算法论文8

联合字节跳动提出JoVA: 一种基于联合自注意力的视频-音频联合生成模型

香港学联合字节跳动提出视频 - 音频联合生成框架 JoVA,支持音视频 Token 跨模态交互,引入嘴部区域特定损失解决口型同步问题。实验显示,它用约 190 万条数据就达先进水平。

机器之心
推荐文章7

模型协同架构在金融智能投顾中的应用与挑战

本文整理自北银金科高级算法专家尹辰轩分享,介绍模型协同架构下的模型投顾方案,能解决幻觉问题、优化回答深度。还提到 12 月 19 - 20 日 AICon 北京站聚焦多热门方向。

InfoQ
产品应用7

用最简单的模型技术打造一个迁云专家有多难?

文章探讨在云迁移领域模型技术“复制”专家80%核心能力。分析标准化方案不足及简单RAG局限,介绍“LX0.1”AI专家助手构建,还提及分层评测、人机协同等优化,最后展望AI在云迁移的未来方向。

阿里云开发者
新闻资讯7

刚被马斯克收购,Cursor掏出新模型:10万卡加持,和Opus、GPT一样

本周二,刚被SpaceX收购的Cursor在首届旗舰会宣布新的1.5万亿+参数模型,在超10万块GPU预训练。Cursor CEO称其规模与Opus、GPT相当,还谈了对其他AI实验室看法,新模型将几周内发布。

机器之心
算法论文8

一个模型千万个灵魂!Anthropic找到了防止AI陷入疯狂的防线

Anthropic和牛津学研究发现,模型的AI助理角色易在长对话中漂移崩塌,致其陷入幻觉。研究解析助理轴,揭示模型人格定位,还提出激活上限技术,能在保能力的同时降低有害回复率。

AIGC开放社区
算法论文8

谷歌DeepMind:AGI不必是巨型模型,拼凑型AI群或率先涌现,管理规模Agent迫在眉睫

DeepMind最新研究提出,AGI未必以单一巨型模型形式出现,可能由多个次级AGI智能体协作拼凑涌现。为此,团队提出分布式AGI安全框架,包含四层深度防御模型应对新安全挑战。

AI寒武纪
新闻资讯8

黄仁勋CES最新演讲:Rubin 今年上市,计算能力是 Blackwell 5 倍、Cursor 彻底改变英伟达软件开发方式、开源模型落后于先进模型约6个月

英伟达CEO黄仁勋在CES 2026演讲宣告AI从理解语言走向改造物理世界。他提及开源模型发展,还发布多款新品,如AlpaSim仿真框架、GROOT 1.6机器人模型、AI超算Vera Rubin等,凸显英伟达在AI领域的布局与野心。

InfoQ