「AI大模型」共找到 14236 篇相关文章

算法论文8

EMNLP2025 | LLM多次回答一致就一定正确吗?非也

随着LLMs在高风险领域广泛应用,其输出的事实性错误引发安全质疑。中科院计算所和美团团队论文揭示自我一致错误,传统检测方法对此失效,提出跨模型探针法提升检测能力。

深度学习自然语言处理
新闻资讯7

Gemini进手机,Android翻身;Gemini进电脑,全网开喷!

谷歌在端侧AI大力尝试,在Android Show I/O Edition发布围绕Gemini Intelligence的新产品与功能,让AI进入系统基础体验。手机端Create My Widget功能亮眼,而Googlebook引发争议。同时苹果iOS 27也有Siri改造新消息。

AI前线
7

GPT-5.6现身后,下一个Claude Sonnet 4.8又曝光了!

GPT-5.5发布不久,开发者在Codex内部日志发现GPT-5.6,几乎同时,Anthropic的Claude Code源码泄露,炸出Sonnet 4.8、Jupiter等型号。两家公司下一代模型几乎同时曝光,模型迭代节奏在加速。

新智元
新闻资讯8

高盛怕了!Claude Mythos全球首个攻破企业网络,奥本海默时刻来了

英国AI安全研究所研究显示,Anthropic发布的Claude Mythos Preview模型在网络安全评估中表现惊人,能全自动、全自主完成企业网络攻击模拟。高盛为此加强网络防御,人类网络安全或进入奥本海默时刻。

新智元
产品应用8

Agent 落地,数据库先变

AI竞争靠近落地,Agent如何读懂业务、释放模型智能价值成核心命题,数据库也被推到台前。Agent成新用户,对数据库提出新要求。OceanBase提出湖库一体架构,欲做Agent时代数据底座,降低落地成本。

AI科技评论
新闻资讯7

Meta 重金抢人,明星云集就能复制 DeepSeek 的成功吗?

Meta 扎克伯格亲自出手重金招人,组建豪华 AI 战队,核心领导与技术阵容都很强大。但天才招聘只是第一步,组织天才协同才关键。DeepSeek 团队规模小、扁平化,成功逆袭。Meta 难复制其成功,组织重构能力或更重要。

AI科技评论
产品应用7

Multi-Agent 的灵活编排之路

文章从Copilot 3.0架构规划模块出发,结合DeepSeek R1强化学习训练实践,探讨多智能体架构下大模型编排智能体解决问题。分析Copilot 2.0局限并介绍3.0升级,指出难点,展示效果对比及解决方案。

阿里云开发者
推荐文章8

出价算法新SOTA——快手首提生成式强化学习出价

文章介绍快手新提出的生成式强化学习出价模型GAVE,回顾出价算法发展历程。GAVE结合生成式与强化学习优势,有Score-based RTG等创新,经竞赛、实验验证效果佳,为出价技术带来新方向。

王喆的AI笔记
算法论文8

0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26

大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。

量子位
算法论文8

综述238篇遥感微调!清华院士团队指出9大方向 | CVMJ

在大数据和大模型推动下,遥感微调技术从全参数微调发展到混合微调。清华等团队在CVMJ期刊梳理技术脉络,涵盖适配器、提示等微调方法,还指出9个潜在研究方向,助力遥感技术应用。

新智元