大模型推理」共找到 9477 篇相关文章

算法论文7

720美元套出A社死藏的Opus原始思维链,还是Haiku泄露的,GPT/Gemini也中招

研究人员发现,将模型返回的加密推理块扔给同厂小模型让其复述,就能破解模型隐藏的思维链。如Anthropic、OpenAI、Google的模型均中招,还会带来隐私、安全等风险,虽已打补丁,但仍有难题。

量子位
算法论文8

首篇全新情景认知视角的模型Agent综述

中科的这篇Survey从全新情景认知视角对模型Agent进行综述,给出Agent本质,介绍Agentic AI定义、模型五层演化理论等,还以OpenClaw为例说明,旨在提供理解框架与未来方向。

PaperAgent
开源动态8

The Batch:841 | 语言模型正在纠正历史遗留的不公

美国北加州旧不动产契约含种族歧视条款,人工筛查耗时久。斯坦福和普林斯顿学研究人员微调语言模型实现自动识别,分析圣克拉拉县契约,发现诸多受影响土地,且揭示少数开发者推动住房隔离,模型已开源。

DeeplearningAI
开源动态8

35B参数科学性能比肩万亿参数模型,『书生』科学模型Intern-S2-Preview开源

5月15日上海AI实验室开源新一代模型预览版Intern - S2 - Preview,尺寸小、科学能力强,在多方面有突破。其深化与昇腾算力生态协同,探索‘通专融合’,科学及智能体能力升级,还优化训推效率。

GiantPandaLLM
新闻资讯8

谷歌年度招:所有AI模型全升级一遍!Gemini2.5杯中杯霸榜前二,新版视频/图像模型亮相

谷歌在I/O会放招,升级所有AI模型,重做原有产品,推出诸多实验性新产品。如Gemini 2.5系列升级,具备新功能;还有异步代码助手Jules、新搜索模式等,多模态模型也全线升级。

量子位
新闻资讯8

国足缺席世界杯,但中国模型们集体参赛

联想在2025联想天禧AI生态伙伴会宣布举办AlphaGoal预测杯,8家中国模型将与普通球迷、开发者的AI Agent同台,预测世界杯赛果。这或触发足球体验革命,推动AI走向真实世界。

量子位
产品应用7

Chaterm Agent Skills + 千问模型,智能运维再进化

文章介绍Chaterm Agent Skills与千问模型结合用于智能运维。它能将运维经验打包成技能,提供三种模式,缩短运维时间。文中还阐述了技能概念、工作原理、技术实现及实战案例,鼓励用户尝试创建技能。

阿里云开发者
新闻资讯7

模型平台AI21 Labs获3亿美元D轮融资

Business Insider消息,模型平台AI21 Labs获3亿美元D轮融资,由谷歌、英伟达领投。该公司创立于2017年,2025年3月推出新AI平台Maestro,可提升主流模型指令遵循准确性。

AIGC开放社区
开源动态8

15个前沿模型,100个职业场景:谁才是最强AI打工人?

通义千问与港中文联合发布OccuBench,用语言世界模型评测AI Agent职业能力。评测15个前沿模型,发现无全能选手,隐式故障难处理,Scaling定律有效,做Agent和环境模拟器能力不同,还给出具体案例。

AI科技评论
算法论文8

AI"学霸"也解不出高中题?耶鲁、复旦发布MMSciBench,揭示AI理科推理能力短板

耶鲁、复旦等推出MMSciBench评测基准,揭示主流模型复杂科学推理短板。它有高质量数据、多模态多题型测试和精细知识分类体系。测试发现模型图文融合及推理能力弱,英文推理或效果更好。

深度学习自然语言处理