多模态语言推理」共找到 3468 篇相关文章

产品应用7

Pinterest 部署生产级模型上下文协议生态系统,赋能 AI 智能体工作流

Pinterest 工程团队搭建内部模型上下文协议(MCP)生态系统,驱动 AI 智能体,实现工程任务自动化。架构上线生产级服务器等,替换零散对接方式,让语言模型调用工具、访问数据,还能执行多种任务。

InfoQ
新闻资讯7

全网疯传!Claude最新模型意外曝光:全面碾压Opus 4.6,强到让Anthropic不敢发布

Anthropic“手滑”泄露最强新模型Claude Mythos,它在编程、推理和网络安全测试中表现超Claude Opus 4.6。因模型“黑客能力”强,Anthropic发布谨慎。此外,该公司还意外泄露3000多未发布文件。

AI前线
开源动态8

Transformer 中的专家混合模型 (MoE)

文章介绍Transformer中专家混合模型(MoE),它能解决稠密模型扩展瓶颈。阐述其优势,如计算高效、适合并行等,还介绍在transformers库中支持稀疏架构的演进,包括权重加载重构、专家执行后端、专家并行及训练方案。

Hugging Face
算法论文8

文言文秒杀所有大模型!100%攻击成功,轻松突破安全防线

南洋理工等机构团队提出基于文言文语境的自动化黑盒测试框架CC - BOS,利用果蝇算法和8维策略空间,暴露主流大语言模型安全盲区,实验显示对6款主流模型攻击成功率达100%。

AIGC开放社区
算法论文8

4B模型幻觉抑制能力超越GPT-5,CMU等提出行为校准强化学习新方法

语言模型幻觉问题是部署难题,CMU等研究人员提出行为校准强化学习新方法,重新设计奖励函数。经训练,40亿参数模型幻觉抑制力超GPT - 5,实验证明该方法效果显著,还带来理论洞察。

机器之心
算法论文7

谷歌研究院探索多智能体协调的扩展原则

谷歌研究院对180种智能体配置对照评估,得出‘AI智能体系统首批定量扩展原则’。发现多智能体协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。

InfoQ
开源动态8

CVPR 2026 | AI寒武纪时刻?字节世界模型新作,仅靠视觉学习真实世界知识

豆包大模型团队与北京交通大学联合提出视觉世界模型 “VideoWorld 2”,无需依赖语言模型,仅靠视觉信息让机器掌握复杂能力。它能完成复杂手工任务,成功率远超主流模型,代码与模型已开源。

机器之心
新闻资讯7

The Batch: 918 | 智能体 AI 引发投资者恐慌

投资者担忧AI系统动摇软件制造商商业根基,致标普软件与服务指数等大幅下挫。Anthropic推出多款产品加剧风波,后与部分公司合作使SaaS类股反弹,但未收复全部跌幅。AI正重塑软件市场,SaaS未死,正迈向AI原生化。

DeeplearningAI
产品应用8

引爆千亿市场!杭州AI再出王炸:刷新自研天花板,“三甲专家大脑”装进14亿人口袋

在2026智诊科技AI发布会上,智诊科技完成蜕变。其发布的Wise MemOS 2.0打破传统局限,WiseDiag V2有深度多模态联合分析能力,WiseResearch让AI告别幻觉,“好伴AI”下放技术,服务大众。

AI寒武纪
产品应用7

自动化评测的九九归一——评测agent

本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。

阿里云开发者