多步推理」共找到 5651 篇相关文章

算法论文8

综述:LLM 驱动AI Agent通信协议与策略

文章指出传统互联网用户完成行程繁琐,而代理互联网可让代理自动完成。随着LLM驱动智能体应用深入,其发展专业化,需智能体协同,有效通信成关键。介绍了智能体通信定义、分类及种通信协议。

CourseAI
推荐文章7

AI们数不清六根手指,这事没那么简单。

作者测试发现Grok4、OpenAI o3等模态模型都将六指图数成五指,仅Claude 4偶尔答对。研究揭示大模型看图片用记忆而非视觉,易受刻板印象影响,在工业等场景或引发严重后果。

数字生命卡兹克
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在模态基准测试中表现优异,尤其小规模模型性能突出。

新智元
产品应用7

Proactor AI:首个自主行动的AI 智能体,无需唤醒,就能主动识别对面是个骗子

Proactor AI v1.0发布,号称是世界首个「自主行动」的AI队友。它能感知、思考并自主行动,如识别骗局。还提供主动式AI服务,应用场景广泛,用户反响热烈,带来人机交互范式转变。

AGI Hunt
算法论文8

集成20+先进算法,优于GPT-4o,自主因果分析智能体来了

加利福尼亚大学圣迭戈分校研究团队提出自主因果分析智能体 Causal - Copilot,集成超 20 种算法。它解决因果分析使用门槛高、预训练模型有局限等问题,性能优于 GPT - 4o ,已开源邀全球研究者参与。

机器之心
算法论文8

大模型时代,通用视觉模型将何去何从?

过去通用视觉模型(VGM)是研究热点,想实现‘视觉模型大一统’。但大语言模型发展使研究热点转移,视觉‘独立性’被重新定义。清华鲁继文团队综述梳理其进展,探讨现状、挑战与应用潜力。

机器之心
算法论文8

UofT、UBC、MIT和复旦等联合发布:扩散模型驱动的异常检测与生成全面综述

大学、麻省理工学院等高校研究者合作完成长文综述,聚焦扩散模型在异常检测与生成领域的应用,梳理图像、视频等异常检测任务进展,提供分类体系,展望未来趋势。

机器之心
7

OpenAI连丢4位大将!Ilya合作者/o1核心贡献者加入Meta,苏黎世三人组回应跳槽:集体做出的选择

OpenAI连失4员大将,Trapit Bansal跳槽Meta,继续研究推理大模型;苏黎世三人组Lucas Beyer等也加入Meta。此外,Meta还在洽谈收购语音AI初创公司PlayAI,连续布局语音AI。

量子位
开源动态8

谷歌开源Gemma 3n:2G内存就能跑,100亿参数内最强模态模型

本周五凌晨,谷歌正式发布、开源全新端侧模态大模型 Gemma 3n。它有模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在方面实现质量提升。

机器之心
新闻资讯8

刚刚,何恺明官宣入职谷歌DeepMind!

AI大神何恺明正式入职谷歌DeepMind担任杰出科学家,同时保留MIT终身副教授身份。他因提出ResNet名震江湖,研究成果且获奖无数,今年也成果不断,将助力DeepMind的AGI目标。

新智元