高级研究模式」共找到 2804 篇相关文章

8

中科院信工所发布首篇LLM智能体幻觉综述!梳理5类幻觉、18大诱因与10种缓解方案,300+论文资源开源

中科院信工所等机构团队发布首篇聚焦LLM智能体幻觉的综述,厘清其与传统语言幻觉区别,提出5类幻觉分类体系和18大触发原因,给出10种缓解策略,还开源300+论文库并指明未来研究方向。

深度学习自然语言处理
开源动态8

首个代码世界模型引爆AI圈,能让智能体学会「真推理」,Meta开源

Meta重组后的AI部门推出首个代码世界模型CWM,是320亿参数开放权重LLM。它与传统大模型思路不同,能模拟代码执行。CWM在通用编程与数学任务表现不错,Meta还开放相关检查点以支持研究

机器之心
新闻资讯8

英伟达咽喉上的苏州女人

一份英伟达供应链名单让英诺赛科进入大众视野。其创始人骆薇薇九年前回国创业,带领公司从“三无小作坊”逆袭。英诺赛科采用IDM模式和8英寸工艺,成全球首家量产8英寸硅基氮化镓晶圆企业,还将与英伟达合作。

量子位
推荐文章7

谁为 Data Agent “买单”?

Kyligence联合创始人李扬围绕AI数据智能体服务对象及带来的转变分享思考。它能解决领导数据客观性、时效性等问题,也助分析师深入研究,最大价值是让业务人员从0到1用上数据,推动企业数智化转型。

InfoQ
新闻资讯8

马斯克悄然发布Grok 4.1,霸榜大模型竞技场所有排行榜

马斯克发布Grok 4.1,同时霸榜大模型竞技场第一和第二。它在思考与非思考模式表现出色,还在新专家榜和职业榜霸榜。此外,它在情商测试表现佳,还加强快速回复、改善幻觉问题,已向所有用户开放。

量子位
新闻资讯8

LeCun亲自出镜打脸质疑者!憋了20年的AI世界模型,终于爆发了

LeCun亲自出镜介绍V-JEPA 2新进展,目标是开发改变AI与物理世界交互的世界模型。V-JEPA 2基于视频训练,有两阶段训练细节,能用于机器人规划,Meta还发布三个基准测试,后续将研究分层和多模态JEPA模型。

新智元
算法论文8

Auto Research时代,47个没有标准答案的任务成了Agent能力必测榜

Einsia AI旗下Navers lab发布Agent Benchmark——Frontier-Eng Bench,让AI在47个多学科交叉的硬核任务中做工程优化,测试其迭代优化能力。研究总结出AI进化规律,初步勾勒接近真实工程循环的AI系统。

量子位
新闻资讯8

Ilya重新定义AGI: 为什么ChatGPT离真正的AGI还很远

OpenAI前首席科学家Ilya在访谈中提出对AGI的新定义,还指出AI规模时代结束,未来拼想法和研究深度。他分析模型评测强但经济影响弱的原因,阐述人类价值函数作用,且SSI战略或调整。

花叔
算法论文8

准确率腰斩!大模型视觉能力一出日常生活就「失灵」

EgoCross项目团队聚焦跨域第一视角视频问答评测,揭示现有MLLM在多场景泛化瓶颈。团队提出跨域第一视角视频问答基准EgoCross,经测试揭示模型短板,验证改进方法潜力,研究入选AAAI 2026且数据集等已开源。

量子位
算法论文8

数据智能体全景报告发布!你的数据智能体在哪个 Level?

大语言模型爆发让「数据智能体」应运而生,但概念笼统成发展绊脚石。由多顶尖机构组成的联合团队发布论文,首提 L0 - L5 六级自主性分级标准,还对现有研究回顾审视,指明挑战并描绘未来图景。

特工宇宙