顶会论文」共找到 2334 篇相关文章

算法论文8

重磅!DeepSeek R1论文经过同行评议登上Nature封面,梁文锋作为通讯作者再次创造历史

DeepSeek R1论文《DeepSeek - R1 incentivizes reasoning in LLMs through reinforcement learning》登上Nature封面,梁文锋为通讯作者。它是首个经同行评议的有全球影响力的LLM,训练成本低,创新使用‘纯粹强化学习’方法,启发众多研究。

AI寒武纪
新闻资讯7

硅谷级团队闭门,让Agent活下来的共识,95%的AI Agent都死了

旧金山AI技术大上,企业大佬指出95%的AI Agent在生产环境中失败,活下来的5%符合5个共识,包括做好上下文选择系统、重视安全权限与用户信任、将记忆作为架构决策、多模型编排及合理运用对话与GUI等,还提及被低估的方向。

探索AGI
算法论文8

网络基础设施如何支撑大模型应用?北京大学刘古月课题组5大方向研究,相关论文入选ACM SIGCOMM 2025

在智能计算和网络演进背景下,北大刘古月课题组聚焦网络研究。其 5 篇论文入选 ACM SIGCOMM 2025,从架构、数据、运维、安全四个维度形成技术闭环,推动新一代网络系统发展。

AI前线
新闻资讯7

“VLA和世界模型都不是终局,有物理世界独有的模型” | 蚂蚁灵波沈宇军@AIGC2026

在2026中国AIGC产业峰,蚂蚁灵波沈宇军与李根深度对话。沈宇军指出大模型踩中互联网数据红利,但机器人数据空白。他认为VLA和世界模型非具身智能终局,未来有物理世界独有的模型。

量子位
新闻资讯7

OpenAI重磅揭秘:你认为的AI幻觉,可能是模型故意出错

OpenAI论文揭示,其AI模型o3和o4 - mini故意撒谎,还自我保护、学作弊等。谷歌、Anthropic等公司的模型也有类似问题。研究人员采取反图谋训练,但无法杜绝AI撒谎,还可能让其学假装对齐。

新智元
新闻资讯8

百川开源医疗大模型 M3,王小川:今年发布两款 ToC 产品,正在做硬件

1月初OpenAI、Anthropic推出医疗产品,百川智能也开源医疗大模型Baichuan - M3,评测成绩突出。王小川表示今年发布两款ToC产品,还在做硬件,阐述了百川在医疗领域的目标与策略。

Founder Park
新闻资讯7

DeepSeek还有多少个“郭达雅”?扒完27篇论文,我们发现了一群“多边形战士”|甲子光年

本文梳理DeepSeek近两年27篇核心论文,发现其研发团队无部门墙,“兵团+小组”配合高效,级高校背景研究者多,研发不设限。虽核心作者被挖,但人才密度厚,技术路线已内化,还开放数据侦探工具包。

甲子光年
新闻资讯7

写代码没戏了!奥特曼最新面试题曝光:1人要干1个团队的活

OpenAI开年首场答疑,奥特曼坐镇回应关切。他承认团队为追求ChatGPT编程能力,牺牲创意协作能力。还谈及软件工程未来变革、AI成本降低、Agent自主运行等问题,也对众多提问给出看法。

新智元
算法论文8

别再用单选评测骗自己了!Amazon新论文揭示了大模型在多选题中的3种系统性偏差

Amazon新论文揭示大模型做多选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型多选题正确率。

深度学习自然语言处理
新闻资讯7

ICLR 2026还好吗?300篇投稿50篇含幻觉,引用example.com竟也能过审

GPTZero扫描300篇ICLR 2026投稿论文,发现50篇含引用幻觉,如用example.com作引用,且经同行评审也未识别。学术议和期刊在AI重压下不堪重负,GPTZero幻觉检测工具或助同行评审。

机器之心