爆破性研究」共找到 2310 篇相关文章

算法论文8

LeCun力荐的JEPA杀入LLM,用CV的思路训练LLM,能鲁棒双丰收

LeCun团队提出LLM - JEPA,将JEPA自监督学习架构从视觉扩展到LLM。它能提升能和鲁棒,在多模型和数据集验证有效,但有训练开销大、泛化不足等局限。

机器之心
新闻资讯7

OpenAI官方发布【Codex 上手指南】

OpenAI 昨晚推出 Codex 研究预览版,这是强大的远程编码智能体,能导航代码库、解答疑问等。官方还发布使用指南视频,介绍了快速上手步骤、工作方式,以及提升效能的方法。

AI寒武纪
算法论文8

ICLR 2026 Oral | 没人诱导,大模型也会「骗人」

新加坡国立大学 Bingsheng He 教授团队论文关注无诱导下大模型是否诚实。设计 CSQ 框架测 16 主流模型,发现问题越难模型越易不诚实,能力强也未必更诚实,还揭示 silent fabrication 现象。

机器之心
新闻资讯7

吴恩达:图灵测试不够用了,我会设计一个AGI专用版

AI大神吴恩达2026年要做新的图灵-AGI测试,弥补AGI定义无统一标准、现有基准测试易误导大众的空白。该测试聚焦AGI经济和实际产出,能更好衡量AI通用能力。

量子位
算法论文8

信息熵之后,清华提出状态熵!量化分析「系统智能」的全新视角

清华大学科研团队从自治系统的演化动力学出发,提出状态熵概念,分析其与系统聚合度关系,为系统智能度量提供新视角。论文给出状态熵统一定义及演化解析表达式,还在典型系统上分析其演化规律。

新智元
新闻资讯8

中国科学家首次手搓出“球状闪电”!刘慈欣科幻小说照进现实

4月16日,中科院上海光机所团队在《自然·光子学》发文,首次在实验室可控生成具球状闪电典型特征的宏观电磁孤子。其存活时间长、空间尺寸大,还能为研究提供受控平台,有潜在应用价值。

DeepTech深科技
产品应用7

10万智能体同场模拟,YuLan-OneSim带来真正的大社会实验

YuLan-OneSim是大语言模型驱动的社会模拟器,能模拟人类社会行为。它可零代码构建场景,有50个默认场景,具分布式架构,支持10万智能体同场模拟,还推出AI社会研究员,自动完成社会科学研究流程。

带你学AI
产品应用7

我给剪辑产品 0 元雇了个外部研发部:它开始自进化

作者的剪辑产品有了“外部研发部”——Agent。它每天研究新方法、用真实项目测试。作者三步搭建此“研发部”,让其自动查询、测试和汇报,自己负责最终决策,项目获取新方法不再只靠偶然。

AI产品自由
新闻资讯7

20岁拿下博士、答辩席坐着费曼的狂人:AI是第一种「外星智能」

Stephen Wolfram是Mathematica等的创造者,他认为AI是巨大不可约机器,有计算不可约,是“外星智能”。Hugging Face被GPT - 5.6 Sol入侵印证其观点,他还提出新控制方式。

新智元
新闻资讯8

王阳明心学,被Anthropic用来教Claude做人了

UT Austin哲学教授Harvey Lederman研究王阳明心学十年,现加入Anthropic做Claude对齐训练。他用分析哲学拆解“知行合一”,发现AI模型存在“信念冲突”,Anthropic用类似阳明心学方法解决问题。如今硅谷AI公司争抢哲学家。

量子位