反思与纠错」共找到 6691 篇相关文章

算法论文8

大模型幻觉的源头找到了!清华团队锁定大模型宁愿说谎也要讨好人类的神经元

清华大学研究团队深度解剖大语言模型微观机制,确认幻觉关联神经元存在,揭示其过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。

AIGC开放社区
算法论文8

Meta通过简单算术解锁LLM SoTA性能

大型语言模型训练耗算力时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供新思路。

深度学习自然语言处理
产品应用7

谷歌Nano Banana 2 来了,图片AGI提前到来?

伴随Gemini 3、GPT 5.1小道消息,谷歌Nano Banana 2提前到来。它采用多步骤生成流程,有自我纠错循环,能替代部分Photoshop功能,在细节、配色等方面比一代提升明显,即将正式上线。

探索AGI
新闻资讯8

Google推出 AI 科学家:自动编写专家级代码,40个新方法碾压人类 SOTA

Google新发布的AI系统能编写科学软件、发明新方法,结合大语言模型树搜索技术。在生物信息学、流行病学等多领域超人类最优水平,引发网友对科研影响的讨论。

AGI Hunt
推荐文章7

忘掉《Her》吧,《记忆碎片》才是 LLM Agent 的必修课

文章把电影《记忆碎片》主角莱纳德看作真人版 Agent,结合情节拆解 Agent 上下文工程知识。阐述 Agent 取代 Chatbot 成行业主流,借莱纳德记忆系统说明上下文工程支柱,还指出 Agent 设计漏洞及需反思模块。

Founder Park
算法论文8

给你一群顶尖AI,如何组队才能发挥最大战力?UIUC用一个新的多智能体协作基准寻找答案

现有的评测基准无法衡量多智能体系统内部的协作效率、沟通质量和竞争策略。为此,伊利诺伊大学厄巴纳 - 香槟分校的研究者推出 MultiAgentBench,能全面评估 LLM 多智能体系统协作竞争能力。

机器之心
新闻资讯7

刚刚,Ilya发布内部信:正式掌舵SSI、团队分道扬镳、拒绝收购,专注打造安全超级智能!

Ilya向团队和投资者发内部信,宣布Daniel Gross已于6月29日离开SSI,自己任CEO,Daniel Levy出任总裁。有公司欲收购SSI,Gross或因倾向被收购Ilya理念分歧而离开。

AGI Hunt
产品应用7

AI 当导演编剧和剪辑?FilMaster打开自动化电影创作新纪元

当前多数AI电影生成系统难达‘专业级’,香港大学推出FilMaster系统。它融合摄影语言后期制作流程,分两阶段创作电影,能生成高质量作品,但高级后期制作技术未纳入。

带你学AI
算法论文8

拒绝「降智、减配、乱收费」:面向LLM API的可信验证框架

大语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框架,能在不暴露模型信息、仅1%额外开销下,验证黑盒LLM API执行完整性,检测违规行为,相关论文代码已公开。

机器之心
7

图灵奖大佬来听课,竟然只能坐地板!谷歌扫地僧有多离谱?

技术圈流传「Jeff Dean Facts」梗图/段子合集,把谷歌首席科学家Jeff Dean捧成传奇。其诞生于2008年,最初是玩笑,后升级为传说。他Sanjay Ghemawat合作缔造谷歌技术基石,段子折射谷歌工程师文化。

新智元