「大模型自信问题」共找到 9547 篇相关文章
Sutton判定「LLM是死胡同」后,新访谈揭示AI困境
强化学习之父Rich Sutton直言LLM是死胡同,因其无法从持续实际互动中学习,违背他坚持的原则。在新访谈和圆桌讨论中,多位专家碰撞观点,探讨AI研究问题、强化学习困境及LLM发展走向等。
Mira Murati 创业公司首发长文,尝试解决 LLM 推理的不确定性难题
OpenAI前CTO Mira Murati创立的Thinking Machines Lab首发文章《克服LLM推理中的不确定性》,指出大语言模型推理难获可复现结果,深入探究其不确定性根源,提出使核函数具备批次不变性的方法并给出实现与实验。
菲尔兹奖得主都栽了!Claude终结78年悬案,或成最重要AI数学成果
78年数学难题“六维球面上有无复结构”被哈佛数学家Levent Alpöge和Claude解决,他们绕开老路造出答案,还给出108页论证,数学家挑不出毛病。Alpöge在35天内三次用AI破难题,这次性质不同,是模型创造新对象。
「Memory as a Context」是否将重新定义 Transformer 的 「记忆模式」?
本期机器之心PRO会员通讯解读3个AI业内要事,包括「Memory as a Context」能否重新定义Transformer记忆模式、世界模型发展情况,以及OpenRouter联合a16z发布的《State of AI》报告。详细探讨了谷歌Titans架构及其理论框架MIRAS,还提及业界对LLM记忆力的改进方案。
全网爆火的DeepSeek「UE8M0 FP8」,原来英伟达早已支持
NVIDIA PTX ISA文档早有.ue8m0数据类型,UE8M0 fp8并非DeepSeek独创。从PTX 8.0/9.0起,NVIDIA在ISA级别支持.ue8m0,H100、RTX 40系列等都有相关支持,DeepSeek是将其提升到模型层面。
Meta华人天才毕树超「叛逃」预言:OpenAI未竟交互革命,暗藏万亿赛道
Meta科学家毕树超在演讲中揭秘AI进化真突破,认为更好更快造数据是关键。他指出AI原生交互领域若有新突破,或催生万亿级公司,语音和视觉将成重要部分,还分享了AI进化时间线及面临的问题和未来图景。
构建会思考的测试Agent:从自动化到自主智能的演进
文章介绍面向企业级软件测试的质量数字人系统,结合大语言模型等实现从传统到自主智能测试跨越。分析专有云测试困境,指出通用AI Agent平台局限,阐述系统设计、能力及架构,展示应用成果并展望扩展场景与未来计划。
“光靠人盯不住了”!拆解上万张晶圆,这家公司靠AI将芯片良率提升数个百分点
喆塔科技创始人赵文政称国内跑通AI的半导体工厂少,工业AI尚处发展阶段。喆塔将DeepSeek接入自研大模型,提升训练效率。还分享了团队实例,强调工业AI决胜点在行业知识。此外,介绍了喆塔切入AI领域的过程、应用成果、面临挑战及未来策略等。
480P的元宇宙入口:Midjourney不是在做视频,是在造"任意门"
Midjourney发布首个视频模型Video V1,它只能图生视频,操作便捷。虽分辨率仅480P,但采样率高。生成成本低,会员就能用。其美学表现好、生成速度快,不过在提示词理解等方面较弱。该公司有独特愿景。
对话智源王仲远:具身智能“小组赛”才刚刚开打,机器人需要“安卓”而非 iOS
智源研究院院长王仲远在对话中指出大语言模型发展遇瓶颈,AI 需走向物理世界。智源推出“悟界”系列,试图打破具身智能“循环悖论”,做具身智能的“安卓”,还提出大小脑协同策略,认为具身智能“小组赛”未结束。