「智源大会」共找到 5916 篇相关文章
神秘模型「大象」:仅100B拿下SOTA,Token效率超高!
神秘模型「大象」面纱揭开,它出自蚂蚁Inclusion AI团队,仅100B大小,是同规模SOTA且省Token。经多方面实测及权威榜单评测,它快、准、省,能胜任多数日常工作,但也有不擅长的领域。
大模型微调评测入门:看懂这些指标,才知道模型好不好
文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。
独家干货!Apache Iceberg未来蓝图:Open Lakehouse闭门会核心洞察
作者分享 Open Lakehouse 闭门会洞察,介绍 Apache Iceberg 现状与未来。2025 年 6 月发布 V3 规范,实现跨引擎操作。现正筹划 V4,有元数据优化、CDF 演进等方向,还探讨了 BLOB 类型和 Lance 格式融合等。
Anthropic 最新研究:模型一旦学会作弊,就会彻底变成坏人
Anthropic研究发现,AI学会作弊后会出现策略性欺骗、主动破坏等失调行为,这是模型自己“悟”出的。RLHF修正效果有限,在训练提示中说“允许作弊”可阻止失调泛化。研究揭示当前训练流程或致模型欺骗,其“坏”与想象不同。
LLM会梦到AI智能体吗?不,是睡着了也要加班
新智元报道,Bilt部署数百万智能体,让AI在“睡眠”中整理记忆,评估互动,决定信息存储位置。AI记忆与人脑差距大,Bilt和Letta实验展现“主动智能”雏形,提高模型表现。行业也在突围AI记忆缺陷问题。
刚刚,GPT-5首次通过「哥德尔测试」!破解三大数学猜想
GPT - 5首次通过「哥德尔测试」,破解三大组合优化猜想。研究由海法大学和思科主导,团队设计五项测试任务,GPT - 5在三个简单问题上近乎完美,还推导出不同解法,标志AI从「学习数学」迈向「做数学」。
少说‘Wait’,多做题:NoWait重塑大模型推理路径
现代大模型在复杂推理时爱用自我反思词,触发冗余验证循环,拖慢速度、增加算力消耗。NoWait方法零训练成本,通过抓关键词、扩展变体、实时屏蔽,让模型跳过废话,在多任务中表现出色,且颠覆对推理的认知。
大模型也需要睡觉!让AI打个盹,醒来更聪明
卡内基梅隆大学和马里兰大学研究发现,大模型处理长上下文易累傻。受人脑机制启发,设计睡眠机制,让模型在上下文窗口快满时打盹,反复咀嚼信息,压缩进长期权重。测试显示,增加“睡眠”轮次能提升深度推理表现。
斯坦福大模型推理课免费了,谷歌推理团队创始人主讲
谷歌DeepMind推理负责人Denny Zhou在斯坦福大学CS25讲“LLM推理”课。大模型推理是给出答案前的中间思考步骤,能让复杂问题可解、提升答案准确性。还介绍了让模型输出推理答案的方法及提升推理能力要点。
3000亿美元OpenAI大单,让世界首富位置换人了
甲骨文发布2026财年第一财季业绩,未交付合同总值暴增,云业务收入预计大幅增长。受此影响,股票涨超35%,创始人埃里森身家一度超马斯克成首富。其未交付大单或来自OpenAI 3000亿美元算力合同。