「出行与生活」共找到 6673 篇相关文章
Agent不会搞科研?人大微软开源框架&工具包解决盲目试错通病,抱抱脸日榜第一
AI智能体虽能完成多项任务,但大多难以自主科研,易陷入盲目试错。人大和微软研究者提出Arbor框架与工具包,借助Hypothesis - Tree对优化空间结构化探索,多方面表现出色,荣登Huggingface日榜第一。
Kimi Work 推出目标模式:连肝 24 小时做了本漫画书,已开源
Kimi Work 推出目标模式,设定完成条件可自动工作至达标。与 Claude Code、Codex 有差异,还具 Agent 集群能力。作者用其复刻 Logo、转换论文格式、制作漫画书并开源,指出目标模式类似模型训练。
agent未来落地的收敛形态
当前agent开发变重,基模优化与agent开发脱钩。后续落地的技术收敛范式是将基模训练和agent开发有机结合,有模型更小、agent更智能、基模深入业务场景带来新想象力等好处。
龙虾连Gemma 4,只需三步,谷歌官方教程出炉,不再花钱买token
谷歌官方发布教程,教大家分三步将 Gemma 4 和龙虾(OpenClaw)连接。有人认为此流程清晰直接,让本地跑 Agent 变得简单。不过 Gemma 4 与顶尖模型有差距,且小模型安全性存疑。
MMLU已死?「人类最后考试」登Nature:全球AI模型集体不及格!
AI发展迅猛,现有基准测试难以跟上其步伐。近1000名研究人员组成的全球联盟创建「人类最后的考试」(HLE),涵盖多领域难题,目前最强AI准确率不足50%,凸显AI与人类专家的差距。
一封误发「死亡日历」,引爆亚马逊16000人大裁员
一份意外泄露的日历会议邀请提前引爆亚马逊裁员恐慌。官方宣布再裁约1.6万个岗位,涉及多业务。此次裁员是组织调整与效率革命,也受AI影响,凸显行业变革下普通人职业挑战。
前OpenAI CTO企业遭重创!办公室偷情致团队崩盘,核心3人叛逃OpenAI
2026年1月,前OpenAI CTO Mira Murati创办的Thinking Machines Lab遭遇重创。联合创始人Barret Zoph因办公室恋情被降职后逼宫索权,遭拒被开除,随后与两名骨干叛逃OpenAI。这揭示了AI人才战争的残酷。
社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式
大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。
端到端智驾新SOTA | KnowVal:懂法律道德、有价值观的智能驾驶系统
北京大学王勇涛团队提出新型自动驾驶系统 KnowVal,通过感知与知识检索模块协同实现视觉 - 语言推理。它构建驾驶知识图谱,有价值模型用于轨迹规划,实验在多基准测试表现佳,还通过定性分析验证效果。
Transformer已死?DeepMind正在押注另一条AGI路线
谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。