「大模型微调」共找到 9352 篇相关文章
谢赛宁×李飞飞×LeCun首次联手!寒武纪-S「空间超感知」AI震撼登场
Yann LeCun、李飞飞和谢赛宁联手发布论文「Cambrian - S:迈向视频中的空间超感知」。他们认为LLM虽能力强,但无法像人类一样感知世界,为此构建Cambrian - S系列模型,开源相关数据和模型,还开发了新原型。
Nano Banana 拉爆谷歌营收创纪录,劈柴哥开心坏了!幕后团队曝内部“绝对优先事项清单”
谷歌CEO宣布单季营收破1000亿美元,Gemini月活达6.5亿。Nano Banana模型功不可没,其下载量飙升带动Gemini。幕后团队透露其诞生过程,还探讨AI对艺术创作影响、模型发展方向及未来迭代重点等。
招聘最猛的竟不是OpenAI!这家陷入间谍案的HR初创,正在狂招工程师
自2022年11月ChatGPT推出,美国技术岗变化大。虽裁员潮缓解但新增岗位有限,竞争激烈。资深职位主导招聘,AI工程师需求旺,旧金山湾区优势明显,大厂任职年限拉长,远程岗位比例下降。
让机器人学会系统2慢思考,叠衣服倒咖啡等不在话下 | 上海交大&智元机器人
上海交通大学与智元机器人等团队推出Hume——融合系统2慢思考的双系统VLA模型。它结合深度推理与实时控制,在多种机器人平台实验中表现出色,平均成功率达91%,显著超越现有模型。
AMD新论文颠覆认知:FP4训练不稳定,原因不是随机性不足
大模型训练成本高,降低训练精度可降成本。AMD联合宾州州立大学论文颠覆认知,揭示FP4训练不稳定源于结构性微缩放误差,非随机性不足,还在原生FP4硬件完成大模型预训练。
Anthropic 哲学家首次 AMA:关于 AI 哲学与伦理边界
Anthropic的哲学家Amanda Askell在首次AMA中,就AI哲学与伦理边界等诸多问题作答,涉及AI道德决策、模型特点、理论与实践、模型福祉等内容,还谈及对各类问题的看法及解决思路。
5亿热钱砸向具身智能新玩家!地平线VP创业,余凯又投了
具身智能赛道火热,无界动力获5亿天使轮融资。其创始人张玉峰是前地平线副总裁,团队实力强。此轮融资将加速基础模型研发与专家模型落地,公司首代机器人平台已在两方向突破。
OpenAI新幻觉论文惹争议!GPT-5拉胯是测试基准有问题??
OpenAI新论文《语言模型为何会产生幻觉?》提出,模型有幻觉是因标准训练和评估流程倾向奖励“猜对”。GPT - 5不爱猜测,在榜单表现不佳,网友质疑论文是为GPT - 5挽尊,论文引发网友多方向讨论。
实战·Agentic 上下文工程(上):无需微调,让智能体自我学习与进化
在Agent时代,提示工程进化成上下文工程。斯坦福等团队提出Agentic Context Engineering(ACE),让智能体自我学习与进化。文章介绍了上下文工程的必要性、定义、常见策略,以及ACE的概念、原理与架构。
「微调已死」再添筹码,谷歌扩展AI自我进化范式,成功经验与失败教训双向学习
近期,‘微调已死’言论引关注。谷歌《ReasoningBank: Scaling Agent Self - Evolving with Reasoning Memory》论文提出类似概念,可让智能体从自身成败经验学习,还引入MaTTS,实验显示其有效性和效率优于基准方法。