「垂类Agent训练」共找到 4583 篇相关文章
刚刚,“云计算一哥”版龙虾发布,奥特曼打着官司也要云站台
亚马逊云科技发布Amazon Quick,可连接本地文件等,打通生态,还是主动的Agent。奥特曼虽打官司仍云站台,OpenAI与亚马逊云深度合作。此外,Amazon Connect扩展成四个AI解决方案,发布会强调Agent是新企业操作系统。
LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了
华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效性与模型能力有关。
模型与「壳」的价值同时被低估?真格基金戴雨森 2025 AI 中场万字复盘
这是真格基金管理合伙人戴雨森2025年中对AI行业的半年度复盘。他从投资人视角,围绕OpenAI通用大模型达IMO金牌水准、ChatGPT Agent发布等热点,分享AI应用、模型、产品“壳”价值等看法,认为模型和应用价值被低估。
Manus卖给了Meta!年初火爆年底数十亿美元被收购
Meta和Manus官网宣布,Meta收购Manus以提升通用Agent能力。此次收购费用数十亿,是Meta第三大收购案。Manus产品以“通用Agent”为核心叙事,今年先爆火、融资,后迁总部,最终被收购。
一篇被证明“理论有误”的论文,拿下了ICML2025时间检验奖
2015年发表的Batch Normalization论文在ICML 2025会议获时间检验奖。它引用超6万次,推动了深层神经网络发展。虽2018年被指理论有误,但仍有新研究发现其对训练过程的根本影响。
中国具身模型狂揽全球第一!机器人的人类数据时代来了
00后带队的灵初智能用近10万小时人类数据拆解具身智能,1000小时数据开源。其发布Psi-R2和Psi-W0双系统架构,让Psi-R2登顶MolmoSpace榜单。灵初认为纯人类数据训练必要,还强调开源对具身智能落地重要。
Claude有的,国产也有!紫东太初科研龙虾ScienceClaw,已经把Harness卷进实验室
Claude发布的Managed Agents让“Agent Harness”概念受关注,而国内紫东太初ScienceClaw早有相关思路并落地。它全链条覆盖科研,能7x24小时优化,具透明执行优势,还覆盖通用场景,架构有创新。
小目标检测难点分析和解决策略
文章基于24年综述论文,分析小目标检测难点,如特征不足、难区分背景等,还给出主流改进方法,涉及数据增强、特征提取、特征融合、损失函数、训练策略等方面,介绍多种算法及效果。
沉迷贪吃蛇,7B小模型竟变身「数学天才」!几何推理碾压GPT-4o
NVIDIA等团队提出视觉游戏学习ViGaL范式,让7B多模态模型玩贪吃蛇等游戏,使其在数学、几何等任务击败GPT - 4o。游戏培养通用认知与推理能力,不同游戏提升不同推理能力,多游戏训练效果更佳。
林俊旸从阿里离开后首度发声:推理模型的时代快结束了
前通义千问Qwen负责人林俊旸离职后发长文,指出AI正从「推理思考」转向「智能体思考」,分析推理模型发展,谈混合思考模式失败,还提及智能体思考挑战及相关企业、学术界进展。