「训练方法升级」共找到 4036 篇相关文章
起猛了,追觅的扫地机、割草机、洗护机器人在CES成精了!
在AI浪潮下,具身智能正加速涌入家用场景。追觅在CES带来多款「具身智能」产品,如洗护、割草、扫地等机器人,它们能自主决策执行任务,或成具身智能家庭化量产进程最快的公司。
Transformer已死?DeepMind正在押注另一条AGI路线
谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。
Manus卖给了Meta!年初火爆年底数十亿美元被收购
Meta和Manus官网宣布,Meta收购Manus以提升通用Agent能力。此次收购费用数十亿,是Meta第三大收购案。Manus产品以“通用Agent”为核心叙事,今年先爆火、融资,后迁总部,最终被收购。
AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型
文本提示图像分割技术有战略意义,但基于监督式微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。
模型大一统?1100多个模型殊途同归,指向一个「通用子空间」!
约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间。此研究为神经网络参数空间“通用性”提供严谨实证,虽成因待探索,但意义深远。
陶哲轩震撼!数学家1975年埋下的「坑」,被AI和全球网友用48小时填平了
2025年12月,困扰数学界50年的Erdos#1026问题被攻克。陶哲轩宣布,在AI辅助下人类团队仅用48小时就完成证明。传统方法可能需数周甚至数月,AI带来全新理解,生成了新数学洞见。
GPT-5.2发布,OpenAI十周年纪念版更新。
OpenAI在成立十周年之际发布GPT-5.2。此次更新让其在真实工作场景更实用,包括PPT/表格制作能力升级、前端编码能力惊艳、视觉能力细节处理更强、工具调用意识领先等。
谷歌最新版「深度研究」反击GPT-5.2
GPT - 5.2发布前,谷歌推出新版Gemini Deep Research Agent,基于Gemini 3 Pro构建,功能强大。还开源DeepSearchQA,推出交互API。此外,DeepMind与英国政府合作,在城市规划、科学研究、网络安全等多领域应用AI技术。
全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案
随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。
DeepSeek V3到V3.2的进化之路,一文看全
知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5和Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域和知识。