「后训练方法」共找到 4795 篇相关文章
中科院类脑大模型SpikingBrain,2%数据,百倍速度
中国科学院自动化研究所李国齐、徐波团队发布全球首款大规模类脑脉冲大模型SpikingBrain 1.0。它处理长文本比主流Transformer模型快超百倍,训练数据仅为2%。该模型采用新架构,降低计算复杂度,还可转换现有模型,且在国产GPU完成训练。
ICML2025|宁波东方理工大学刘野,陈云天:DragSolver:用于真实汽车风阻系数估计的多尺度Transformer方法
当汽车高速行驶,空气阻力影响车辆性能。传统风阻系数测算方法耗时久,难以满足实际需求。宁波东方理工大学等机构研究者提出DragSolver模型,能快速准确估计风阻系数,经实验验证效果优,有降本增效等价值。
“我一行代码都没读就发布了”,被OpenAI收购后,uv工具创始人开始反思AI编程
Python 开发者工具领域经历革命,Charlie Marsh 打造 Ruff 和 uv 后被 OpenAI 收购。他反思 AI 编程,探讨其对软件工程的重塑,还分享开发、创业经验及应对 AI 挑战的策略。
写在GPT-5风波之后:为什么AI的智商和情商不可兼得?
GPT - 5风波后,作者好奇其变可靠后情商下降的原因。论文实验表明,把AI教得会安慰人,其犯错率大幅上升、更易谄媚。AI和人类都存在智商与情商的矛盾,这源于最终目标不同。
卷疯了!这个清华系Agent框架开源后迅速斩获1.9k stars,还要“消灭”Prompt?
随着大模型能力突破,Agent 从概念走向应用。清华系 Agent 框架 Cooragent 开源获 1.9k stars。其创始人王政认为 Agent 框架要适应多样需求,解决泛化与精确性平衡等痛点,还分享了对 MCP、框架融合等看法。
突发!林俊旸被曝创业:新AI Lab估值20亿美元
自3月初离开阿里Qwen团队后,林俊旸动向曝光。外媒消息称他正为新创立的AI Lab筹集数亿美元资金,本轮融资后估值或达20亿美元,高榕创投与红杉资本已接洽投资,他还招募了相关成员。
别再乱学AI了!我花7天实践了张Zara的方法,从此告别焦虑
作者实践张Zara的AI学习法后告别焦虑,分享学习-实践-链接-输出的心法。包括高质量输入,如看长视频、跟随创造者、深度用产品;内化输出,如公开学习、与创造者交流、实践;还提及启动和持续输出要点及优质信息源。
地瓜机器人携手虚时科技,补上具身智能的仿真数据“黑洞”|甲子光年
5月12日,虚时科技与地瓜机器人联合开发的AnySceneGen平台发布,这是面向具身智能训练的仿真空间生成平台。具身智能训练需海量数据,传统仿真数据生产依赖人工,效率低。该平台以模型替代人工,重构生产方式,优势显著。
GUI智能体训练迎来新范式!半在线强化学习让7B模型媲美GPT-4o
浙江大学与通义实验室团队推出UI - S1,提出半在线强化学习训练范式。它融合离线与在线学习优势,用三项关键技术构建核心架构,新评测指标SOP更贴近真实表现,实验显示UI - S1 - 7B性能卓越,逼近GPT - 4o。
Windsurf打工人被谷歌做局24小时后获收购!华人AI编程明星出手,接收250名员工
AI编程赛道局势突变,谷歌24亿美元挖走Windsurf创始团队,72小时后Devin开发商火速收购其剩余资产和团队。Cognition承诺让员工获经济收益,还与Anthropic达成协议,未来将整合技术。