有监督微调」共找到 6432 篇相关文章

算法论文8

微调已死!「共识机制」实现提示词自我进化,性能飙升

人工智能领域正从「模型微调」向「上下文工程」转变。西湖大学MAPLE实验室齐国君教授团队提出基于「共识机制」的提示词组进化算法C - Evolve,能突破单一提示词性能局限,提升系统整体性能。

量子位
新闻资讯8

一句话生成任务专属LoRA!Transformer作者创业公司颠覆LLM微调

Transformer作者之一创立的SakanaAI推出Text-to-LoRA(T2L),简化模型适配流程,省却繁琐微调。T2L参数压缩率达80%仅降1.2%准确率,零样本场景平均准确率78.3%超现SOTA方法,开启“一句话定制模型”时代。

量子位
算法论文8

DeepMind率先提出CoF:视频模型自己的思维链

DeepMind在Veo 3论文中提出帧链CoF概念,类比语言模型CoT,让视频模型能时空推理。实验显示Veo 3通用视觉理解能力,能零样本解决视觉任务,未来通用视频模型或取代专用模型。

量子位
产品应用7

马斯克4000亿布局Agent :杀死 Cursor,Bot 什么绝招?

马斯克花600亿美金买下AI编程产品Cursor俩月后,SpaceXAI发布Grok Bot。它定位特殊、可跨应用操作等,亮点是多智能体云端协作,但产品力与生态差距,定价高端。

鲸选AI
开源动态7

OpenMAIC:一键生成互动课堂,视频+PPT全都,还可以编辑

清华开源项目OpenMAIC是多智能体互动课堂,上传文档或描述主题,几分钟就能生成虚拟课堂,AI教授讲课、同学讨论,还白板功能。底层用LangGraph编排,支持主流模型,OpenClaw集成,架构完整。

AI工程化
算法论文8

微调已死?Google 和斯坦福论文指出AI 学习新范式

Google的ReasoningBank和斯坦福的ACE两篇新论文引发热议,二者都在解决让AI系统真正学会学习的问题。前者是经验管理系统,后者让输入上下文进化,都绕开微调探索AI持续学习与自我改进能力。

AI工程化
算法论文8

NeurIPS2025 Spotlight | RobustMerge: 多模态大模型高效微调模型合并的全新范式

中科院、中山大学、北大团队针对高效微调模型合并难题,提出「方向鲁棒性」概念,揭示 PEFT 模块合并失败主因,给出 RobustMerge 解决方案,提升性能,成果开源。

机器之心
新闻资讯7

失去三个联创后,Mira公司危机持续:又两人要出走

前OpenAI CTO Mira Murati创办的Thinking Machines Lab危机不断,此前三位联创离开,如今又两位技术骨干将出走,多家媒体称是OpenAI人才突袭,公司内部产品、发展等分歧或是主因。

机器之心
产品应用8

每天上线一个新系统,这款腾讯自用低代码什么不同

腾讯自用低代码平台无极,平均每天上线1.2个新系统,用户覆盖1/3员工。它去模板化,从数据结构设计开始,数据推导UI,灵活编辑器,支持渐进式开发,具备集成性和开放性,还AI赋能。

腾讯技术工程
产品应用7

数据库厂商入局AI又新思路,OceanBase选择“卖铲子”

国产数据库厂商 OceanBase 入局 AI 新思路,近期动作频频。其云数据库业务 OB Cloud 实现 AI 能力开发部署并与多平台集成,已在多行业落地。副总裁尹博学谈其 AI 战略逻辑、面临挑战及未来趋势等。

InfoQ