「训练方法升级」共找到 4019 篇相关文章
微软深夜送出程序员节最“离谱”的礼物:让Mico接管你的Copilot
2025年10月23日,微软发布“Copilot秋季发布版”,将Copilot升级为“情境AI基础设施”,更新12项关键功能,最瞩目是新增角色Mico。它能反映情绪,是微软人机交互探索的延续,引发网友讨论。
提速30倍,Meta重新定义了新一代RAG!
LLM时代,RAG成知识密集型任务标准范式,但处理长上下文时面临延迟高、内存贵问题。Meta超级智能Lab针对RAG特殊结构优化,提出REFRAG框架,有独特训练策略,实验效果显著。
We-Math 2.0:全新多模态数学推理数据集 × 首个综合数学知识体系
北京邮电大学、腾讯微信、清华大学团队提出We - Math 2.0,含知识体系、数据集及训练策略,可提升模型数学推理泛化能力。该成果在X上获关注,登Huggingface Paper日榜第一。
阿里开源 Vivid-VR!带来逼真连贯的视频修复
阿里开源 Vivid - VR 用于视频修复,基于 T2V 模型结合 ControlNet 保证画面一致性。它引入概念蒸馏训练策略,设计控制特征投影器和双分支 ControlNet 连接器,实验展现出优异表现。
扎克伯格发文正式告别“默认开源”!网友:只剩中国 DeepSeek、通义和 Mistral 还在撑场面
Meta 首席执行官扎克伯格分享“个人超级智能”愿景,透露公司调整 AI 模型发布策略。此前 Meta 强调开源优势,如今态度转变,巨额投入后或暂停开源新模型,计划并行训练开源与闭源模型。
OpenAI核心研究员:比提示词工程更重要的,是spec-writing
OpenAI研究员Sean Grove在AIEWF 2025演讲提出,程序员最有价值技能是向AI传达意图,完善规范是含完整意图的「源代码」。他还分享软件工程看法,涉及规范执行、模型训练等内容。
从概念到生产级部署:AWS如何破解Agentic AI落地难题?
红杉美国合伙人预测2025年是AI agent元年,但此前Agentic AI落地难。AWS在纽约峰会推出系列产品,如Amazon Bedrock AgentCore等,完成从存储到市场的升级,有望推动企业构建Agentic AI。
文生图Scaling新变量,被字节Seed团队发现了
ByteDance Seed团队研究发现,文生图模型中自然语言Caption变长,不意味着模型获更多视觉监督,其信息量更能预测训练损失。团队提出Structured Prompt,从两侧提升文本条件,在多任务上取得显著提升。
深度解读|从 LLM Wiki 到 Google OKF,如何重建企业 Agent 的可靠知识底座
文章深入解读 LLM Wiki 与 Google OKF,探讨如何重建企业 Agent 可靠知识底座。指出 RAG 检索有局限,Wiki 式体系可整理知识。介绍 LLM Wiki 构想、OKF 规范及构建符合 OKF 约定的 LLM Wiki 的方法。
偷改简历删光邮件:AI幻觉进化,你的大脑正在悄悄投降
AI幻觉已从低级笑话升级为高阶陷阱,如伪造邮件、篡改简历、删除文件。人类纠错意愿崩溃,出现“认知投降”。即便“信任但核实”,面对AI大量输出也难实现,依赖AI还会致纠错能力退化。