「大模型对齐」共找到 9257 篇相关文章
Qwen3.5实战教程:从0到1掌握本地部署与微调
阿里通义千问团队发布Qwen3.5系列小模型,打破“大模型=高成本”惯例。本文全面剖析该系列模型,涵盖核心特性、本地部署实战、模型微调实战,还给出技术细节与问题解决办法。
装机量超2000万、全球主流GPU与AI框架“开箱即用”!OpenCloudOS成AI时代优先选项
在大模型训练迭代快、算力需求高但 GPU 利用率低、生态碎片化的背景下,2025 OpenCloudOS 操作系统生态大会举办。OpenCloudOS 围绕 AI 升级技术,构建能力闭环,还发布智能基座,降低产业链技术摩擦。
刚刚,加入腾讯的姚顺雨发表首篇Paper~
腾讯混元与复旦联合发表论文《CL-bench》,姚顺雨署名并全面细致审阅反馈。CL-BENCH 首次单独考‘现学现卖’,有独特设计原则、四大题型,其评分杜绝‘差不多’,还让 10 个前沿模型‘翻车’。
14 岁清华天才、普林斯顿最年轻终身教授王梦迪:AI 尚未发现新的基础科学|附完整演讲
本文整理了普林斯顿大学终身教授王梦迪在2026外滩大会的演讲,分析当前大模型在科学发现上的核心局限,提出AI实现自主科学发现的路径,分享了团队的科研实践。
AI体育教练来了!中国团队打造SportsGPT,完成从数值评估到专业指导的智能转身
现有智能体育系统多停于‘打分+可视化’,通用大模型处理体育生物力学分析有局限。中国团队提出SportsGPT框架,实现从‘动作评估’到‘训练处方’智能闭环,各模块优势明显,超越基线。
DeepSeek-R2可能本月发布,使用华为AI芯片
Huaweicentral消息,搭载华为昇腾AI芯片的DeepSeek - R2可能8月15 - 30日发布,或媲美GPT - 5。它运行在昇腾910B芯片集群,参数规模达1.2万亿,将以低价提供API,冲击开源大模型市场。
第一批“首席龙虾官”,月薪6万
当下不少公司热招“龙虾官”,涵盖AI、医疗、房地产等多行业,薪资优厚。“首席龙虾官”负责推动公司AI Native转型,还有OpenClaw开发工程师等岗位,大模型、智能体技术正改变工作方式。
训练数据枯竭怎么办?首篇「数据价值密度」综述理清思路
上海交通大学与上海人工智能实验室团队发布首篇「数据价值密度」综述。提出“数据价值密度”概念并定义,建立分类框架梳理现有工作,还指出该领域面临的挑战,为大模型训练提供指南。
Nature新研究:AI竟然分不清事实和信念
斯坦福大学团队在Nature发表研究,测试15个大模型,发现其区分事实、信念和知识存在严重缺陷。如处理第一人称信念准确率低,对语言线索依赖高,在高风险领域应用令人担忧。
DeepResearch的概念、核心挑战与进化路径
华为、利物浦大学等研究者撰写综述文章《DEEP RESEARCH AGENTS》,梳理了DeepResearch进展。它由大语言模型驱动,超越RAG等现有技术,介绍其核心技术组件,指出面临的挑战并指明未来发展方向。