预训练策略」共找到 2851 篇相关文章

产品应用8

华为Doc-Researcher 布局感知+视觉语义双杀

现有深度研究系统依赖文本网页数据,忽视多模态文档知识。华为Doc - Researcher系统解决多模态文档解析不足、检索策略有限、缺乏深度研究能力等问题,含多模块,能处理复杂多模态任务。

CourseAI
开源动态8

Hugging Face 推出 GOLD:让不同模型家族也能做知识蒸馏

Hugging Face研究团队提出GOLD方法,解决了知识蒸馏中老师和学生模型需用同一套分词器的痛点,让不同模型家族间也能做知识蒸馏。它通过三步解决跨分词器蒸馏,实验效果良好,已集成到TRL库。

AI工程化
算法论文8

ICCV 2025 | 港科、牛津大学发布AlignGuard,文图生成模型可规模化安全对齐框架

随着文图生成模型广泛应用,其安全防护机制有限。ICCV 2025上,港科、牛津大学推出AlignGuard,是文图生成模型可规模化安全对齐框架,通过生成CoProV2数据集等实现安全对齐,实验效果佳。

机器之心
推荐文章7

AI时代,为什么你又焦虑又学不进去?这个人破解了专注力的秘密

文章指出AI时代人们学不进去,原因在于信息爆炸、AI工具易致分心,本质是没学会处理学习不适。介绍了Time Boxing、“10分钟法则”等应对方法,强调专注力是新学习力,要先规划建立学习系统。

花叔
算法论文8

一个模型装下整个物种树!伯克利GPN-Star斩获基因测双料冠军

加州大学伯克利分校等机构推出基因组语言模型GPN - Star,可将全基因组比对和物种树信息装进大模型。它克服传统GLMs短板,实现三点升级,在多基准测试表现出色,是强大的全基因组变异解读框架。

新智元
产品应用7

RAG性能优化:基于RAGFlow自定义解析工具实现文本结构化(含源码教学)

文章围绕RAG性能优化展开,指出RAGFlow框架中DeepDoc解析算法不足,介绍开源与商业化解析工具优劣势及API调用和本地部署特点,推荐TextIn xParse,给出RAGFlow+TextIn知识库构建方法,还探讨了RAG优化方案。

AINLPer
新闻资讯7

他,37岁华裔,靠AI成为福布斯400最年轻亿万富翁,身价180亿美金!

37岁华裔Edwin Chen成《福布斯400》最年轻亿万富翁,身价180亿美元。他拒绝VC融资,用积蓄打造估值300亿美元的AI数据标注公司Surge,希望让AI学会「人类的复杂性」,还担忧AI模型被错误优化。

新智元
算法论文7

The Batch: 881 | 一千万 token 的输入上下文

Google的Ali Behrouz等人设计“记忆模块”集成到类transformer架构ATLAS,能处理一千万token输入。它替代注意力层,训练后在长上下文任务中表现佳,但小模型,大规模表现未知。

DeeplearningAI
产品应用8

重构开发体验:CodeFuse 智能代码助手的设计与实践

蚂蚁集团技术专家牛俊龙在 QCon 大会分享 CodeFuse 智能代码助手架构设计与实践,介绍本地核心服务设计策略,结合案例优化其 AI 能力,还分享落地经验、教训与未来发展路径。

InfoQ
推荐文章8

OpenAI 最新报告:让团队变得 AI Native 的五大原则

OpenAI 发布白皮书《Staying ahead in the age of AI》,基于与国际大公司合作经验,提炼出让团队变得 AI Native 的五大原则,即对齐、激活、放大、加速、治理,还给出各原则策略及反思问题。

特工宇宙