从零训练」共找到 4868 篇相关文章

产品应用7

飞猪搭建系统演进:人工运营到多Agent协同搭投生产

飞猪移动端页面搭建体系初代寄生于阿里集团平台,发展成“搭投”体系。但传统人工选搭投模式待优化,为此启动AI智能搭投升级专项,构建新范式,还介绍产品结构、技术实现及后续规划。

InfoQ
算法论文8

无需训练的3D生成加速新思路:西湖大学提出Fast3Dcache

在AIGC浪潮中,3D生成模型虽进化快,但‘慢’和计算量大制约其应用。西湖大学AGI实验室提出无需训练、即插即用的Fast3Dcache框架,能在加速同时保持或提升模型几何质量。

量子位
开源动态8

开源即屠榜!UniME多模态框架登顶MMEB全球训练榜,刷新多项SOTA纪录

格灵深瞳等团队联合发布通用多模态嵌入新框架UniME,刷新MMEB训练榜纪录。它是两阶段框架,经文本判别知识蒸馏和困难负样本增强指令微调,在多任务达SOTA,项目已开源。

量子位
算法论文8

蚂蚁VLDB最佳论文:用一张“逻辑表”驯服3050亿条训练数据

蚂蚁集团论文《OmniTable: A Unified Wide-Table System for Petabyte-Scale LLM Data Curation and Exploration》获VLDB工业赛道最佳论文。其研发的OmniTable系统能管理超35PB、3050亿条以上训练数据,解决数据准备难题,如在SFT任务中大幅缩短周期。

量子位
新闻资讯8

机器狗腿被锯了也能继续走!最新机器人大脑来自320亿估值独角兽

Skild AI推出Skild Brain机器人大脑,它在虚拟环境训练相当于一千年时间成型。此模型没在对应机器人训练,控制能力是涌现的,能应对肢体断裂、马达卡住等情况,还可完成精细动作。

量子位
推荐文章7

AI 基础知识-1到0.1:带你走进机器学习的世界

文章沿着AI发展脉络,Seq2Seq到GPT模型,深入介绍关键技术原理。以简明方式梳理AI基础概念,涵盖人工智能、机器学习等定义,还介绍了各类学习方法、特征工程及向量化等内容,最后提及模型应用流程和Quick BI助力企业分析。

阿里云开发者
新闻资讯7

Claude隐形水印回望GenAI时代信息隐藏:嵌入水印如何保证无损?

2026年Anthropic新版Claude模型嵌入隐形水印,引发对水印是否伤模型的质疑。可证安全隐写理论为解决此问题提供支撑,中科大等团队取得诸多成果,将“可证无损”内容延伸到模型,还探讨了水印攻防。

新智元
产品应用7

Copilot 到 通用 Agent : 阿里在 AI Coding 上的应用和挑战

阿里巴巴代码平台负责人向邦宇在 QCon 大会分享阿里智能研发大模型应用与挑战。介绍探索成果,如代码补全、审查等功能;指出面临用户需求理解、领域知识整合等难题;还提及技术进步带来新机遇,促使 Copilot 向 Agent 转变。

InfoQ
算法论文8

高潮第几秒开始?GaMMA 让多模态大模型真正「听懂」音乐时间线

现有多模态大模型难以理解音乐时间线。复旦大学与字节跳动团队提出 GaMMA,采用双编码器融合网络,经三阶段训练,还推出 MusicBench 评测基准。实验显示,GaMMA 在多基准上表现优异,刷新 SOTA。

机器之心
算法论文8

75%预训练数据都能删!Jeff Dean新作:全自动筛除低质量数据

Google DeepMind团队开发的DataRater可全自动评估数据质量,用元学习筛选有价值数据,提升模型训练效率。它能减少计算量、提高性能,在低质量数据集效果佳,还能跨模型规模泛化。

新智元