从零训练」共找到 4868 篇相关文章

开源动态8

百度Qianfan-VL开源,纯国产自研昆仑芯跑出世界一流

百度开源全新视觉理解模型Qianfan-VL,有3B、8B和70B三个版本,在昆仑芯P800芯片上训练。该模型多模态能力强,OCR和教育场景表现突出,跑分超国际主流模型。芯片功耗低、架构优,模型训练方法创新。

AIGC开放社区
新闻资讯8

阿里权力交接全解读:9人出局、蒋凡上位、3800亿豪赌AI—投资者必读深度研报

过去两年,阿里经历权力重组,合伙人缩减,蒋凡上位,吴泳铭押注3800亿AI。“分封制”回归“集权制”、运营驱动转向AI驱动,本文拆解变革,给出投资判断,分析各业务板块营收、竞争力,推演未来情景并提示风险。

AI Reading Hub
开源动态8

The Batch: 873 | 通过自监督学习实现更好得图像处理

Meta等团队发布DINOv3权重和训练代码,参数规模扩6倍,用更多数据并引入新损失函数。它在图像分割和深度估计表现卓越,解决了自监督训练的视觉transformer的问题,提升全局和局部任务表现。

DeeplearningAI
推荐文章8

工业革命看AI对就业的冲击:脑力劳动贬值、结构性失业、生产力提升、财富再分配

文章短期、中期、长期分析AI对就业的影响,指出短期部分白领岗位受冲击,中期职业结构重构,长期会面临财富分配难题。还提到AI会造成结构性失业,解决分配问题很关键。

AI Reading Hub
产品应用8

小红书提出社交大模型RedOne 2.0:兼听、敏行

在SNS内容爆炸式增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交大模型,采用以RL为核心的三阶段渐进式训练方法,实验显示其性能优异,还能转化商业价值。

量子位
开源动态8

世界模型和具身大脑最新突破:90%生成数据,VLA性能暴涨300%|开源

国产世界模型玩家获突破,VLA模型性能涨300%,90%训练数据由世界模型生成。极佳视界开源GigaWorld - 0及训练框架,在多方面优化,经对比性能领先,还验证其生成数据对具身任务的提升作用。

量子位
算法论文8

千万级标注成本归!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

以往空间音频模型受限于采集条件和标注成本,清华和密西根大学团队在CVPR 2025给出新路径,利用相机自运动作监督信号,让模型互联网视频学三维空间音频感知,成果入选会议Highlight。

量子位
8

谷歌公开全新极限压缩算法:LLM提速8倍、内存占用狂降6倍,精度损失

谷歌推出全新量化算法 TurboQuant,瞄准大模型键值缓存吃内存、高维向量搜索算力瓶颈痛点,能砍内存、提速度且精度损失。分 PolarQuant 和 QJL 两步,实验数据表现优异,将改变搜索格局。

AI寒武纪
推荐文章8

Transformer到Agent:生成式AI行业技术路线与职业发展指南,深度解析AI价值链

文章深度解析生成式AI行业,介绍其宏观图景、商业运作、行业定位与战略考量。指出行业价值链呈“杠铃”形态,应用层机会大,还提及盈利模式、岗位薪酬、开源闭源之争等,为业者提供职业指南。

AI Reading Hub
推荐文章7

8种LLM架构设计大比拼: DeepSeek-V3 到 Kimi K2,究竟有啥不同

文章对比了8种LLM架构设计,如DeepSeek-V3、OLMo 2等。介绍各模型关键技术,像DeepSeek-V3的多头潜在注意力和混合专家架构,还分析不同设计对性能、效率的影响,助读者了解LLM架构差异。

CourseAI