「大模型效率」共找到 9839 篇相关文章
国产手机正从底层重构安卓!vivo版AI OS亮相了
在vivo开发者大会上,OriginOS 6正式亮相,AI功能全面更新,还首次上线Live Photo的AI消除。它用自研技术重构安卓底层核心,首发蓝河流畅引擎,从计算、显示、存储三大模块优化。
一文读懂DeepSeek-V3.2核心技术DSA:API疯狂降价性能不减的背后
DeepSeek发布实验模型DeepSeek V3.2,引入自研稀疏注意力机制DSA,API价格最高降75%。DSA先筛选后计算,含闪电索引器和稀疏多潜在注意力两组件,分四步工作,权衡了精确性与速度。
亚马逊100万机器人上岗!即将超越人类员工?机器人军团接管工作
亚马逊仓库迎来第100万个机器人,其机器人数量快与人类员工平分秋色。从机械臂到AI驱动的Vulcan,物流效率提升25%。公司推出DeepFleet优化路径,还让机器人与订单系统对接,但也引发裁员担忧。
实测完豆包Seedream 4.5,替我设计师朋友哭了
火山引擎推出图像创作模型Doubao - Seedream - 4.5,有强化原图保持、多图组合生成、优化海报排版与Logo设计等主打点。经实测效果不错,已全量开放API并公测,官方还给出生图tips。
一文带你彻底理解AIGC、Agent、MCP的概念和关系
本文为非AI开发者科普AIGC、Agent、MCP概念和关系。AIGC用AI生成内容;Agent可自主决策调用工具;MCP是Anthropic开源协议,降低模型与工具集成成本,获大厂支持。
训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD
清华大学THU-IDM团队与慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,预测难度,开销低、动态适应且平衡探索利用,在多任务表现佳,降本增效,有新范式。
“心内推理”:一种动态多模态潜在空间推理范式 | 直播预约
当前多模态大模型推理效率低、稳定性不足。本次分享将介绍DMLR,它无需额外训练,仅在推理阶段生效,通过在潜空间优化潜在思考token、引入关键视觉信息,实现高效稳定的多模态推理。
AI不再「炫技」,淘宝要让技术解决用户每一个具体问题
技术发展迅速,淘宝力求将AI融入应用场景解决用户问题。今年3月升级AIGX技术体系,近日郑波公开淘宝全模态大模型进展,认为狭义AGI或5 - 10年到来,多模态智能成关键技术域。
BLIP3-o统一图像生成与理解,多模态融合趋势显现
BLIP3 - o致力于统一图像理解和生成,提升生成质量与效率。它融合自回归和扩散模型,采用CLIP + Flow Matching架构等。经训练,在图像理解和生成任务表现佳,指令微调效果显著。
清华、西交联合开源发布了Cheers : 一条更简洁、更高效的统一多模态路线
清华、西交联合开源发布CHEERS,提出面向统一多模态理解与生成的架构路线,在保持系统简洁前提下,统一理解与生成任务,继承开源预训练模型知识,在多项基准测试中表现优异,还实现4× token压缩。