多模态处理能力」共找到 4442 篇相关文章

产品应用8

面壁MiniCPM-SALA模型,稀疏-线性注意力,单卡吞吐百万上下文

面壁智能团队提出SALA,基于此训练的MiniCPM-SALA模型,在单张A6000显卡实现百万token超长上下文推理,训练成本降约75%。它结合稀疏与线性注意力,采用混合架构,继承权重降低成本,在长文本处理上优势明显。

AIGC开放社区
新闻资讯8

碾压小扎!22岁成亿万富翁,2025年AI造富速度刷新人类认知

2025年AI成超级造富机,将50多位创始人送入亿万富翁俱乐部。从大模型到应用层,AI渗透生活。巨额融资不断,巨头砸钱建基建,人才争夺激烈,多模态初创公司也受青睐,职场AI使用比例上升。

新智元
推荐文章7

《AI时代下,中国低/零代码市场发展研究》报告正式发布 | LowCode低码时代

《AI时代下,中国低/零代码市场发展研究》报告发布,指出低/零代码技术渗透率提升,主流厂商提供全链路方案。生成式AI与低/零代码融合成趋势,市场稳定增长,企业对平台综合能力要求提高。

AIGC开放社区
7

AI公司创始人现跑路迪拜!80%收入烧广告、假账骗投资人,微软都被坑:硅谷的第一个AI大泡沫出现了!

AI独角兽公司Builder.ai估值15亿美元,现破产清算。创始人Sachin Dev Duggal跑路迪拜,公司花80%收入宣传,还用假账骗投资。此前就被指无AI能力,靠人工开发。当下虚假AI盛行,多家相关公司涉欺诈。

AI前线
算法论文7

高效大规模创新3D重建模型iLRM

多数基于Transformer架构的模型处理多视图输入有可扩展性问题,成均馆大学、延世大学研究人员提出创新3D重建模型iLRM。它通过迭代细化机制生成3D高斯表示,有独特架构设计和高效注意力机制。

AIGC开放社区
产品应用8

kimi 的RL end2end ON LLM

文章分享Kimi Researcher背后技术思考,采用端到端强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍多应用场景。

Agent的潜意识
产品应用8

阿里发布新一代千问旗舰模型Qwen3.7-Max,登顶最佳国产模型

5月20日,阿里发布新一代千问旗舰模型Qwen3.7 - Max。近三月千问迭代三次,Qwen3.7 - Max在多测评中表现优异,位列国产模型第一。它强化编程等能力,阿里还通过MaaS等连接各环节,布局AI基础设施。

InfoQ
开源动态8

OpenClaw 能“边用边训”了:智能体强化学习训练框架 AReaL v1.0 稳定版发布

3月4日,蚂蚁集团联合清华发布开源强化学习训练框架AReaL v1.0稳定版,主打‘Agent一键接入RL训练’。它解决现有智能体框架接入训练成本高、缺乏持续进化能力的问题,还推出原生训练引擎Archon,集成AI辅助开发体系。

InfoQ
推荐文章8

听了Andrej Karpathy最新2小时访谈,我对Agent彻底祛魅了

Andrej Karpathy在播客中表示,Agent发展还需十年,离像实习生工作还差很远,要解决诸多能力问题;他认为强化学习糟糕但其他方法更糟,还提出AI应削减背书式记忆、未来强大AI或仅十亿参数等观点。

MacTalk
算法论文8

3D高斯泼溅,可输入视图量高达500!推理速度提升3倍,内存少80%

ZPressor能高效压缩3D高斯泼溅(3DGS)模型的多视图输入,解决其在处理密集视图时的性能瓶颈。它基于信息瓶颈原理,分三步压缩信息,降低内存占用和推理时间,提升3DGS在高视图输入下的性能。

新智元