「多模态Scaling范式」共找到 1975 篇相关文章
低延迟、高吞吐,LLM优化与高效推理引擎综述
LLM计算成本高,用户要低延迟,企业要高吞吐。工程师开发优化技术,如动态批处理、KV缓存、模型量化。论文对比25款推理引擎,还探讨了多模态支持、手机端推理、新型架构支持等进化方向。
AI越用越聪明,自主+自进化是关键拼图丨盛大邓亚峰EverMind@AIGC2026
在AIGC2026峰会上,盛大集团邓亚峰指出,AI范式从Chat转向Agent,未来AI需“自主”与“自进化”,长期记忆是关键。EverMind团队基于此研发相关技术,成果显著,还提出个人记忆主权等观点。
DeepSeek出品,必是精品!DeepSeek-OCR 2发布:让LLM像人一样读懂复杂文档,效果超Gemini 3 Pro
DeepSeek推出DeepSeek-OCR 2,提出“视觉因果流”,以全新视觉编码器赋予模型因果推理能力。它在文档解析基准表现超Gemini 3 Pro,代码和模型权重已开源,为2D推理和原生多模态探索铺路。
LLM协作告别文本形式:直接“脑对脑”,Cache-to-Cache实现语义瞬时传输
现有多LLM系统依赖文本通信,效率低且易失真。论文提出Cache - to - Cache(C2C)范式,让LLMs通过KV - Cache“脑对脑”交流,实现高效精准语义传输,在多类任务中提升性能与效率。
经典之作!Agent无需奖励也能学习:通过“早期经验”的Agent Learning
该论文提出‘早期经验’范式,让智能体通过执行动作、观察结果状态学习,无需外部奖励。它能降低数据依赖,提升泛化与鲁棒性。实验显示,其在多样环境中效果出色,为智能体训练提供新思路。
老思维做 Agent,没戏!云厂商们又想憋大招了
企业落地 Agent 经历快速演化,自主性 Agent 成新趋势。云厂商起初推 AI Infra,现转以 Agent 应用为中心开启 Agent Infra 赛道竞争,虽已布局但新开发范式未成型,未来需产业链协作迭代。
刚刚,智元提出SOP,让VLA模型在真实世界实现可扩展的在线进化
智元具身研究中心提出SOP框架,可让VLA模型在真实世界实现可扩展的在线进化。它是颠覆性的机器人学习新范式,整合在线、分布式和多任务机制,构建闭环打破机器人认知时间边界。实验显示其性能优越。
博士学位答辩PPT分享 | 基于神经网络的偏微分方程优化求解方法研究
本文聚焦基于神经网络的偏微分方程优化求解方法,指出传统数值求解范式有局限,物理信息神经网络(PINNs)虽有潜力但面临瓶颈。作者从多方面研究,形成工程流动问题分析框架与改进方法。
从顶级三甲到医疗巨头,他们为何都选择同一个AI“大脑”?
AI医疗迎来爆发,政策、技术、需求共振催生千亿蓝海。智诊科技WiseDiag医学多模态大模型成医疗企业破局关键,它有三大核心能力,适配多场景,还有低风险接入方案,现开放API免费试用。
小扎开9位数薪酬新建AI团队!砸千亿收购华人初创公司,Llama 4太拉胯急坏了
Meta CEO扎克伯格对Llama 4表现失望,一边开7 - 9位数薪酬从谷歌、OpenAI等公司挖人组建新AI实验室,另一边豪掷148亿美元收购初创公司Scale AI 49%股份并挖来CEO,Llama 4在第三方测试中表现不佳。