「计划+行动范式」共找到 1648 篇相关文章
ERNIE 5.0:走向原生统一的万亿参数多模态基础模型
过去多模态模型‘拼接式’方案存在理解与生成割裂问题,ERNIE 5.0 借此提出,用统一自回归框架做多模态理解与生成,在架构、训练与系统层面有创新,评测中各模态能力表现出色。
《多模态大语言模型技术发展报告》正式发布 | 中科算网算泥社区
2月5日,中科算网算泥社区发布《多模态大语言模型技术发展报告》。报告回顾多模态大模型发展历程,剖析核心技术创新,展示应用实践,分析挑战与机遇,为各界提供参考,推动多模态AI技术发展。
AI远征太空!马斯克SpaceX收购xAI,估值1.25万亿美元
彭博社报道,马斯克的SpaceX收购xAI,新公司估值约1.25万亿美元。当前AI发展受地面数据中心资源限制,天基AI是规模化唯一途径,马斯克将整合多领域送入太空。
首钢园“产业跃升俱乐部”首秀:从WANOS全景声到波萝元宇宙
首钢园“产业跃升俱乐部”首期轮值活动“从WANOS全景声到波萝元宇宙”成功举办,标志开启月度轮值新机制。活动汇聚各方精英,探索创新驱动产业跃升路径,展示波萝元宇宙成果,还围绕技术与投资议题讨论。
Nature发表、Science点赞!清华揭秘AI让科学家走捷径却让科学走窄路
清华大学基于超4100万篇论文研究发现,AI虽提升科学家个人产出与职业进程,却使科学探索领域变窄固化。研究发表于Nature,被Science深度报道,揭示了AI在科学发展中的利弊。
梁文锋署名新论文,DeepSeek V4架构首曝?直击Transformer致命缺陷
新智元报道,梁文锋署名的DeepSeek新论文提出全新Engram模块,解决Transformer记忆难题。论文联手北大提出与MoE互补的“条件记忆”稀疏轴,通过Engram模块实现近似O(1)的确定性知识查找,或成稀疏LLM主流路线,下一代V4可能集成该方法。
深度拆解:如何在 LangChain DeepAgents 中复现 Claude 的 Skills 机制 ?
本文探讨在LangChain的DeepAgents框架复现Claude的Skills机制。先回顾Skills,它是Anthropic提出的Agent能力注入方式,有渐进式加载特点。接着介绍让通用框架支持Skills的环节,最后测试验证其效果和收益。
50万个AI生成的应用,正在赚钱
在2025秒哒创造者大会上可知,“三无”AI生成应用已诞生50万个商业应用,覆盖200多个细分领域。如“荣堂古村数字博物馆”等,它们变现能力强。秒哒是相关工具,操作简单,技术体系完整。
谢赛宁与Jaakkola团队重磅研究:无数据Flow Map蒸馏
麻省理工学院Tommi Jaakkola和纽约大学谢赛宁团队联合研究,提出无需数据、仅从先验分布采样实现flow map蒸馏的新方法。该方法可规避“教师 - 数据不匹配”风险,在ImageNet实验中表现出色。
AI应用开发与落地实践:从“能用”到“好用”的惊险一跃
本文深入剖析2025年AI应用开发四大核心范式与实践。涵盖AI Agent爆发、RAG技术深化、垂直AI落地及多模态应用,为开发者提供实战指南,助其将技术转化为成功产品。