「算法与神经网络」共找到 6864 篇相关文章
Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!
国内独角兽月之暗面发布并开源 Kimi K2 模型,推出两天就在 OpenRouter 平台 token 使用量超 xAI 的 Grok 4。它成本低、性能强,编码能力追平 Claude 4,架构与 DeepSeek 相似,技术研究也多次‘撞车’。
RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异
清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。
CVPR 2026 | 给扩散模型装上「物理引擎」: 北大彭宇新团队提出NS-Diff,使扩散模型学会流体与刚体力学
北大彭宇新团队提出 NS - Diff,将物理约束与强化学习结合,解决视频生成物理失真问题。它通过多模块提升视频物理真实感,实验表明在多数据集上超现有方法,降低物理运动误差。
南大等8家单位,38页、400+参考文献,物理模拟器与世界模型驱动的机器人具身智能综述
当下,具身智能成研究热点。南大等8家单位学者撰写综述论文,指出物理模拟器与世界模型融合是实现具身智能的潜力路径。论文系统梳理两者协同推动机器人演进全貌,还提出分级标准等内容。
只训练数学,却在物理化学生物战胜o1!新强化学习算法带来显著性能提升,还缓解训练崩溃问题
上海创智学院、上海AI Lab的MM - Eureka系列工作提出新强化学习算法CPGD,缓解训练崩溃问题,提升性能。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。
因果发现大模型迎来「理论破局」: DAG-FM 破解异质机制下的因果图识别与涌现难题 | GAIR Paper 116
浙大、清华与稳准智能联合发布因果发现大模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果图可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。
壁仞中昊芯英行云集成电路都来了!中国AI算力大会6月举办,聚焦推理算力、AIDC、异构混训与超节点
2025中国AI算力大会6月26日在北京举行,是“智领未来”活动之一。大会设主、分会场与展览区,解构AI算力变局。公布主、分会场嘉宾阵容,含中昊芯英、中科加禾等创始人,报名火热进行中。
中科院信工所发布首篇LLM智能体幻觉综述!梳理5类幻觉、18大诱因与10种缓解方案,300+论文资源开源
中科院信工所等机构团队发布首篇聚焦LLM智能体幻觉的综述,厘清其与传统语言幻觉区别,提出5类幻觉分类体系和18大触发原因,给出10种缓解策略,还开源300+论文库并指明未来研究方向。
Token售卖已无溢价、大模型公司转型“系统商”?记忆张量 CTO 李志宇:智能体能力会拉开差距,长期记忆与状态管理成竞争核心
InfoQ 采访记忆张量 CTO 李志宇,他指出 Scaling up 经济效益下降,大模型公司正变系统公司,核心是长期记忆与状态管理能力。2026 年若模型无代际差,价格战或加剧。智能体是主赛道,但现有模型推理能力不足。
Meta华人实习生搞出超级智能体!自己写代码实现自我进化
Meta研究团队论文结合哥德尔机思想与达尔文开放算法,提出达尔文哥德尔机,进而定义超级智能体Hyperagents。它能持续自我迭代,实现元学习,实验证明其能有效自我提升,且改进有迁移性。