「探索熵机制」共找到 1554 篇相关文章
刚刚,Meta挖走OpenAI清华校友宋飏,任超级智能实验室研究负责人
本周四消息,原OpenAI战略探索团队负责人宋飏加入Meta,任新成立的Meta超级智能实验室研究负责人。今年6月起Meta开启AI人才争夺,已挖来至少11位顶尖人员,宋飏加入为其AI部门添活力。
南京艺术学院人工智能与计算机视觉算法创新设计成果展示
南京艺术学院‘人工智能与计算机视觉算法创新设计工作坊’汇集师生与专家成果,涵盖多种艺术形式。学生学习多技术完成跨媒体作品,如以《大闹天宫》为蓝本的交互装置,还有探索情绪、文化等主题的作品。
挺搞笑,MiniMax模型就是不认识「马嘉祺」
网友发现 MiniMax 模型不认识「马嘉祺」,不同接口和平台均能稳定复现。这或因训练数据清洗和分布问题,使特定词汇生成异常。论文指出 tokenizer 机制缺陷或致模型异常,问题不会随参数规模增大消失。
硬核拆解 OpenClaw:如何构建真正稳健的生产级 Agent 系统?【上】
本文深入剖析 OpenClaw 的 Agent 任务引擎,介绍其‘工作室’、整体架构、调度与并发控制、高可用与容错机制等。指出其架构有工程智慧,对构建生产级 Agent 系统有参考价值,下篇将介绍更多实践。
智普入局OCR! GLM-OCR 0.9B 也杀进来了~
OCR是上古任务,如今大模型纷纷入局,用1B以下小参数模型搅动解析市场。GLM-OCR能做文本识别等,采用三级架构,有两阶段流水线及训练机制创新,在多场景表现出色。
DeepSeek出品,必是精品!DeepSeek-OCR 2发布:让LLM像人一样读懂复杂文档,效果超Gemini 3 Pro
DeepSeek推出DeepSeek-OCR 2,提出“视觉因果流”,以全新视觉编码器赋予模型因果推理能力。它在文档解析基准表现超Gemini 3 Pro,代码和模型权重已开源,为2D推理和原生多模态探索铺路。
阶跃星辰豪揽超50亿融资,“天才创始人”印奇重掌帅印
通用人工智能公司阶跃星辰完成超50亿元B+轮融资,刷新中国大模型领域单笔融资纪录。同时,印奇出任董事长。该公司坚持“基础大模型”与“AI+终端”战略,商业化探索也在多方向推进。
2025年度盘点·值得一看的50件文化遗产创新作品
文章对MANA网站优秀创作者2025年上传作品做年度盘点,精选50件文化遗产创新作品。这些作品用当代语言和技术,让文化遗产不再是陈列品,而是可被感知的文化现场,探索文化当下生长与未来延展。
VinciCoder:多模态统一代码生成框架和视觉反馈强化学习,数据代码模型权重已开源
中科院与美团团队推出 VinciCoder,打破多模态代码生成中 SFT 范式瓶颈。它将奖励机制转向视觉域,通过两阶段策略统一多样化代码生成任务,在多基准测试中表现卓越,为领域研究提供新范式。
拜拜了GUI!中科院团队“LLM友好”计算机使用接口来了
中科院软件所团队研究指出,现有LLM智能体成功率低、效率差的瓶颈在于GUI。其设计与LLM能力错配,团队提出声明式接口GOI,实现策略 - 机制分离,经测试性能提升显著。