「新能安」共找到 7856 篇相关文章
又一款国产高性能GPU问世,实力对标海外巨头
2025年9月22日,芯动科技发布“风华3号”全功能GPU,它架构全面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。
刚刚,DeepSeek最新发文!V3/R1训练细节全公开,信息量巨大
网信办新规生效,DeepSeek回应,标注AI生成内容,公开V3/R1训练细节。介绍训练分预训练和优化训练,深挖数据使用,还谈及推理、开源情况,也提到对抗AI幻觉与滥用风险的措施。
无需外部数据!AI自问自答实现推理能力进化
卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。
R2没来,却等来综合性能更优的DeepSeek R1T2
抱抱脸热门排行榜出现R1变体模型DeepSeek-TNG-R1T2,构建于多个父模型之上,在智能与输出token长度间达新平衡点,速度快且测试表现佳,还给出与不同模型对比的选择建议。
LiteReality来了!用一张扫描图还原真实3D世界
剑桥大学提出 LiteReality,可将室内 RGB - D 扫描数据转为 3D 虚拟副本,支持多种图形渲染功能,适用于多领域。它通过多步骤流程重建场景,还引入新框架解决材质恢复问题,但也存在依赖人工等局限。
Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO
Meta和NYU研究强化学习在大模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。
这些关于研发提效的深度实践分享,值得每一位开发者关注 | AICon
6月27 - 28日AICon北京站上,多位大厂技术大牛将分享“AI赋能研发提效”经验。如丁宇介绍AI编程范式革新,张乐分享腾讯代码智能化实践,还有同程、百度、网易游戏相关人员分享研发提效经验。
WSL、Copilot皆重磅开源,深夜炸场的微软给我们带来了哪些惊喜?
今年微软 Build 2025 大会于 5 月 20 日凌晨开场,AI 是重要战略方向,‘开源’成关键词。大会有诸多亮点,如开源 Copilot 核心功能和 WSL,升级开发者工具,推出新智能体和平台等,还与多方探讨 AI 发展。
IJCAI 研究卓越奖得主 Nick Jennings:一个智能体的聪明,不如一群智能体的相遇|IJCAI 2026
8月18日,IJCAI 2026大会上,研究卓越奖得主Nick Jennings回顾智能体发展历程,指出当下智能体AI火热,它并非新概念,而是经数十年积累。还分享经验,展望从智能体到智能社会的未来。
不再止步于自然语言!PhiZero让世界模型学会「物理语言」
PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。