「三重频域融合」共找到 1384 篇相关文章
DeepSeek-V3.2正式版发布,将开源模型的能力推向极致
DeepSeek-V3.2正式版开源,包含标准版和Special版。它采用稀疏注意力机制,降低计算复杂度。后训练阶段有多项算法改进,支撑高难度推理。还融合思考与工具使用,合成训练数据,在智能体评测表现优异。
瓦卡奖AI视觉创意大赛·从人工智能专家跨文化对话到全球AI厂商的竞技
10月17 - 19日,第二届瓦卡奖AI视觉创意大赛在深圳举行。期间AI全球视觉工作坊汇聚专家探讨AI与艺术融合,竞技日集结全球AI视频厂商民间团队参赛。大赛还发布国内首部《AI视觉创意应用蓝皮书》。
大模型顿悟原理!Meta新论文说清楚了
Meta超级智能实验室(FAIR)最新论文把大模型顿悟(grokking)现象的数学机制说清楚了。提出Li2数学框架,将两层神经网络的grokking动态分三阶段,还推导了泛化缩放定律等。
TDSQL Boundless:AI时代的多模态数据库
在AI与数据分析处理技术融合的当下,传统数据库架构面临诸多挑战。腾讯云TDSQL Boundless推出,通过统一架构处理多模态数据。本文从核心架构、关键技术特性及对未来数据平台建设的启示三方面解读。
让具身智能体拥有「空间感」!清华、北航联合提出类脑空间认知框架,导航、推理、做早餐样样精通
清华、北航联合提出类脑空间认知框架 BSC-Nav,让具身智能体有「空间感」。它克服现有导航方法记忆难题,有三大记忆组件,实验中性能碾压,能应对复杂任务,真机实测也表现出色。
“AI不是工具,是工人!” 英伟达GTC 2025,黄仁勋如是说
英伟达GTC 2025大会上,黄仁勋提出“AI不是工具,是会用工具的工人”,重新定义人类与技术关系。阐述AI产业本质、三大扩展定律,公布GPU路线图及新硬件,还将AI部署到多行业,构建全栈生态。
边画边想!多模态Reasoning迎来巨大提升!
论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)在空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,在五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。
阿里的未来,是通往超级人工智能
云栖大会上,阿里巴巴 CEO 吴泳铭演讲传达阿里对 AI 发展判断与战略规划。他认为 AGI 非终点,ASI 是目标,并提出实现三阶段。还指出阿里抓住大模型和 AI Cloud 支点,要把通义千问打造成 AI 时代 Android 系统。
每周2亿年轻人用ChatGPT,却连高手的零头都没用出来
全球超2亿18 - 24岁年轻人用ChatGPT,高阶用户调用能力仅为超级用户1% - 10%。OpenAI推出三款教育插件,分别针对K - 12老师、大学老师和大学生,还搭建教育闭环,不过教学权仍在教师、学校和政府手中。
GPT-5编程测评大反转!表面不及格,实际63.1%的任务没交卷,全算上成绩比Claude高一倍
Scale AI的新软件工程基准SWE - BENCH PRO测试中,‘御三家’表面解决率低。深入看,GPT - 5已提交任务准确率比Claude高一倍。该基准新题多、更复杂,能真实考验模型能力,当前模型解决商业问题能力有限。