扩展计算」共找到 1086 篇相关文章

新闻资讯7

OpenAI研究大模型对GDP贡献,三大行业已能代替人类,并自曝不敌Claude

OpenAI推出新评估方法GDPval,跟踪模型在现实任务表现。评估显示前沿模型接近专家水平,Claude Opus 4.1表现最佳,GPT - 5准确性出色。还发布黄金子集和评分服务,其处于起步阶段将持续扩展

机器之心
算法论文8

扩散模型自引导新范式:直接交换token就能变强! | CVPR‘26 Oral

上海交大和vivo研究者提出自交换引导(SSG),不依赖文本条件、不加噪声、不改模型,只交换token特征。在多数据集实验中,SSG表现超现有方法。不过,其缺理论支撑、计算开销大。

量子位
新闻资讯7

Scaling Laws起源于1993年?OpenAI总裁:深度学习的根本已揭秘

人工智能扩展定律(Scaling Laws)把模型性能和资源投入联系,是构建大模型的参考标尺。其起源说法不一,康奈尔博士生将其推至1993年贝尔实验室论文,OpenAI总裁称它揭示深度学习根本。

机器之心
开源动态7

重磅!微软宣布开源Copilot!Cursor:完了!

5月19日微软VS Code团队宣布完全开源其AI编辑器功能,将把GitHub Copilot Chat扩展代码以MIT许可开源并重构到VS Code核心。此决定受AI开发领域变化推动,在开发者社区引发争议。

AGI Hunt
产品应用8

破解300年数学难题,智能体大突破!谷歌发布超强AI Agent

今天凌晨谷歌Deepmind发布编程AI Agent——AlphaEvolve,它与Gemini深度集成,能评估算法。它解决了300多年的数学难题,还提出新算法,提升大模型计算效率,可优化GPU指令,架构含多模块。

AIGC开放社区
算法论文8

多模态大模型,真的「懂」世界吗?——揭秘 MLLM 的核心知识缺陷

ICML 2025高分论文揭示MLLM核心认知盲区。研究发现主流MLLM缺乏核心认知能力,且不能靠规模扩展自然习得。作者构建测评体系CoreCognition,提出干预测试方法Concept Hacking,还给出关键发现与启示。

机器之心
推荐文章7

【博客转载】CUDA Kernel Execution Overlap

文章讨论CUDA kernel执行重叠,指出有足够计算资源时可重叠,通过调整`blocks_per_grid`值,观察到不同并行化程度。还提到隐式同步会影响重叠,可启用`per-thread` default Stream 禁用。

GiantPandaLLM
算法论文7

基于风雷软件的NF3数字风洞

在第四届智能流体力学产业联合体大会发布的数字孪生风洞「风神NF3」相关技术在《太阳能学报》发表。基于风雷软件构建西北工业大学NF - 3数字风洞,可自动生成网格、高效计算,实现飞行器翼型数值模拟自动化和业务化运行。

力学与人工智能
算法论文8

ICML 2025 | M+框架来了,增加LLM隐空间记忆,不再受上下文窗口限制

本文提出M+长期隐空间记忆扩展框架,在MemoryLLM之上,将8B级模型有效记忆跨度从不到20k提升到160k+,显存占用不变。它解决了现有记忆模型冗余、冲突难解等问题,为下一代语言模型提供支撑。

机器之心
新闻资讯7

英伟达斥资50亿美元入股英特尔

18日,英伟达与英特尔宣布深度合作,联合开发产品。英伟达将斥资50亿美元入股英特尔,双方以NVLink技术连接架构,合作聚焦数据中心和个人计算领域,旨在提升运行效率,填补产品空白。

芯师爷