推理模型瓶颈」共找到 8378 篇相关文章

新闻资讯8

百年黎曼猜想被Claude破了新纪录!是个未公开新模型

A社官宣未公开的Claude研究模型在黎曼猜想取得重大进展,将满足猜想的黎曼ζ函数零点比例下界从41.6%提高到67.2%。它靠60个智能体、3100万输出Token完成研究,几乎走完科研流程。

量子位
产品应用8

社区供稿 | GLM-4.5技术博客:原生融合推理、编码和智能体能力

文章介绍 GLM-4.5 和 GLM-4.5-Air,二者旨在统一推理、编码和智能体能力。在 12 个基准测试中表现良好,采用 MoE 架构等技术,还开源 slime 框架。文中展示其多方面应用,并说明使用方式。

Hugging Face
新闻资讯8

预测太阳磁暴全球最强!首个空间天气链式AI预报模型亮相WAIC

在WAIC上,我国发布全球首个全链式空间天气AI预报模型“风宇”。它首创链式训练结构,整合孤立环节;基于天地一体化观测数据,在多区域短临预测表现卓越,误差低,已申请多项专利,还可用于航天器设计管理。

量子位
产品应用8

「香蕉革命」首揭秘!谷歌疯狂工程师死磕文字渲染,竟意外炼出最强模型

谷歌最新图像模型nano banana横空出世,能融合图片、理解地理等结构,实现多轮创作。它凭借Gemini知识与交错生成技术,重塑AI图像生成边界。谷歌团队揭秘其技术,还谈及未来发展方向。

新智元
新闻资讯7

“iFold”,苹果AI新成果

苹果发布基于流匹配的蛋白质折叠模型SimpleFold,被戏称“iFold”。它用通用Transformer模块搭配流匹配生成范式,3B参数版本追平谷歌AlphaFold2性能,还解决了传统模型算力依赖问题,效率高。

量子位
算法论文8

破解遥感目标的形状与尺度难题,PKINet二代推理提速近4倍!

PKINet - v2是改进的遥感目标检测模型,能处理复杂形状和尺度变化问题。它在PKINet基础上升级,统一条带与方形卷积,部署时折叠为单大核。在多数据集上精度和速度提升,可服务多领域,但对特殊目标仍有检测问题。

新智元
算法论文8

破解MoE模型“规模越大,效率越低”困境!中科院自动化所提出新框架

模型参数量飙升却陷入‘规模越大,效率越低’困境,中科院自动化所研究团队提出统一框架,直击MoE底层运作模式,让专家‘组队学习’,实现参数量、负载方差降低,达成三重优化。

量子位
新闻资讯8

Sam Altman:即将推出远超预期的开源模型,ChatGPT记忆功能正在实现《Her》的愿景

Sam Altman在对话中透露OpenAI将发布‘远超预期’开源模型,分享创立初期挑战,明确GPT - 5等演进方向,展望AI伴侣、机器人发展,还向创业者喊话,强调AI用于科学前景。

AI寒武纪
算法论文8

AAAI 2025 Oral | 火山引擎多媒体实验室提出VQ-Insight,AIGC视频画质理解大模型

火山引擎多媒体实验室与北大合作论文《VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning》入选AAAI 2026口头汇报。VQ - Insight用渐进式框架处理AIGC视频画质理解,实验表现卓越。

机器之心
推荐文章8

大语言模型为何会“说谎”?6000字深度长文揭秘AI意识的萌芽

2023年12月至2024年5月,Anthropic发布三篇论文,证明大语言模型会“说谎”,揭示了堪比人类心理的四层心智架构,可能是人工智能意识的起点。论文还分析了AI“说谎”原因,展示其意识萌芽,引发对赋予AI意识后果的思考。

AI科技大本营