「新推理模型」共找到 9688 篇相关文章
135 个项目、七大趋势、三大赛道:撕开大模型开源生态真相,你会怎么卷?
在开发者大会密集登场之际,5月27日蚂蚁集团开源团队发布《2025大模型开源开发生态全景图》。展示135个项目、七大趋势、三大赛道,剖析开源生态现状与变化,揭示应用重塑和生态位博弈。
最低仅需2G显存,谷歌开源端侧模型刷新竞技场纪录,原生支持图像视频
今天凌晨,谷歌官宣Gemma 3n,原生支持多模态。它在大模型竞技场超1300分,是首个超此分数的10B以下模型。其VRAM占用低,最低2GB,已在谷歌AI Studio等可用,还公开了技术细节。
80%到25%逆转!大模型代码能力最新排名:Anthropic不再是唯一的神?
OpenRouter网站有模型使用排行榜,按不同使用场景分类。2024年12月到2025年2月,Anthropic模型编程流量占比曾达80%,后谷歌Gemini 2.5 Pro等抢占份额,其跌至25%以下,Claude 4发布后份额回升。还介绍了OpenRouter特点。
新天终启,万象智生!从AlphaGo到GPT-5,新智元十年见证ASI创世纪
2025年AI飞速发展,大模型发布密集,如OpenAI、谷歌等有诸多成果,中国造大模型也表现出色。新智元9月7日将举办十周年峰会,邀多位嘉宾探讨前沿突破,还将发布报告,人类将达ASI临界点。
别再所有人平分AI算力:顶级模型给资深工程师才省钱,新人刷题式成长已失效
在2026世界人工智能大会InfoQ直播间,滕昱和唐飞虎探讨AI Coding深层变化。他们认为AI放大资深工程师能力,冲击新人与大型软件组织,还就模型使用、判断力、企业部署等发表见解。
首家央企AI独角兽浮出水面!背靠自研大模型,4家国家队资本背书
中电信人工智能科技(北京)有限公司成为央企首家AI独角兽,完成首轮增资,引入四家国家级战略投资方。其靠自研“星辰”系列大模型,在多领域突破,实现技术与市场认可闭环,有望推动AI产业落地。
碾压π0.5,复旦团队首创「世界模型+具身训练+强化学习」闭环框架
复旦团队针对当前 VLA 策略依赖模仿学习、真实机器人在线 RL 成本高、传统物理仿真器有局限等问题,提出 ProphRL 框架。该框架以世界模型 Prophet 为核心,结合 RL 算法,为具身智能落地提供更可行路径,实验效果显著。
东南大学耿新团队:模型不是不会做,而是被「挤掉了能力」丨CVPR 2026
东南大学耿新团队针对模型多任务融合问题提出论文《Model Merging in the Essential Subspace》。指出多任务融合失败源于关键方向重叠冲突,提出 ESM 方法,能让不同任务在模型中稳定共存,实验显示其性能更优。
语音“PS”来了!蚂蚁又放大招,ASR+TTS+编辑的全能语音模型开源了!
在大模型浪潮下,语音领域迎来“整合与统一”趋势。阿里蚂蚁团队推出端到端统一语音模型Ming - UniAudio,能在一个框架下完成识别、生成、编辑等任务,语音编辑能力创新,开发者上手简单。
腾讯AI Lab首创RL框架Parallel-R1,教大模型学会「并行思维」
腾讯AI Lab等机构研究者首创Parallel - R1框架,通过强化学习让大模型掌握并行思维。它解决了RL训练的冷启动和奖励设计难题,在多数学基准上提升准确率,还揭示模型思维策略变化及并行思维的‘脚手架’作用。