新模型Spud」共找到 9338 篇相关文章

新闻资讯7

直播预约 | 推理模型的“过思考”现象与高效推理,2.5h的深度分享

本期GenTalk学术分享邀请刘梓辰、齐朋辉等4位博士生,在2025年6月6日15:00 - 17:30带来“推理模型的‘过思考’现象与高效推理”报告,由夏鹤明主持,NICE学术等支持。将分析‘过思考’因素,总结高效推理思路。

深度学习自然语言处理
算法论文8

让VLM学会「心中有世界」:VAGEN用多轮RL把视觉智能变成「世界模型」推理机器

当前VLM智能体面对复杂视觉任务表现不佳,美国西北大学等机构联合研究成果VAGEN,提出创强化学习框架,奖励正确思考过程,让VLM在行动前构建内部世界模型,效果超多款闭源大模型

机器之心
开源动态8

最低仅需2G显存,谷歌开源端侧模型竞技场纪录,原生支持图像视频

今天凌晨,谷歌官宣Gemma 3n,原生支持多模态。它在大模型竞技场超1300分,是首个超此分数的10B以下模型。其VRAM占用低,最低2GB,已在谷歌AI Studio等可用,还公开了技术细节。

量子位
新闻资讯7

80%到25%逆转!大模型代码能力最排名:Anthropic不再是唯一的神?

OpenRouter网站有模型使用排行榜,按不同使用场景分类。2024年12月到2025年2月,Anthropic模型编程流量占比曾达80%,后谷歌Gemini 2.5 Pro等抢占份额,其跌至25%以下,Claude 4发布后份额回升。还介绍了OpenRouter特点。

AI寒武纪
新闻资讯8

天终启,万象智生!从AlphaGo到GPT-5,智元十年见证ASI创世纪

2025年AI飞速发展,大模型发布密集,如OpenAI、谷歌等有诸多成果,中国造大模型也表现出色。智元9月7日将举办十周年峰会,邀多位嘉宾探讨前沿突破,还将发布报告,人类将达ASI临界点。

新智元
新闻资讯7

别再所有人平分AI算力:顶级模型给资深工程师才省钱,人刷题式成长已失效

在2026世界人工智能大会InfoQ直播间,滕昱和唐飞虎探讨AI Coding深层变化。他们认为AI放大资深工程师能力,冲击人与大型软件组织,还就模型使用、判断力、企业部署等发表见解。

InfoQ
新闻资讯8

首家央企AI独角兽浮出水面!背靠自研大模型,4家国家队资本背书

中电信人工智能科技(北京)有限公司成为央企首家AI独角兽,完成首轮增资,引入四家国家级战略投资方。其靠自研“星辰”系列大模型,在多领域突破,实现技术与市场认可闭环,有望推动AI产业落地。

量子位
算法论文8

首个时空时序推理框架:让大模型真正读懂时空数据 | ACL'26

STReasoner是首个结合时间序列、空间结构和自然语言的推理模型,能识别异常源、追踪影响路径。研究团队构建数据生成框架和评测基准,采用三阶段训练策略,模型在多任务表现优,成本低且泛化能力强。

新智元
算法论文8

碾压π0.5,复旦团队首创「世界模型+具身训练+强化学习」闭环框架

复旦团队针对当前 VLA 策略依赖模仿学习、真实机器人在线 RL 成本高、传统物理仿真器有局限等问题,提出 ProphRL 框架。该框架以世界模型 Prophet 为核心,结合 RL 算法,为具身智能落地提供更可行路径,实验效果显著。

机器之心
开源动态7

LM Studio宣布支持在Mac上跑Qwen3-Next 80B模型

LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。

AI工程化