Qwen3-1.7B」共找到 3809 篇相关文章

产品应用8

编码封神,Gemini 2.5 Pro (I/O 版)视频秒转 App!网友:比 o3/Claude 强,Vibe 程序员集结!

谷歌 I/O 大会前,Gemini 2.5 Pro 预览版升级,重点在编码。它搞前端、做 UI 出色,能将视频变互动学习 App,推理速度提升。对标 GPT - 4.1 等,性价比高、表现优,获开发者好评。

AI进修生
算法论文8

突破多模态奖励瓶颈!中科院清华快手联合提出R1-Reward,用强化学习赋予模型长期推理能力

多模态奖励模型(MRMs)对提升多模态大语言模型表现至关重要,强化学习理论上可引入长期推理能力,但现有RL算法用于训练MRM会不稳定。中科院、清华等团队推出R1 - Reward模型,在多模态奖励模型benchmark上有显著提升。

量子位
新闻资讯8

刷新硅谷融资纪录!华人具身智能团队刚毕业融资过7亿元,平均年龄不到28岁

华人主导的Genesis AI公司成立仅一月完成1.05亿美元种子轮融资,刷新硅谷两项融资纪录。团队平均年龄不到28岁,靠开源的Genesis物理引擎吸引投资,致力于开发通用机器人基础模型和通用机器人。

量子位
产品应用8

英伟达推出下一代计算平台Rubin:可用45°C的热水进行冷却,训练速度提高3.5倍

英伟达黄仁勋在CES演讲,宣布进入自动驾驶领域、推出Alpamo模型与下一代计算平台Rubin。他指出计算行业正经历平台性转变,还介绍AI进展、应用架构,Rubin平台性能强且能效高。

AI寒武纪
产品应用7

Ollama 推出免费搜索API + MCP集成:Cline、Codex一键接入网络搜索( + Qwen 搭建迷你搜索代理 )

Ollama推出免费Web搜索API,个人使用免费,本地和云端模型均可调用,还出了MCP服务器。它能让开源模型执行长期研究任务,还介绍了用其与Qwen搭建迷你搜索代理及MCP集成的方法。

AI进修生
算法论文8

破解「长程智能体」RL训练难题,腾讯提出RLVMR框架,让7B模型「思考」比肩GPT-4o

腾讯混元AI数字人团队提出RLVMR框架,将‘元认知’理论引入RL,通过奖励‘好的思考过程’解决长程任务中智能体的低效探索与泛化难题,经其训练的7B模型表现出色。

机器之心
新闻资讯8

国货之光!全球AI存储基准测试MLPerf Storage 3.0结果发布,斩获九项第一|甲子光年

9月1日,MLPerf Storage 3.0基准测试结果发布,XSKY星辰天合旗下MeshFS首次参赛,在并行文件存储赛道获九项第一。该测试覆盖多类负载,可多维度衡量存储系统性能,MeshFS兼顾性能与成本效率。

甲子光年
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源科学多模态大模型Intern-S1。它融合多学科知识,首创跨模态科学解析引擎,在多学科任务上超越顶尖闭源模型,还支撑构建了多智能体系统。

机器之心
开源动态8

机器人视觉语言导航进入R1时代!港大联合上海AI Lab提出全新具身智能框架

香港大学与上海AI Lab联合提出VLN - R1,可将自然语言指令转化为连续导航动作,打破传统链条。它有两阶段训练等创新支柱,在测试中表现出色,小模型性能佳,推动具身智能从数字向具身认知跨越。

量子位
新闻资讯7

堆推理链全错了!林俊旸离职首曝:曾在阿里 Qwen 踩中一个“致命”技术误区

阿里千问技术负责人林俊旸离职后发声,复盘 Qwen 训练尝试,指出合并 thinking 和 Instruct 模式不理想。他认为大模型未来应从‘推理思维’走向‘智能体思维’,并阐述了智能体思维的特点和挑战。

AI前线