人类在环」共找到 8738 篇相关文章

产品应用8

刚刚,千问App把谷歌和OpenAI的「付费绝活」塞进了手机,还免费?

千问App迎来史诗级更新,接入阿里两大视觉模型Qwen - Image和Wan 2.5。Qwen - Image图像编辑上有强大视觉逻辑理解和一致性保持能力;Wan 2.5能实现原生音画同步。千问App还实现一站式工作流。

机器之心
算法论文8

VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确

纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。

AIGC开放社区
算法论文8

智能体系统如何「边做边学」?斯坦福团队探索线优化的新范式

斯坦福等校团队提出 AgentFlow 框架及 Flow - GRPO 算法,让智能体系统能「边做边学」。它由多个智能体模块协作,多领域基准测试中表现出色,小模型也能超越大模型,为智能体训练提供新思路。

机器之心
推荐文章7

Thinking Machines 发布第二篇博文:用模块化流形让训练更加稳定高效

Thinking Machines实验室发布第二篇Connectionism研究文章,提出模块化流形理论框架,通过权重矩阵施加流形约束让神经网络训练更稳定高效。文章从几何角度思考优化问题,提出流形Muon优化器,还探讨了模块化流形扩展到大型网络的方法。

AGI Hunt
开源动态8

牛!小米开源「音频语言模型」,超1亿小时预训练时间,音频理解和输出能力是真顶!

小米推出开源音频语言模型MiMo - Audio,有超1亿小时预训练时间。它能理解音频,70亿参数模型多基准测试达SOTA,音频理解超Gemini - 2.5 - Flash,复杂推理优于GPT - 4o - Audio,还支持多模态任务。

开源AI项目落地
开源动态8

Meta联手UCSD发布DeepConf:计算成本暴降85%,99.9%准确率!

Meta AI联合UCSD推出DeepConf技术,解决了AI高难度推理准确率与计算成本的难题。它让AI学会“察言观色”,筛选靠谱推理路径,AIME 2025竞赛中与GPT - OSS - 120B模型取得99.9%准确率,还节省大量计算资源。

AIGC开放社区
推荐文章8

斯坦福大模型推理课免费了,谷歌推理团队创始人主讲

谷歌DeepMind推理负责人Denny Zhou斯坦福大学CS25讲“LLM推理”课。大模型推理是给出答案前的中间思考步骤,能让复杂问题可解、提升答案准确性。还介绍了让模型输出推理答案的方法及提升推理能力要点。

量子位
新闻资讯8

7个月翻一番!AI agent能力飙升,METR报告揭示指数级进化规律

非营利研究机构METR报告显示,Agent能力每7个月翻一番,这9项基准测试中得到验证,任务涉及编程、数学等领域,大模型正迈向高度自动化,且Agent性能提升快,未来处理复杂任务能力或更强。

量子位
新闻资讯7

“烂出”1.35亿票房?AI二创《牛来》也疯狂,网友都惊呆了

2026年夏天,影视黑马《牛来》AI二创助力下火出圈,截至8月18日票房破2100万,猫眼预测达1.35亿。网友用AI将其做成解说视频、游戏等,虽AI版精致,但有人认为缺真诚感。

鲸选AI
推荐文章8

实战案例|当本体遇上 Agent:让 AI 真正“听懂业务”并“按规矩办事”【上】

本文是“企业级本体应用”系列第三篇,探讨本体如何融入企业智能体系统。指出本体非数据库或图谱,是语义层。介绍本体Agent系统的架构与职责,通过案例展示用本体做规则判断和多维归类,凸显其优势。

AI大模型应用实践