人类在环」共找到 8730 篇相关文章

新闻资讯7

全国首部AI大模型私有化部署标准,公开征集起草单位和个人!

近期AI领域政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但行业存技术错配等问题。国内首部针对AI大模型私有化部署的标准《人工智能大模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。

CourseAI
开源动态8

百度Qianfan-VL开源,纯国产自研昆仑芯跑出世界一流

百度开源全新视觉理解模型Qianfan-VL,有3B、8B和70B三个版本,昆仑芯P800芯片上训练。该模型多模态能力强,OCR和教育场景表现突出,跑分超国际主流模型。芯片功耗低、架构优,模型训练方法创新。

AIGC开放社区
新闻资讯7

小米造芯:一个失败者重整旗鼓

小米曾2017年澎湃S1铩羽而归,2021年重启手机SoC设计研发。此次玄戒O1一次流片成功后回片,表现超预期。文章分析了小米此前失败教训,介绍其芯片战略,还谈及产业特点与小米面临的挑战。

芯师爷
算法论文8

突破多模态奖励瓶颈!中科院清华快手联合提出R1-Reward,用强化学习赋予模型长期推理能力

多模态奖励模型(MRMs)对提升多模态大语言模型表现至关重要,强化学习理论上可引入长期推理能力,但现有RL算法用于训练MRM会不稳定。中科院、清华等团队推出R1 - Reward模型,多模态奖励模型benchmark上有显著提升。

量子位
算法论文8

ACL 2026|Doc-V*:读100页文档不如只翻对5页,80页场景「暴打」RAG 10个点

Doc-V*由小米和华中科技大学团队提出,是多页文档理解新范式,通过交互式视觉推理让模型有策略地读长文档。它多页文档问答基准上比RAG变体提升49.7%,不依赖大模型或长上下文窗口。

机器之心
新闻资讯7

GPT-5准确率不足40%!北大发布多模态、高难度化学基准SUPERChem

北大团队发布多模态、高难度化学基准SUPERChem,构建评估大语言模型化学推理能力新体系。测试显示,GPT - 5准确率仅38.5%,与低年级本科生相当,且模型高阶推理有短板,该基准为模型优化指明方向。

新智元
新闻资讯8

Runway Gen-4.5刷屏发布,把重量、尘土和光影都做对了,网友:颠覆

Runway Gen-4.5突袭发布,获“视频生成AGI时刻”评价,Artificial Analysis测试中拿下SOTA。它能精准执行复杂指令,物理还原与视觉精准度强,官方将逐步开放使用权限,还直言其存因果推理等局限。

量子位
新闻资讯7

4倍速吊打Cursor新模型!英伟达数千GB200堆出的SWE-1.5,圆了Devin的梦!实测被曝性能“滑铁卢”?

Cognition推出全新AI编码模型SWE-1.5,专为软件工程任务设计,运行速度快,基准测试中成绩良好。它基于GB200芯片训练,有定制编码境,开发有新战略,还与Cursor新模型Composer对比引发关注。

InfoQ
新闻资讯7

AI看不到的爱心,成了最棒的AI检测器。

作者以漂浮爱心图检测AI,Gemini 2.5 Pro、GPT - 5等模型均失败。又用噪点鹿视频测试,AI准确率为0%。原因是AI是空间王者、时间瞎子,无“共同命运法则”视觉系统,存时间盲视。

数字生命卡兹克
开源动态8

谷歌痛失王座?港科大贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana

港科大贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理多参考图像,多模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了新测试集与数据构建范式。

新智元