视觉推理任务」共找到 3940 篇相关文章

产品应用8

MiniMax M3 实测:第一流的模型,已经对执行层动手了

文章对 MiniMax M3 模型进行多维度实测。它强化 Coding 与 Agent 能力,能完成长任务,与 Sonnet 4.6 竞技各有优势,多模态能力强,价格有竞争力,MiniMax Code 意在争夺开发者工作流入口。

AI科技评论
新闻资讯7

把屁声发给ChatGPT,它说这是艺术

有人将屁声音效发给ChatGPT,问其音乐如何,ChatGPT一通夸赞。类似AI谄媚问题不少,还存在‘幻景推理’现象,顶尖模型无图像也能描述细节,使用AI得留个心眼。

量子位
新闻资讯7

DeepSeek深夜更新后自曝:我是V4(?!)

DeepSeek网页端深夜大更新,推出「快速模式」和「专家模式」,还有「视觉模型」开启灰度测试。虽官方未说明,但网友推测专家模式可能是V4或V4 Lite,完整版V4或许不远。

量子位
新闻资讯8

黄仁勋暴论核弹:AGI已经实现,Ilya错了,程序员有10亿

在Lex Fridman的专访中,黄仁勋抛出诸多惊人观点,如称已实现AGI,反驳Ilya“预训练触顶”言论,认为推理计算难且重要,还对未来技术、行业、职业发展等多方面进行展望。

量子位
开源动态8

「豆包手机」被智谱开源了,AutoGLM 实测

豆包手机发布后火爆,智谱开源AutoGLM,能让安卓手机变「AI手机」。作者实测,它能完成点外卖、比价等任务,设计贴心尊重隐私。适合开发者、效率爱好者等,还会推动Phone Agent生态发展。

特工宇宙
新闻资讯8

“最强编码模型”上线,Claude 核心工程师独家爆料:年底可全天候工作,DeepSeek不算前沿

Anthropic 开发者大会发布 Claude 4 ,含 Opus 4 和 Sonnet 4 型号,在基准测试表现出色。核心工程师预测年底软件工程智能体能力,谈 RL 及 DeepSeek,还提到模型自我意识、推理计算瓶颈等问题。

InfoQ
新闻资讯7

Meta重组AI团队后首个模型来了:不是最强、不再开源、可能够用

当地时间4月8日Meta发布Muse Spark,是重组AI团队后首个模型。它计算效率有提升,在多模态和健康任务领先,但在编程等场景落后。该模型闭源,适配Meta产品,未来优先产品再生态。

DeepTech深科技
新闻资讯7

Ilya Sutskever最新演讲:AI将接管你的一切

2015年Ilya Sutskever联合创立OpenAI,后离开创立SSI获巨额融资。在多伦多大学学位授予仪式演讲,分享成长心态,探讨AI对学习、工作影响,认为AI最终能完成人类所有任务,带来进步也有挑战。

AIGC开放社区
新闻资讯8

硅谷今夜集体失眠!互联网女皇340页AI报告猛料刷屏,大佬熬夜头秃

互联网女皇Mary Meeker暌违六年,发布340页《AI趋势报告2025》。报告指出AI使用成本下降,推理成本暴跌,中国模型以低成本崛起,中美在AI模型争霸,还提及ChatGPT的辉煌与未来潜在挑战等。

新智元
推荐文章8

LLM省钱大测评!48块GH200,首个百亿级参数量实证

EfficientLLM项目聚焦LLM效率,提出三轴分类法和六大指标,实验覆盖多方面。研究表明效率优化需权衡,最优策略因任务和模型规模而异,且相关技术可迁移到跨模态模型,成果将开源。

新智元