「智能生产力平台」共找到 4580 篇相关文章
ICML 2025 Spotlight | 多模态大模型暴露短板?EMMA基准深度揭秘多模态推理能力
最新研究推出 EMMA 基准测试,揭示顶尖多模态大语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。
深度解析大模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景
大模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。
干货超标!腾讯混元3D负责人郭春超:真正的3D AIGC革命,还没开始!
腾讯混元团队推出开源项目 Hunyuan 3D 成焦点。腾讯混元 3D 负责人郭春超在 2025 全球机器学习技术大会上表示,真正的 3D AIGC 革命还未开始,分享了 3D 生成现状、挑战及未来等核心洞察。
1/8成本比肩Claude 3.7,Mistral Medium 3来了
“欧洲OpenAI”Mistral AI发布多模态新模型Mistral Medium 3,主打编程和多模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已上线,还推出企业聊天机器人服务,引发网友不同看法。
通用 Agent 向左,Agentic Browser 向右
作者五一深度体验了Fellou,认为它和Manus走不同路线,Manus专注做Agent,Fellou做基于浏览器的全新系统。还介绍了Fellou核心功能,也指出其上手门槛高、执行慢等不足,认为发展尚早,值得期待。
刚刚,SpaceXAI最强Grok 4.7发布!价格杀疯,跑分令人失望
本文报道SpaceXAI发布新款大模型Grok 4.7,该模型定位面向编程与知识工作,主打速度翻倍、价格仅为同类一半,强化长任务处理能力,跑分表现引发网友争议。
我给阶跃星辰 Step 5 Preview 出了一道工程题
本文作者池建强参与阶跃星辰新一代旗舰大模型Step 5 Preview小范围内测,设置带两层bug和隐藏需求的编码工程题,与Qwen 3.8 Max、Kimi K3对比测试,分享实际项目使用体验,给出客观评测。
快去提问!沐神空降小红书,在线答疑
本文整理了深度学习大牛李沐(沐神)在小红书开展的AMA答疑内容,覆盖AI学习、职业方向、技术趋势、行业赛道等大众关心的热门问题,给出了直白干货的回答,适合AI从业者、学生参考。
陈大年复出,入局大模型
国产大模型领域黑马StartLux-V1.0-27B-Preview,参数量仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数量的DeepSeek-V4-Pro。其创始人陈大年押注本地模型,公司专注该领域商业化。
深度实测「豆包工作」+飞书:目前最接近企业Agent终局的答案
「豆包工作」作为面向生产力场景的Agent产品正式发布,与飞书深度打通,给出了目前Agent进入组织的最佳答案。主流办公Agent基础能力趋同,企业上下文正成办公Agent分水岭,豆包工作+飞书优势明显。