激波与涡识别」共找到 6795 篇相关文章

算法论文8

ACL 2025 | 指令遵循不能仅靠常识?GuideBench 揭示大模型如何“踩雷”领域指南规则

这篇ACL 2025主会论文聚焦提升智能体指南规则遵循能力。提出评估基准GuideBench,涵盖7类1272个任务。实验显示多数主流大模型指令遵循能力不佳,尤其数学推理挑战大,为模型迭代提供评估基准。

深度学习自然语言处理
推荐文章7

统一框架下的具身多模态推理:自变量机器人让AI放下海德格尔的锤子

当前先进机器人无法像人类自如用工具,现有多模态系统有局限。自变量机器人提出端到端统一架构,以统一表示学习和多任务多模态生成解锁具身多模态推理能力,实现范式转换。

机器之心
新闻资讯7

「摸鱼」被踢,GPT-4o真不行!30天筹款破万,AI真人秀太上头

AI Digest进行「智能体村庄」实验,4个AI为慈善筹款30天。Claude 3.7 Sonnet夺冠,GPT - 4o表现差被替换。实验展示AI多场景潜力,也暴露协作、应对复杂环境的局限。

新智元
推荐文章7

快速行动,创造未来:AI时代的职业新法则——LinkedIn联合创始人给即将踏入AI时代职场的毕业生一些忠告

LinkedIn联合创始人Reid Hoffman给即将踏入AI时代职场的毕业生忠告。虽就业形势严峻,但毕业生应兴奋,主动驾驭AI,用其优化职业,具备AI素养,发挥主动性,重视人际关系,创造未来。

宝玉AI
新闻资讯8

谢赛宁苏昊CVPR25获奖!华人博士王建元一作拿下最佳论文

CVPR 2025奖项揭晓,谢赛宁、苏昊获青年学者奖。最佳论文《VGGT: Visual Geometry Grounded Transformer》由王建元一作。还介绍了最佳学生论文及4篇荣誉提名论文的亮点应用前景。

量子位
产品应用7

低延时、可交互的音频驱动肖像视频生成框架LLIA

美团提出新型音频驱动肖像视频生成框架LLIA,是低延迟、可实时交互的虚拟形象生成技术。它提出四项核心技术,引入三大核心模块,构建超100小时数据集,在多方面有出色表现。

带你学AI
算法论文8

端到端GUI智能体首次实现“犯错-反思-修正”闭环,模拟人类认知全过程

南洋理工大学MMLab团队提出框架GUI - Reflection,让端到端多模态GUI智能体有“自我反思”能力。它在各训练阶段引入“反思纠错”机制,实验证明该框架能提升智能体能力。

量子位
开源动态8

“甲方快乐模型”诞生,拿下平面设计新SOTA!多条件一键生成,还能独立调整元素 | 复旦&字节

复旦大学和字节跳动团队联合提出CreatiDesign新模型,可实现高精度、多模态、可编辑的AI图形设计生成。它解决了以往方法在处理图形设计时的难题,在多维度评估基准上表现出色,还支持多轮编辑。

量子位
新闻资讯7

硅谷AI圈变天!OpenAI弃微软转投谷歌,LeCun被边缘小扎组队血战复仇

OpenAI抛弃微软,谷歌达成云服务协议,重塑AI竞争格局。Meta的Llama 4表现不佳,扎克伯格亲自组队50人,斥资150亿收购Scale AI,誓要做出AGI,硅谷AI圈风云骤变。

新智元
新闻资讯7

大模型热度退潮,真正的技术创新者开始被「看见」

过去两年中国大模型投资多是商业模式驱动,而技术投资注重创新。DeepSeek 出圈后,独立创新成主流。今年国内大模型吸金热度下降,但智谱 AI、面壁智能仍获融资。面壁智能发布 MiniCPM 4.0,在多方面优化,展现端侧优势。

AI科技评论