现实任务」共找到 2165 篇相关文章

新闻资讯8

Google封神,计算机视觉的GPT3时刻来了!

Google Deepmind称在CV领域做出类似GPT-3的成果,Veo 3经大规模训练涌现通用视觉理解和推理能力,能以图片+提示词完成复杂视觉任务,还具备感知、建模等四大超能力。

探索AGI
产品应用8

百度Qianfan-VL,发票/图表/合同等PDF识别94.75%刷新纪录!

当前主流视觉 - 语言模型在企业级应用有难点,百度千帆团队提出Qianfan - VL系列多模态大模型,在通用和企业级任务表现出色,基于自研芯片训练,还提供框架与管线降低成本。

CourseAI
新闻资讯8

凯捷研究院最新报告:到2028年,Agentic AI市场规模4500亿美元

凯捷研究院报告显示,到2028年Agentic AI有望撬动4500亿美元经济价值,但目前仅2%企业规模化应用。其能自主执行任务,带来商业价值,不过面临信任危机,各行业巨头已开始探索落地场景。

AIGC开放社区
算法论文8

KDD 2025 Best Paper Runner-Up | EI-BERT:超紧凑语言模型压缩框架

香港城市大学王茂林等提出 EI - BERT 框架,解决移动设备部署 NLU 模型难题。通过硬令牌剪枝、交叉蒸馏、模块化量化,实现 99.5% 压缩率。在多任务中表现出色,已在支付宝大规模应用。

机器之心
算法论文8

打破长视频理解瓶颈:HoPE混合位置编码提升VLM长度泛化能力

如今视觉语言模型在长上下文任务表现不佳,CMU和小红书团队深入研究,首次提出多模态RoPE扩展策略理论评估框架,指出现有泛化能力不足原因,提出HoPE大幅提升VLM长度泛化能力。

机器之心
新闻资讯8

斯坦福临床医疗AI横评,DeepSeek把谷歌OpenAI都秒了

斯坦福最新大模型医疗任务评测,构建含35个基准测试的MedHELM综合评估框架。结果显示,DeepSeek R1以66%胜率领先,o3 - mini等模型也各有表现,还分析了成本效益。

量子位
产品应用8

AI开始“动手”了,全世界第一个带头的是阿里千问

阿里千问App上线400多项新功能,依托Qwen模型和阿里生态,在全新Agent架构下提升AI能力。它能在购物、旅游、办公等场景帮用户办事,使AI具备现实世界落地能力,推动人机交互跃迁。

量子位
算法论文8

绝对零监督Absolute Zero:类AlphaZero自博弈赋能大模型推理,全新零数据训练范式问世

清华大学 LeapLab 团队等提出全新推理训练范式 Absolute Zero,使大模型实现「自我进化式学习」。基于此范式训练的模型 AZR,在代码生成与数学推理基准任务表现出色,缓解了大模型对人工数据依赖难题。

机器之心
算法论文8

UIUC清华微软联合提出PlugMem:当Agent记忆告别「经历」,开始存储「经验」

随着大语言模型Agent长期运行,‘记忆该如何设计’成核心问题。UIUC、清华、微软联合提出PlugMem,将记忆拆分为三类,以知识为单位存储,在三类任务中验证其有效性,为Agent长期记忆设计提供新思路。

机器之心
新闻资讯7

社区供稿丨Reachy Mini 亮相 CES 黄仁勋主题演讲:一场开源共创的科技旅程

CES 2026 的 NVIDIA 主题演讲中,黄仁勋带来开源桌面机器人 Reachy Mini,展示了将模型与物理世界连接打造智能伙伴。它运行在本地,依托 DGX Spark 算力,能完成多种任务,其开发是开源硬件与敏捷制造的胜利。

Hugging Face