领域特定任务」共找到 3624 篇相关文章

算法论文8

与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读长文本

NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。

机器之心
新闻资讯8

ICIG 2025:共话图像发展新坐标

2025年10月31日至11月2日,第十三届国际图象图形学学术会议(ICIG 2025)在徐州举行,700余人参会。大会展示前沿成果,设多场论坛与赛事,专家认为其为领域发展注入新动力,巩固中国学术交流地位。

AI科技评论
新闻资讯8

英伟达,全球首个5万亿美元公司诞生!「GPU帝国」超日本德国GDP

英伟达市值突破5万亿美元,成全球首家达此里程碑公司,超德国和日本GDP。黄仁勋预计2026年GPU销售额达5000亿美元。GTC大会围绕‘AI工厂’展开,英伟达在多领域布局,搭建庞大AI帝国。

新智元
产品应用7

从0到1:天猫AI测试用例生成的实践与突破

本文阐述天猫技术团队在AI赋能测试领域的实践,讲述智能测试用例生成落地路径。介绍业界现状与天猫业务特性,给出实施策略,展示应用效果,还指出问题并对未来发展做了展望。

阿里云开发者
算法论文8

Embedding黑箱成为历史!这个新框架让模型“先解释,再学Embedding”

来自多高校研究人员推出可解释的生成式Embedding框架GRACE,解决传统文本表征模型黑箱式表征瓶颈。它重新定义对比学习信号,含三个关键模块,训练双模式统一,实验跨任务提升且不损生成能力。

量子位
开源动态8

LeCun团队开源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典

Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在多个代码与推理任务表现出色,开源代码、训练细节等,不过目前仅支持Python。

量子位
新闻资讯7

科学界论文高引第一人易主!AI站上历史巅峰

深度学习三巨头之一Yoshua Bengio成各领域被引最多在世科学家。其多篇论文为深度学习奠基,影响自然语言处理等研究。他近期再创业,还介绍了论文引用排名情况,凸显AI和医学热度。

量子位
算法论文8

VLA 推理新范式!一致性模型 CEED-VLA 实现四倍加速!

近年来,VLA模型成机器人领域重要研究方向,但推理速度受限。本文提出一致性蒸馏训练、混合标签监督机制及提前退出解码策略,在多基线模型上实现超4倍推理加速,实验验证其高效通用。

机器之心
开源动态8

性能比肩DeepSeek-R1,MiniMax仅花380万训出推理大模型性价比新王|开源

MiniMax开源推理大模型MiniMax - M1,原生支持100万token输入、8万输出,性能比肩DeepSeek - R1,仅花380万训成。采用Lightning Attention机制与CISPO算法,在多领域表现出色,模型权重可在HuggingFace下载。

量子位
新闻资讯7

把 RAG 做成主流的公司,现在开始“做空”RAG 了

Pinecone 曾将 RAG 定义成大语言模型 grounding 标准范式,如今却宣布 RAG 时代结束。它推出面向 Agent 的知识引擎 Nexus,提出“知识编译”概念,称能提高任务完成率、降低 token 开销,整个 AI 世界都在将“推理”往上游移动。

AI前线