外推能力」共找到 3761 篇相关文章

算法论文8

与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读长文本

NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。

机器之心
开源动态8

M2模型杀回Coding和Agent领域,MiniMax想要「普惠智能」

如今大模型竞争转向综合比拼,MiniMax 发布并开源 M2 模型,在权威测评跻身全球第一梯队。它定位轻量级,Coding 与 Agentic 能力强,性价比高,还升级 Agent 产品,以技术普惠策略让用户零成本体验。

InfoQ
产品应用7

从0到1:天猫AI测试用例生成的实践与突破

本文阐述天猫技术团队在AI赋能测试领域的实践,讲述智能测试用例生成落地路径。介绍业界现状与天猫业务特性,给出实施策略,展示应用效果,还指出问题并对未来发展做了展望。

阿里云开发者
算法论文7

重塑你的vlog!PickStyle打造稳定的视频风格迁移模型

Pickford提出PickStyle,这是基于扩散模型的视频到视频风格迁移框架。它结合上下文–风格适配器和CS–CFG机制,能在保持画面连贯时准确迁移风格,还能避免闪烁等问题,不过也继承了基础模型部分缺陷。

带你学AI
新闻资讯7

承认自己开源不行?转型“美国DeepSeek”后,两个谷歌研究员的AI初创公司融到20亿美元,估值暴涨15倍!

AI创业公司Reflection AI由两位前Google DeepMind研究员创立,仅一年就完成20亿美元融资,估值达80亿美元。它从编程领域起步,出代码理解智能体Asimov,现转型为开源替代公司,要打造开放模型。

InfoQ
算法论文8

UserBench 与 UserRL 带来的交互智能范式转向

当下大模型在与用户交互时存在不足,来自UIUC与Salesforce的UserBench和UserRL两篇新作,将‘用户价值’量化,把‘可测的交互’转化为‘可训练的策略’,从评测和训练层面动模型向‘懂用户’转变。

深度学习自然语言处理
开源动态8

全新合成框架SOTA:强化学习当引擎,任务合成当燃料,蚂蚁港大联合出品

蚂蚁通用人工智能中心自然语言组联合香港大学自然语言组出PromptCoT 2.0,押注任务合成。它让30B - A3B模型在数学代码理任务达SOTA,全面升级效果、数据和方法,还将考虑多方向发展。

量子位
产品应用8

Anthropic 深夜祭出 Claude Sonnet 4.5,能自主工作 30 小时!CEO:它更像你的同事

昨夜凌晨,Anthropic 出新一代模型 Claude Sonnet 4.5,官方称其是世界上最好的编码模型等。该模型性能跑分登顶,工程落地能力强,还带来产品生态升级,开放 Agent SDK,误报率降低,价格亲民。

InfoQ
新闻资讯7

Anthropic 联创曝内部工程师已不写代码了,但工作量翻倍!开发者嘲讽:所以 Claude bug才那么多?

Anthropic联合创始人透露公司工程师已不写代码,而是管理AI Agent系统,工作量达以往2 - 3倍,Claude也参与编写自身代码。Dario提议向AI公司征税,开发者对AI写代码存质疑,还提到AI测试作弊等情况。

InfoQ
开源动态8

用 1/1000 的参数打穿大模型:我为什么强烈荐 PaddleOCR

PaddleOCR是百度开源的OCR工具,模型参数仅0.07B,却能在复杂场景媲美大模型精度。其新一代PP - OCRv5全面升级,在文本检测等方面表现出色,还稳定增长且在海受关注。

MacTalk