测试时训练」共找到 4002 篇相关文章

算法论文8

Meta打碎Transformer 8年铁律!改写AI最底层规则,模型首次冒出潜意识

Meta推出「自由Transformer」新模型,打破自2017年以来GPT模型核心规则,在解码器引入潜在随机变量Z,增加“潜意识”。仅增约3%计算开销,在多测试中超越大规模模型,或开启后自回归代。

新智元
产品应用8

刚刚,Anthropic 发布 Claude for Life Sciences,目标生物科研全流程

Anthropic推出Claude for Life Sciences,全方位布局生命科学领域。它配备Skills功能,生物学测试表现提升,能解读图像、分析数据。还深度整合科研生态,应用场景广,获众多药企、学术机构青睐,还有AI for Science计划。

AGI Hunt
算法论文8

一篇92页大模型Vibe Coding技术全面综述

中科院计算所&杜克大学发布首篇Vide Coding技术全面综述。介绍以“氛围/结果”为导向的Vibe Coding开发范式,含技术分类、能力分析、开发模式、数据模型等内容,还提及价值及反馈回路等。

PaperAgent
产品应用8

将科研脏活累活真·丢给AI!上海AI Lab推出深度科研智能体FlowSearch

上海人工智能实验室推出深度科研智能体FlowSearch,它由动态结构化知识流驱动,有三大核心模块。在多个科研基准上性能领先,能让科研更高效,标志科研智能体迈向新阶段,还为未来系统奠定基础。

量子位
产品应用7

让YOLO飞起来:从CPU到GPU的配置指南

文章指出默认安装的YOLO用CPU计算,处理大量图像或实检测任务效率低。详细介绍将YOLO从CPU模式切换到GPU模式的步骤,对比性能,还给出常见问题解决办法,能显著提升运行效率。

机器学习AI算法工程
开源动态7

超越ZIP的无损压缩来了!华盛顿大学让大模型成为无损文本压缩器

华盛顿大学SyFI实验室提出LLMc,利用大型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。

量子位
算法论文8

230个大模型在婴幼儿认知题上集体翻车!揭秘多模态大模型的核心知识缺陷

ICML 2025研究揭示多模态大模型在基础认知能力上表现不佳。研究者建测评题库CoreCognition测试230个主流模型,发现其存在核心知识缺陷,扩规模难补短板,还需补齐核心知识。

量子位
开源动态8

Sora2还在5秒打转,字节AI生视频已经4分钟“起飞”

字节和UCLA联合提出Self - Forcing++方法,无需更换模型架构或重收集数据集,就能生成分钟级长视频,最长达4分15秒,高质量且开源,在长、短长生成上性能领先。

量子位
产品应用8

深夜炸场!Claude Sonnet 4.5上线,自主编程30小,网友实测:一次调用重构代码库,新增3000行代码却运行失败

Anthropic推出Claude Sonnet 4.5,号称‘世界上最好的编码模型’,持续运行长、推理等能力提升,‘幻觉’等问题改进,Claude Code也有更新,开发者实测有惊喜也有问题,新一轮AI‘内卷’开启。

AI科技大本营
开源动态8

AIME'25满分炸场!Qwen一波七连发,全家桶大更新

云栖大会上,通义团队成果丰硕。Qwen3-Max性能提升,数学评测满分,多测试成绩优异;Qwen3-VL、Qwen3-Omni等开源,各有亮点;Qwen3-Coder升级。吴泳铭称要发展超级人工智能。

量子位