「零依赖」共找到 775 篇相关文章
陶哲轩转发!华人数学博士后反超DeepMind AI,停滞18年数学问题1个月内3次突破
DeepMind的AlphaEvolve打破集合和差问题18年纪录,华人博士后Fan Zheng等数学家出手反击。人类用测度集中性少量辅计算机,1个月内该问题3次突破,陶哲轩称不同方法可互补推动数学进步。
只用图像也能思考,强化学习造就推理模型新范式!复杂场景规划能力Max
现有 MLLM 依赖文本处理视觉信息,会造成信息丢失。剑桥、伦敦大学学院、谷歌团队提出视觉规划范式,以强化学习框架 VPRL 提升模型规划能力,实验显示其性能优于文本规划。
Arc研究所造出能“举一反三”的虚拟细胞模型,破解跨细胞预测难题
生物学和药物研发中,因细胞组合庞大,难以全实验验证,且同药在不同细胞效果不同。Arc Institute 团队推出虚拟细胞模型 STATE 及评测套件 Cell - Eval,STATE 预测效果优,但也存在短板。
启发学习:让大模型认知从外化到内生
当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。
紫东太初推出GMC核心集剪枝方法,少80%Token仍满血保真多模态能力
视觉Token冗余是多模态模型高效推理与落地的瓶颈,传统筛选方法有缺陷。紫东太初团队提出GMC核心集剪枝方法,具双阶段架构,优势多,实验显示其能在减少Token同时保持性能。
这个开源项目把视频处理与投稿接成一条流水线
Y2A-Auto是面向YouTube、AcFun和bilibili的自动化处理工具,将下载、识别、翻译等操作集成到Web管理后台。用户可手动或自动处理,支持多平台投稿,有多种功能和灵活配置,适合持续处理授权内容的用户。
NUS、牛津等联合发布音视频智能综述:系统梳理大模型时代的AVI全景图
NUS领衔近10家机构发布音视频智能综述,系统梳理大模型时代AVI发展全貌,涵盖感知、生成与交互,复盘子方向工作,构建任务蓝图,整理评测体系,总结基础技术,还探讨应用、安全及未来研究方向。
0%完成率!Claude、GPT、Gemini 全灭,SWE-Bench作者新作把AI圈干沉默了
SWE - Bench创建者推出新benchmark ProgramBench,测试AI从零构建软件系统能力。结果一线模型完成率0%,暴露AI擅长局部代码生成,缺全局系统规划能力,引发对其评估方式的讨论。
AI短漫剧的Netflix来了!恒星AI推出全球首个影视级AI Agent「Starfilm」,打造AI短漫剧制作的“超级梦工厂”
恒星AI推出全球首个影视级AI Agent「Starfilm」,能一站式完成AI短漫剧创作。它集剧本、数字人、音乐等核心能力,还搞“星光计划”助力创作者在多平台分发变现,让“一人成剧”梦想成真。
西方忘了怎么制造东西,现在它又在忘记代码
文章以国防工业为例,指出西方制造业存在知识流失、产能恢复困难问题。如重启“毒刺”导弹生产线困难,欧洲炮弹交付延期。软件行业也类似,AI使初级工程师能力培养受阻,可能重蹈覆辙。