「多任务学习」共找到 6177 篇相关文章
视频生成1.3B碾压14B、图像生成直逼GPT-4o!港科&快手开源测试时扩展新范式
香港科技大学联合快手可灵团队推出 EvoSearch 方法,支持图像和视频生成。该方法无需训练和梯度更新,能提升模型生成质量,展现了 test - time scaling 补充 training - time scaling 的潜力,目前论文和代码已开源。
MiniCPM 4.0来了!220倍极速狂飙,端侧模型的比赛,结束了
面壁智能联合清华发布MiniCPM 4.0,极限场景220倍加速。它是首个原生稀疏模型,有三级火箭推理加速体系,性能强,适配全平台,应用广泛,或成端侧AI分水岭。
Ilya Sutskever多伦多大学最新演讲:即将上大学或正在上大学的强烈建议围观
2025年6月6日,ChatGPT之父Ilya Sutskever重返多伦多大学获荣誉理学博士学位并演讲。他分享人生建议,指出AI定义了“最不寻常时代”,建议学生体验使用AI,称其是人类最大挑战与机遇。
单卡搞定万帧视频理解!智源研究院开源轻量级超长视频理解模型Video-XL-2
智源研究院联合上海交通大学等机构发布新一代超长视频理解模型Video-XL-2。它单卡能处理万帧视频,编码2048帧仅需12秒,在效果、长度和速度上全面优化,已开放模型权重。
逆向工程:ChatGPT 的记忆是如何工作的
文章是工程师eric对ChatGPT记忆系统的深度逆向工程和技术实现推测,详细拆解‘可保存记忆’和‘聊天历史’,分析工作原理、实现方案,探讨其对提升用户体验的作用,认为‘用户洞察’是关键。
14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~
有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不可控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经多步骤训练,实验显示其在检索能力和泛化性上表现出色。
刚刚,ICML 2025录用结果公布!好评论文惨遭拒,审稿人敷衍引全网怒喷
ICML 2025录用结果公布,共提交12107篇有效投稿,3260篇被接收,录用率26.9%。此次评审质量遭热议,出现审稿人敷衍、评审错误等问题,同时展示了部分网友的论文录用和拒稿情况。
一个被低估的Markdown神器!
本文是开源君分享的一款被低估的开源AI原生Markdown编辑器OpenKnowledge,它兼顾美观编辑体验、AI协作、本地存储,满足个人和团队知识管理需求,目前GitHub已收获4.1k Star。
光计算如何走向实际部署?清华、上交提出光计算走向实用化的技术路线图
传统电子计算算力遇瓶颈,光计算成为下一代算力新方向。清华与上海交大研究团队联合在Nature Nanotechnology发表研究,提出国际首个光计算实用化统一评价框架与技术路线图,为光计算落地部署提供明确指导。
一行 Python,生成绝美城市地图海报!
开源君发现宝藏项目`prettymaps`,这是巴西开发者Marcelo Prates的开源作品,能从OpenStreetMap拉取数据画定制地图。它功能丰富,安装简单,可让普通人轻松进行地图视觉创作。