「顶会论文」共找到 2336 篇相关文章
DeepSeek最新模型意外泄露~
DeepSeek最新模型DeepSeek-V3-0526疑似泄露,消息源于https://docs.unsloth.ai/basics/deepseek-v3-0526-how-to-run-locally ,其性能媲美GPT - 4.5 / Claude Opus,或成最强开源模型,信息若属实将很快发布。
只用图像也能思考,强化学习造就推理模型新范式!复杂场景规划能力Max
现有 MLLM 依赖文本处理视觉信息,会造成信息丢失。剑桥、伦敦大学学院、谷歌团队提出视觉规划范式,以强化学习框架 VPRL 提升模型规划能力,实验显示其性能优于文本规划。
帮大模型提速80%,华为拿出昇腾推理杀手锏FlashComm,三招搞定通算瓶颈
在大模型推理通算难题凸显的背景下,华为数学家祭出 FlashComm。它包含三项技术,分别在 AllReduce 通信、以存换传、多流并行方面优化,解决通信瓶颈,提升推理性能,未来还将围绕多方向创新。
OpenAI很看好!首个SWE-1模型发布,软件开发或将提速99%
Windsurf发布首个前沿模型SWE-1,目标将软件开发提速99%。它不只能写代码,还能协助软件工程流程。有三个系列模型,SWE-1运行成本低,SWE-1-lite对所有用户开放,SWE-1-mini适用于低延迟场景。
在校生开发,榨干 win 系统全部带宽!
介绍在校生开发的开源工具 HypoMux,它面向 Windows,能把多张网卡「绑」在一起,让下载任务多线路并行。有双模式可选,还能智能分流,兼容主流加速器。操作简便,可解决下载慢问题。
Ilya的第一个模型,被曝本月上线
新智元报道,投资人Gavin Baker称Ilya Sutskever创立的SSI本月将发布首个模型。他还提及持续学习等技术或影响英伟达显卡需求,且指出Claude成华尔街“克朗凯特”,带来市场共识同质化。
体验了两周Robot Phone,这是我第一次觉得手机活过来了。
作者体验两周荣耀Robot Phone后分享感受,它是有瑕疵但具探索感的产品,独特在云台与YOYO结合,带来新奇体验,解决自媒体人刚需,还让手机从工具迈向伙伴,使手机品类重获趣味。
提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026
香港科技大学研究发现,大模型的“提示词压缩”模块会重写系统安全边界,成为新攻击面。团队提出“对抗性信息损失”概念和COMA攻击框架,实验有效,还给出隔离压缩防御方案。
Codex 负责人:「所有人都是 builder」是个很糟糕的主意
OpenAI Codex 团队负责人 Andrew Ambrosino 认为,AI 时代产品开发各环节发生变化,实现成本降低,品味变得更重要。他还谈到岗位角色融合但 PM 不会消失,以及 Codex 发布时机和工作模式等问题。
刘陈立领衔!六国学者联合发布亚洲合成细胞技术路线图
由刘陈立牵头的联合团队发表论文,提出亚洲合成细胞技术路线图。它指出构建合成细胞的四大挑战,提出新型研究范式和十年两阶段目标,体现亚洲科研协作原创探索,推动国际合作。