「通用视觉语言」共找到 2225 篇相关文章
世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍
视觉规划里世界模型‘想象’过程慢,西安交通大学研究团队提出Fast LeWorldModel,从根本改变预测方式,实验显示其提升了成功率,还大幅缩短规划时间。
清华新研究,Nature+Science双杀!
清华大学李勇团队分析2.5亿篇科学文献,揭示AI for Science领域矛盾:虽助科学家个体加速,却致科学界群体注意力窄化。这由当前AI模型缺通用性导致,团队推出OmniScientist系统破局限。
多模态BUG修复新SOTA:慕尼黑工大GUIRepair登上SWE-bench Multimodal榜单第一
自动化修复软件缺陷是长期目标,多模态问题修复受关注。慕尼黑工业大学团队提出GUIRepair,融合APR与GUI Testing知识,登上SWE - bench Multimodal榜单第一,为多模态软件自动修复开辟新路。
读博最后一年转方向,拿到OpenAI offer:我的面试之路充满「意外」
布朗大学博士生Yong Zheng - Xin自宣下月加入OpenAI做AI安全研究。他博士最后一年转方向,分享求职经历,总结6个意外洞察,如求职重要的可能仅一两篇论文、面试形式多样等。
见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述
该文是对LLM奖励建模的「Analytic Rubric」范式的全面综述。介绍了Rubric概念来源,指出传统奖励模型存在对齐风险,而Rubric RM在多方面取得平衡,还阐述其工作流、各维度研究情况及面临的挑战。
分享10个你可能不知道的Claude Code隐藏命令。
作者分享10个Claude Code隐藏命令,如/btw可并行提问不污染上下文,/rewind能分别回退代码和对话等,还介绍快捷键,强调Claude Code更新快,建议关注更新动态。
Gemini证明数学新定理!全程没联网
Gemini内部数学版学霸模型FullProof全程不联网,帮数学家证明代数几何领域新定理,即0亏格映射到旗簇空间的motivic类等价结论。它埋下关键思路伏笔、独立给出反例,比Macaulay2更优。
AI杀死了破折号,也绞杀了语文。
互联网上破折号“暴毙”,因被无数人当成AI接头暗号。很多社媒平台上AI写的内容用蹩脚符号,人类苦AI内容久矣。为区分AI,人类或放弃部分文化表达,这是表达降级,AI正绞杀语文。
DeepMind首个猜想库开源,获陶哲轩力挺!
谷歌DeepMind开源首个形式化数学猜想库,获陶哲轩力挺。该库用形式化语言重述数学猜想,为AI提供“标准答案模板”,还采取措施确保准确性,诚邀各方参与贡献。
OpenAI大变革!继续与微软等,以非营利模式冲击AGI
今天凌晨2点,OpenAI宣布继续由非营利组织控制,营利性实体转变为公共利益公司。此前转型营利性公司引发争议,此次调整是听取各界意见后做出,旨在让AI造福全人类。