「UCSD研究团队」共找到 4710 篇相关文章
谷歌Agent正在憋大招:AI科学家内测,锦标赛制“炼”想法,一次跑40分钟
谷歌正为Gemini Enterprise开发多智能体系统,能扮演联席科学家提炼想法,实现研究自动化。工作时以锦标赛形式评估想法,一次运行约40分钟,还准备了“想法生成”“联席科学家”等智能体。此外还有“与文档对话”功能。
音画同步视频生成重磅开源!Character AI和耶鲁大学推出Ovi,让音、画在一个大脑里思考
Character AI和耶鲁大学团队推出开源模型OVI,它采用双骨干交叉模态融合架构,让音视频同步生成。其架构对称,用旋转位置嵌入技术对齐时间,训练策略分步进行,生成效果佳,为开源音视频生成提供新路径。
获NVIDIA致谢:悟空Agent的实践、复盘与迭代
本文以悟空Agent获NVIDIA致谢为切入点,介绍多智能体架构闭环及实战挑战,如上下文断流、调度失衡。还阐述架构设计、迭代优化、数据飞轮体系,指出AI infra存在安全隐患,强调安全融入业务的重要性。
清华、北大,上海交大等发布人机协同训练框架,让机器人零样本学会新技能
清华、北大等发布人机协同训练框架MotionTrans,能让机器人零样本学会新技能。它将人类数据翻译成机器人语言,构建数据集,经格式转换、速度调整等处理后训练模型,实验验证其有效性,且数据、代码和模型已开源。
让AI生成视频「又长又快」:Rolling Forcing实现分钟级实时生成
南洋理工大学与腾讯ARC实验室联合研究,由博士生刘坤昊等完成,提出Rolling Forcing方法,通过滚动窗口联合降噪等创新设计,突破实时长视频生成瓶颈,实现分钟级实时生成,还支持交互控制,但仍有优化方向。
ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节
格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。
田渊栋被Meta卸磨杀驴,但全网疯狂发offer!OpenAI冲来抢人了
Meta裁员风暴扩散,FAIR研究科学家田渊栋等被裁。田渊栋入职十年多,成果亮眼,却在协助处理Llama 4相关事务后被裁。此外,不少刚入职的博士也遭殃。同时,Meta还用AI取代人工审核。
大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金
新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。
Cursor 1.7 新增 Agent 生命周期管控钩子函数
Cursor 1.7 版本推出钩子系统,可在预定义生命周期节点拦截并修改 Agent 行为,如阻断命令、自动运行工具等。早期反馈有好有坏,虽有团队探索集成,但应用范围有限,还存在文档缺失等问题。
ChatGPT新功能Pulse,GPT-5主动给你推消息,大家玩得停不下来
本周五凌晨,OpenAI 向 Pro 订阅用户开放 ChatGPT 新功能「Pulse」预览版。它基于智能体,会根据用户信息提供个性化更新,还能异步搜索。用户可管理研究内容、提搜索请求及反馈,未来或推广告、建社交网络。