「生产级交付」共找到 1299 篇相关文章
攻克长文档与多模态挑战,Paper2Video实现学术视频的自动化生产
新加坡国立大学 Show Lab 团队主导研究,提出 Paper2Video 基准及评价指标,还推出 PaperTalker 多智体框架实现学术视频自动化生产,实验显示其在多方面表现佳,效果接近人工水平。
超越纯视觉模型!不改VLM标准架构,实现像素级深度预测
Meta开源DepthLM,首证视觉语言模型不改架构就能媲美纯视觉模型的3D理解能力。通过视觉提示等创新策略,它精准完成像素级深度估计等任务,为多领域带来前景。
腾讯开源最强3D生成模型,消费级显卡就能跑 | CVPR
在CVPR上,腾讯混元3D 2.1模型宣布开源。相比前一代,它实现几何与纹理双重优化,纹理贴面提升大,达当前开源3D模型SOTA水平。全链路开源,适配消费级显卡,Hugging Face下载量超180万。
陶哲轩亲测Claude跑崩电脑,全靠这份保姆级指令清单翻盘
全球顶尖数学家陶哲轩实测Claude Code,首次完全放权致电脑崩溃。后拆分任务、给出「保姆级」指令,约半小时完成证明。他强调人类应保持「人类在环」,拒绝过度依赖AI。
马斯克生日惊喜!全球首例Model Y无人「自驾交付」,30分钟见证历史
昨天,一辆特斯拉Model Y从得州超级工厂无人自驾,最高时速115公里,30分钟到车主家门口,完成人类首次工厂到用户的闭环交付。马斯克激动祝贺,此场景复杂度超竞争对手。
a16z 发布百大【生成式AI】消费级应用排行榜第五版
a16z发布第五版百大生成式AI消费级应用榜单,揭示普通人使用AI习惯的演变,生态趋于稳定。谷歌多款产品上榜,Grok与Meta加入战局,中国本土赢家崛起,“凭感觉编程”催生真实用户,还公布“全明星”阵容。
谷歌做了个论文专用版nano banana!顶会级Figure直出
科研人画论文插图耗时久、要求高,现有大模型搞不定。北大与Google Cloud AI Research团队推出PaperBanana,能按论文方法画顶会级Figure,不仅能从零生成,还能润色丑图,通过多智能体协作实现科研表达自动规范化。
玩转智能体协议:谷歌开发指南教你拼出工业级AI应用
谷歌两篇开发指南拆解六大前沿开放协议核心代码,从开发者挑战赛提炼五条架构法则。介绍各协议用途,如MCP消除重复劳动,A2A规范智能体通信等,阐述协议协同运作及架构法则助力工业级智能体应用开发。
让AI生成视频「又长又快」:Rolling Forcing实现分钟级实时生成
南洋理工大学与腾讯ARC实验室联合研究,由博士生刘坤昊等完成,提出Rolling Forcing方法,通过滚动窗口联合降噪等创新设计,突破实时长视频生成瓶颈,实现分钟级实时生成,还支持交互控制,但仍有优化方向。
颠覆算力格局!全球首个星座级太空AI算力服务,在中国诞生
第四届琶洲算法大赛中,国星宇航与佳都科技联手推动「慧行·AI上星」实验,标志国星宇航成全球首个提供常态化星座级太空算力商业服务公司,验证太空算力承载行业应用可行性。