「多任务统一输出」共找到 2586 篇相关文章
英伟达周末双炸!CUDA二十年最大更新,顺手屠榜AGI比赛
本周末英伟达有两大动作。一是推出CUDA 13.1,这是CUDA平台诞生二十年来最大更新,引入CUDA Tile编程模型等。二是在Kaggle ARC Prize 2025竞赛中,团队用4B小模型变体夺冠,靠合成数据等策略。
优理奇机器人完成两轮合计3亿元天使++++轮及天使+++++轮融资,“算法-硬件-场景”三位一体加速具身智能应用落地
优理奇机器人近日完成两轮合计3亿元融资,是半年内第五轮。其坚持“场景驱动”,产品在运动会获奖,量产交付订单超千台。构建完整技术栈,推出标准化机械臂产品,创始人看好具身智能统一发展。
兵临OpenAI!谷歌集结2500人「复仇」,Gemini 3夺回AI王座
谷歌发布Gemini 3欲夺回AI主导权。谷歌DeepMind的CTO与AI Studio产品负责人剖析其发布盛况等,称这是与全球用户共建AGI的实验,还谈到模型发展、应用及多模态等问题,也承认仍有提升空间。
谢赛宁、李飞飞、LeCun联手提出多模态LLM新范式,「空间超感知」登场
纽约大学助理教授谢赛宁与李飞飞、Yann LeCun 合作提出「Cambrian - S」,迈出视频空间超感知探索第一步。该研究引入 VSI - Super 基准,还提出预测性感知范式,在空间认知任务上有提升,相关论文值得视频多模态研究者参考。
AI被严重低估!AlphaGo缔造者罕见发声:2026年AI自主上岗8小时
AlphaGo作者Julian发声,指公众对AI认知落后,低估其进展。实验室里AI已能完成复杂任务且指数进化。研究显示AI能力逼近专家,2026年或可自主工作8小时,2027年或超人类。也有人质疑趋势可靠性。
下一代核心商业媒体,应该是视频播客
视频网站“降本增效”或靠视频播客,它性价比高,能让嘉宾持续输出。下一代核心商业媒体可能是头部视频播客,还分析了播客应是视觉系产品,中国播客发展路径或因环境改变。
4倍速吊打Cursor新模型!英伟达数千GB200堆出的SWE-1.5,圆了Devin的梦!实测被曝性能“滑铁卢”?
Cognition推出全新AI编码模型SWE-1.5,专为软件工程任务设计,运行速度快,在基准测试中成绩良好。它基于GB200芯片训练,有定制编码环境,开发有新战略,还与Cursor新模型Composer对比引发关注。
被困住的日本数据中心
日本一座合资建设的数据中心是AI战略象征,承载训练大模型任务。但生成式AI兴起让数据中心成“电老虎”,与日本环保目标冲突。日本在发展AI与碳中和间艰难平衡,面临能源结构等多方面困局。
重磅!华为开源业界首个Serverless分布式计算引擎openYuanrong,单机体验编程、极致分布式运行性能
近期,华为开源自研的 Serverless 分布式计算引擎 openYuanrong,它是业界首个统一支持通算和智算场景的开源引擎。能解决传统 Serverless 产品通用性不足等问题,已在华为多个核心产品应用,提升了开发效率和资源利用率。
谷歌痛失王座?港科大贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana
港科大贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理多参考图像,在多模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了新测试集与数据构建范式。