「多模态代码生成」共找到 4227 篇相关文章
用完这张无限可能的AI画布,第一次感觉人类导演要失业了!
2024年7月上线后迅速风靡海外的SkyReels发布最新版本,它重构AI创作生态,打通「图片—音频—视频」全栈,集成多种功能于一张画布,还推出专家智能体,让普通人轻松创作高质量内容。
CMAME | 香港理工大学周原野、周恺等:面向清晰几何边界工程优化的拉格朗日拓扑物理信息神经网络
近年来物理信息神经网络引入拓扑优化领域,但结果边界弥散。本文提出“拉格朗日拓扑物理信息神经网络”框架,将显式可变形基础几何体嵌入可微分物理求解器,提升了优化结果的可制造性与精度。
最新外国「自研」大模型,都是套壳国产?
本周,Cursor发布新代码模型Composer,Cognition推出新AI模型SWE - 1.5,二者均被指背后基于中国AI模型。业界大佬认为有证据指向中国开源模型,国产开源模型已成AI领域主流,改变全球竞争格局。
让机器人在“想象”中学习世界的模型来了!PI联创课题组&清华陈建宇团队联合出品
斯坦福Chelsea Finn课题组与清华陈建宇团队联合提出可控生成世界模型Ctrl - World,可让机器人在“想象空间”预演任务。该模型使用零真机数据,提升下游任务指令跟随成功率。其相关论文已发布于arXiv平台。
赵长鹏投了一个华人大三学生,1100 万美元种子轮,做教育 Agent
华人大三学生 Kai Zhao 创立的教育 Agent 产品 VideoTutor,获 1100 万美元种子轮融资。该产品主打生成专属教学视频,解决 K12 美国高考学习痛点,团队技术与市场表现出色,还分享了硅谷大学生创业趋势。
HAMi × NVIDIA:GPU 拓扑感知调度实现详解
HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决多卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。
基础模型已颠覆科研,进入第五范式!港科大综述113篇论文 | NeurIPS'25
港科大论文指出,随着科学问题复杂度提升,传统科研范式显露出局限。基础模型(FMs)横空出世,具备通用性、规模与知识覆盖、推理与生成能力,可能引领科学进入第五范式,但也面临偏见、幻觉等问题。
字节Seed发布PXDesign:蛋白设计效率提升十倍,进入实用新阶段
字节跳动Seed团队提出可扩展蛋白设计方法PXDesign,24小时生成数百高质量候选蛋白,效率较主流方法提升约10倍,湿实验成功率达20%–73%。还推出公开免费在线服务,提供配套工具加速应用落地。
一周10来个模型被开源,阿里Qwen杀疯了~
阿里通义千问这周开源众多模型,如Qwen3 - Omni、Qwen - Image - Edit等,涉及全模态、图像编辑、安全审核等多领域。各模型能力出色,如Qwen3 - Omni能处理多模态输入,Qwen3 - VL表现超部分闭源模型。
一次汇报,资源投入暴涨数十倍:快手大模型推荐以 1/12 成本突围,技术负责人亲历的革新故事
InfoQ 专访快手科技副总裁周国睿,他分享了快手大模型推荐技术投入挑战、决策过程等。如汇报后资源投入涨数十倍,以 1/12 成本突围。还阐述推荐系统变革、技术押注及未来推荐系统突破点等观点。