「聆动通用」共找到 871 篇相关文章
RSS 2025 软硬件全开源,智源清华带来混动灵巧脸Morpheus
清华大学赵昊团队联合多家机构发布高拟真机器人面部系统Morpheus,融合三项关键技术,能实时生成多种细腻表情。它在核心指标表现出色,有三大创新突破传统瓶颈,为下一代情感机器人奠定技术基座。
FairyGen:AI 把孩子的画“动”起来,个性化教育和动画创作
FairyGen 能将孩子画作变成卡通短片,通过多模态大语言模型构思分镜脚本,采用分层建模处理前景人物动作与背景动态。其生成流程分四阶段,但也存在前景角色重建不准、背景生成不稳定等问题。
改写纳米光学底层逻辑!MIT学者搭建通用可重构光子平台
MIT助理教授唐皓凝构建可相对运动的双层纳米光子系统,将机械运动变为可定量科学变量。2024年,她和合作者集成光谱仪和偏振仪功能。她想发展可编程光子架构,还把AI作工具。
动动嘴写SQL!Codex+终身记忆,OpenAI把查询难度直接归零
2026年初,OpenAI曝光数据分析智能体,将数据查询从「天数级」缩至「分钟级」。它用Codex驱动,有六层上下文架构,能补齐数据语义、沉淀经验记忆,让工程师提问取代手动查表。
ChatGPT这次对数学教育动了真格,家长学生都不用愁了
OpenAI针对数学和科学学科抽象难学问题,推出ChatGPT动态可视化交互解释新功能,从超70个核心概念起步,可让用户拖动变量、调整公式,实时观察结果变化,今日面向全球已登录用户开放。
小鹏加速冲向L4终局:对VLA架构「动刀」成关键一环
在辅助驾驶领域,端到端的VLA方法虽有效果,但面临中间层语言难以准确表达物理世界细节的问题。小鹏汽车去掉“语言转译”环节,推出第二代VLA,有跨代级驾驶体验,背后是底层技术架构重构。
4D通用世界模型!中科院NeoVerse用百万单目视频直接构建
中国科学院自动化研究所与CreateAI团队构建4D世界模型NeoVerse,它用全新端到端架构,从单目视频高效重建4D高斯泼溅,模拟成像退化提升生成鲁棒性,在多任务表现卓越。
李飞飞又被超越了?百万「普通视频」打造通用4D世界模型!
全行业为昂贵多视角数据发愁时,中科院和CreateAI推出NeoVerse,用百万单目视频打开4D世界模型大门。它抛弃多视角数据和离线预处理,解决扩展性瓶颈,在重建速度、生成质量等方面表现出色,有丰富下游应用。
1100多个模型殊途同归,指向一个「通用子空间」,柏拉图又赢一回?
约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间,表明架构比数据影响大。此发现能解释诸多现象,还有多种应用可能,但也有局限性。
从 Copilot 到 通用 Agent : 阿里在 AI Coding 上的应用和挑战
阿里巴巴代码平台负责人向邦宇在 QCon 大会分享阿里智能研发大模型应用与挑战。介绍探索成果,如代码补全、审查等功能;指出面临用户需求理解、领域知识整合等难题;还提及技术进步带来新机遇,促使从 Copilot 向 Agent 转变。