「彭宇新团队」共找到 6212 篇相关文章
联合理解生成的关键拼图?腾讯发布X-Omini:强化学习让离散自回归生成方法重焕生机,轻松渲染长文本图像
图像生成领域,自回归与扩散模型技术路线之争不断。腾讯混元团队发布X-Omni模型,通过强化学习提升自回归图像生成质量,能渲染长文本图像。该模型已开源,还构建奖励系统评估生成质量。
豆包悄悄上线的这个新功能,也能用眼睛推理全世界了。
作者分享豆包新上线的视觉推理功能,在PC和手机场景使用体验良好。通过ChinaJoy图片、德爷相关图片、表情包等实例展示其推理能力,虽有软肋但很实用,还免费,体现出与其他工具的差距。
公司业绩大爆发,芯片大佬身家逼近两百亿
在《2025新财富500创富榜》中,瑞芯微大佬励民身家173.8亿成福州第二富豪,财富较去年涨73%。他2001年创立瑞芯微,多次带领转型。近年公司业绩佳,但大股东抛减持计划,且面临行业风险。
“稚晖君”智元机器人豪掷21亿,抢跑宇树、砸出“人形机器人第一股”?!
北京时间7月8日晚,智元机器人相关主体拟21亿收购上纬新材63.62%股份,交易完成将成绝对控股股东,有望成A股“人形机器人第一股”。智元成立2年多,产品多元且已完成9轮融资。
心芯相栖黄思铭:我们做了只像狗狗一样的小猫 | 00 后创业者系列
2023年,黄思铭因世界变化快、大学教材陈旧而从杜克休学。他结合自身幸运经历,想借AI普及优质关系。2024年6月,其团队上线虚拟角色小喵希拉,教AI与人做朋友,目前已获不少用户。
从文本到3D动画:AnimaX重新定义3D动作合成方式
北航与清华推出3D动画框架AnimaX,结合视频扩散模型运动先验与骨骼动画可控性,让任意骨架3D角色自然动起来。其核心方法灵活控制动作,虽有局限,但为3D动画创作打开新局面。
英伟达笑到最后!训练2000步,1.5B逆袭7B巨兽,Scaling真来了
英伟达团队提出ProRL训练法,将强化学习扩展到超2000步。用此方法训练的15亿参数模型媲美70亿参数的Deepseek - R1 - 7B,在多任务中表现出色,解决了熵崩溃和训练不稳定问题。
PaddleOCR3.0全面开源!文档解析PP-StructureV3:PDF秒变高质量结构化文件!
在大模型与RAG技术发展下,结构化数据愈发重要。飞桨团队打造PP - StructureV3并随PaddleOCR3.0全面开源,它能将文档精准转为结构化文件,有精度高、能力多等优势,还介绍了使用方式。
100%纯血国产AI反超Suno!一个下午做出百万预算主题曲
流媒体平台Deezer数据显示,AI歌曲产能虽高但播放率低,尤其中文歌问题突出。音潮团队从底层重构音潮大模型V4.0,实现算力国产化,产品矩阵四线齐头并进,走出一条有别于Suno的发展路线。
Waver:面向统一图像与视频生成的高性能基础模型
字节提出的Waver是面向统一图像与视频生成的高性能基础模型,支持T2V、I2V、T2I。它引入新架构、结合筛选流程与质量模型。虽有局限,但表现出色,架构设计独特,功能多样。