「AI 大模型」共找到 14236 篇相关文章
腾讯混元开源世界模型!2.0版本一键生成3D空间,游戏关卡随心造
4月16日,腾讯正式发布并开源混元3D世界模型2.0(HY - World 2.0)。它是多模态模型,能理解多种输入,自动生成、重建和模拟3D世界,支持多格式3D资产导出,可与游戏工作流对接。
Sora 2 中国首测?Open AI 这次真成了!
OpenAI提前发布Sora 2模型,可克隆音色,支持多语言。还推出似AI版抖音的社交APP,免费生成视频。测试显示,它有世界知识,能多参生成、自动切镜头,在多方面表现出色,但版权限制严,部分一致性待提升。
何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升
何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。
AI海啸来袭:不只白领,连水电工的饭碗也即将被冲走
作者 Andrew Wilkinson 指出人工智能海啸将冲击各行业,众多工作面临颠覆,给出未来发展时间表。还提醒企业和投资者重视风险,给出对冲策略,也提及 AI 发展可能遇阻碍。
我用7个主流AI工具助手总结4篇写GEO公众号文章的分析及看法
作者白杨SEO参加国平老师线下分享活动,获AI相关启发。还用7个主流AI工具助手总结4篇GEO公众号文章,给出各篇核心观点,并分享自己看法,指出GEO尚无标准方法,企业应按需选择。
jiSGLang集成ktransformers:2TB内存运行Kimi K2 Thinking模型
对于内存多但GPU资源有限的用户,SGLang集成ktransformers的CPU内核,支持直接运行Kimi K2 Thinking模型。它无需等量化,还能微调,虽性能与GPU方案有差距,但给用户新选择。
让机器人在“想象”中学习世界的模型来了!PI联创课题组&清华陈建宇团队联合出品
斯坦福Chelsea Finn课题组与清华陈建宇团队联合提出可控生成世界模型Ctrl - World,可让机器人在“想象空间”预演任务。该模型使用零真机数据,提升下游任务指令跟随成功率。其相关论文已发布于arXiv平台。
Grok 4源代码刚刚泄露!上线倒计时,马斯克xAI估值破1130亿,大模型要变天
xAI再获百亿美元融资,估值飙至1130亿。xAI控制台已有Grok 4和Grok 4 Code源代码流出,计划7月4日后发布。Grok 4智能无与伦比,或打破o3在榜单的领先地位,xAI将成OpenAI等对手。
巧妙!一个传统技术让国产视觉基础模型直接上大分
格灵深瞳的Glint - MVT视觉基础模型表现出色,线性探测准确率高于CLIP等,下游任务效果佳。其引入间隔Softmax损失函数,结合虚拟类别构造等优化方案提升性能,团队专注视觉研发,务实开放。
5个月估值120亿!OpenAI前CTO自曝首个多模态AI,竟要免费开源
OpenAI前CTO Mira Murati创立的Thinking Machines Lab获20亿美元融资,估值达120亿美元。未来几个月将发布首个多模态AI产品,还会开源部分组件,团队全力构建多模态AI以增强人类能力。