世界统一模型」共找到 8105 篇相关文章

产品应用7

央企怎么做超级智能体?对谈中电信天翼AI:自研模型为底座,自主规划是必须,能适应千行百业才行

中国电信天翼AI发布星辰超级智能体,获2025企业级AI Agent榜单央企第一。它依托自研“星辰大模型”,具备全模态、复杂推理等能力。访谈专家指出智能体可直接产出应用,落地需嵌入主业系统,电信持续迭代模型优化它。

量子位
推荐文章8

李飞飞万字长文爆了!定义AI下一个十年

李飞飞新文指出AI下一个前沿是「空间智能」,揭秘其「世界模型」核心框架和三大核心支柱。构建具备空间智能的AI需世界模型,其应用涵盖创意、机器人、科学医疗等领域,有望提升人类生活。

力学与人工智能
开源动态8

社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!

阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。

Hugging Face
产品应用7

Alibaba力作:Ovis-U1 融合理解、生成与编辑,解锁无限可能

OpenAI 2025 年推出的 GPT - 4o 结合图像与语言能力,但引发视觉解码器设计及统一模型训练问题。Alibaba 力作 Ovis - U1 单一模型能完成理解、生成与编辑任务,介绍了其架构、训练过程和应用。

CourseAI
算法论文8

ICLR 2026 | 异常需要定义!中传团队提出开放世界视频异常检测新范式

现有视频异常检测(VAD)方法泛化能力不足,无法适应开放世界需求。中传吴晓雨团队在ICLR 2026发表论文,提出LaGoVAD模型,联合建模视频与异常定义,解决样本密度下降等问题,实验显示泛化性强。

机器之心
推荐文章8

超实用提示词模板!AI科学家教你用协作提示词激发大模型潜力

文章由知名AI科学家Lance Eliot所写,指出主流大语言模型因训练机制变得‘短视’,缺乏深度协作能力。介绍协作提示词技术,能让AI成为主动引导者,并以测试展示效果,还说明了适用场景。

AIGC开放社区
产品应用8

每帧Sora级震撼!Midjourney首个视频模型登场,超逼真大片首测来袭

Midjourney首个AI视频模型V1上线,每月10美金可体验20秒。其视觉效果惊艳,能媲美Sora等,还能一键让图像动起来。成本低,提供多种模式与设置,有技术愿景,未来将完善模块。

新智元
新闻资讯8

月吞100万亿Token!AI中转站OpenRouter赚爆了

OpenRouter宣布完成1.13亿美元B轮融资,估值达13亿美元。它每周处理25万亿个tokens,全球用户超800万。其提供AI推理统一控制层,解决企业多模型管理难题,开源模型崛起使其价值凸显。

新智元
开源动态8

狂涨26.5K star!一个接口搞定20+AI大模型,开箱即用,太香了!

文章介绍开源项目One API,它是LLM API管理与分发系统,能统一管理主流AI模型,用一个接口搞定调用。有友好界面和可视化操作,在Github获26.5K star,还介绍其性能特色、安装使用方法。

开源先锋
推荐文章8

卡帕西点赞Transformer内置计算机!每秒3万Token吞吐,拿下世界最难数独

当前大模型推理顶尖但精确计算不足,Percepta团队在Transformer权重里内嵌可执行程序,通过2维注意力头设计提升推理效率,能在普通CPU上实现每秒3万+Token的流式输出,还精确求解了世界最难数独。

量子位