大模型3.0」共找到 10122 篇相关文章

开源动态7

毫秒响应延迟!开源统一语音对话模型Voila

Voila是开源统一语音对话模型,能以自发、实时且有情感的方式与人类互动。它采用全新端到端架构,响应延迟仅195毫秒,支持超百万种预构建声音,适用于多种语音应用。

带你学AI
新闻资讯8

美国视频生成老炮儿,入局世界模型

Runway发布首个通用世界模型GWM - 1及一系列变体,包括GWM Worlds、GWM Avatars、GWM Robotics,均基于Gen - 4.5构建。还对Gen - 4.5升级,新增原生音频生成、编辑和多镜头编辑功能。

量子位
开源动态7

Meta 发布 Docusaurus 3.9,新增 AI 搜索功能

近日 Meta 发布 Docusaurus 3.9,重点更新有现代化运行时环境、增强 AI 搜索能力、提升国际化灵活性。如支持 DocSearch v4 让用户对话查内容,提高 Node.js 最低要求,改进 i18n 配置等。

InfoQ
新闻资讯7

辍学潮来了?19、20 岁年轻人“逃离”教室去 AI 创业,20 多年创业佬断言:他们的机会比

云存储公司 Box 创始人 Aaron Levie 称,19、20 岁年轻人很多辍学投身 AI 创业。他认为 AI 让初创公司生产力幅提升,巨头优势不再,年轻创业者迎来黄金机会,还分享了创业建议。

AI前线
推荐文章7

2026 将近,世界模型到底更「世界」了吗?

近期 Runway 发布相关产品,让「世界模型」讨论再聚焦。其定义从强化学习语境延伸,业内理解不断变化,概念边界变模糊。如今被推到和 LLM 同级,出现概念同名但内核分裂现象。

机器之心
新闻资讯8

不得了,这个新技术把视频压缩到了0.02%!

中国电信人工智能研究院的生成式视频压缩(GVC)技术,将视频数据压缩率干到0.02%,还能保持画面高清连贯和细节。它以‘用计算换宽带’为核心理念,在实测中表现优异,有诸多应用场景。

量子位
开源动态7

any-llm:又一个统一模型服务接口的Python代理库

Mozilla AI开发的开源项目any-llm,解决多LLM提供商接口统一问题,能让开发者用一个接口调用不同语言模型。它吸取此前产品长处,有统一接口等优势,使用和安装简单。

AI工程化
新闻资讯7

马斯克“开”,600亿重金收购Cursor

SpaceX 宣布将以 600 亿美元收购代码生成初创公司 Cursor,或支付 100 亿美元合作。此前 xAI 编程项目落后,3 月挖角 Cursor 核心人员。Cursor 受竞争压力且缺算力,合作有望提升模型智能水平。交易或影响 SpaceX IPO 估值。

InfoQ
产品应用8

Codex 更新:一个 AI,接管你所有软件。

Codex 迎更新,有望成 OpenAI 超级应用核心。它能与多工具协作,超 300 万开发者在用,近半使用场景非写代码。具备跨应用多 Agent、非编码任务处理等功能,还增添图像生成等特性。

AI进修生
新闻资讯7

《时代》2025重塑世界的五AI进展

本文讲述2025年AI重进展。中国Deepseek R1开源模型冲击全球格局,AI具备思考能力,特朗普政府推“星际之门计划”,AI公司支出逼近1万亿美元,同时AI与人类关系更复杂,引发风险思考。

AIGC开放社区