「世界模型生成」共找到 8925 篇相关文章
谷歌最强大模型付费上线,在DeepSeek开源后被吐槽太贵
谷歌最强模型Gemini 3 Deep Think上线,推理能力强,能将草图变3D场景、搭建游戏。它在多评测基准表现出色,准确率超GPT - 5 Pro等。但仅向Ultra会员开放,月费约1800元,被吐槽贵,开源的DeepSeek-V3.2成冲击因素。
Qwen3-ASR开源:够稳定,能流式,多语言!
今日正式开源Qwen3-ASR系列模型,含两个语音识别与一个语音强制对齐模型,支持多语种。依托创新技术实现精准稳定识别,1.7B模型多场景达SOTA,0.6B兼顾性能效率,强制对齐模型精度超传统模型。
英伟达推理服务器被曝高危漏洞,云端AI模型被攻击直接裸奔
安全研究机构Wiz Research曝光英伟达Triton推理服务器一组高危漏洞链,可组合利用实现远程代码执行,造成模型被盗、数据泄露等后果。英伟达已发布补丁,25.07版本前系统有风险。
北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。
商汤新模型 SenseNova-U1 Pro 曝光,对标 GPT-Image-2,瞄准「设计」赛道
商汤科技在股东大会预告下一代旗舰多模态基座模型 SenseNova-U1 Pro,预计 2026 年 7 月邀测,对标 GPT-Image-2,瞄准「设计」赛道,具备多核心能力,还支持 8K 分辨率输出。
刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」
Cursor 2.0发布重大更新,带来自研编码模型Composer和新协作界面。Composer速度领先,针对软件工程优化;新界面以智能体为中心,可并行运行多智能体,还解决了代码评审和测试瓶颈。
数据邪修大法好:仅用文本数据就能预训练多模态大模型
多模态大模型研发中,行业认为无图文对就无多模态能力。但ReVision研究表明,预训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,能实现跨模态互换,降低成本。
超越ZIP的无损压缩来了!华盛顿大学让大模型成为无损文本压缩器
华盛顿大学SyFI实验室提出LLMc,利用大型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。
记忆罗盘:大模型智能体记忆的表征、操作与演进航向 | 直播预约
记忆对基于大语言模型的智能体迈向通用人工智能至关重要。来自多所高校及华为的研究团队分析超30000篇论文,提出记忆表征与操作分类坐标系,绘制记忆罗盘指明演进航向。2025.12.24有相关直播。
倒计时三周!2026 世界人工智能大会将于 7 月 17 日至 20 日在上海举行
6月17日,2026世界人工智能大会倒计时30天发布会举行,公布主题、生态矩阵等。大会7月17 - 20日在上海举办,设六大板块,有诸多活动和展示,还发布SAIL奖TOP30榜单,公布WAIC City Walk等信息。