大模型3.0」共找到 10074 篇相关文章

新闻资讯7

挺搞笑,MiniMax模型就是不认识「马嘉祺」

网友发现 MiniMax 模型不认识「马嘉祺」,不同接口和平台均能稳定复现。这或因训练数据清洗和分布问题,使特定词汇生成异常。论文指出 tokenizer 机制缺陷或致模型异常,问题不会随参数规模增消失。

机器之心
开源动态7

3.3k星星爆火!Claude Design开源升级版,中文本地化,支持DeepSeek V4

Anthropic发布的Claude Design能生成UI、人机协作,但国内无法使用且不能用自己的API。Open-codesign是其开源本地化平替方案,支持多模型,功能丰富,保密性好。

开源AI项目落地
新闻资讯8

Ilya罕见发声:模型力出奇迹」到头了

Ilya神在近2万字采访中称,AI正从「规模时代」走向「科研时代」,主流「预训练 + Scaling」路线遇瓶颈。他还探讨了AI泛化、安全对齐、预训练范式等热门话题,给出独特见解。

量子位
新闻资讯8

763亿港元,模型公司最规模IPO!MiniMax登陆港交所,开盘前涨50%

MiniMax正式在港交所主板挂牌上市,股票代码“00100”。此次全球发售约3358万股,募资约55.4亿港元。市场认购热烈,早盘一度涨幅超50%,市值突破763亿港元。其技术多模态齐发,组织高效,为行业提供新样本。

量子位
算法论文8

快9倍还更清晰?Direct3D-S2一键解锁高效3D生成

在高分辨率三维形状生成中,传统方式有计算与内存瓶颈。南京学提出Direct3D - S2框架,基于稀疏体积构建,有空间稀疏注意力机制,加速计算,还引入统一格式VAE,生成质量领先,训练成本更低。

带你学AI
开源动态8

无需训练,即插即用:西湖学发布世界模型WorldForge,让普通视频模型秒变「世界引擎」

自Sora亮相,AI视频可控性成瓶颈。西湖学AGI实验室团队提出WorldForge框架,在推理时为视频模型注入「时空几何」,无需训练,实现单图360°环绕视频生成和视频重运镜等,降低创作门槛。

机器之心
新闻资讯8

李飞飞最新思考:语言模型救不了机器人

本文是对李飞飞的访谈编译。她指出语言模型在世界理解上有短板,空间智能是关键,还探讨了AI发展历程、世界模型重要性等,介绍其公司产品Marble,强调人人在AI时代都有位置。

AI科技评论
算法论文7

阿里、南开学发布免训练,视频模型创新压缩方法

视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。

AIGC开放社区
算法论文8

准确率腰斩!模型视觉能力一出日常生活就「失灵」

EgoCross项目团队聚焦跨域第一视角视频问答评测,揭示现有MLLM在多场景泛化瓶颈。团队提出跨域第一视角视频问答基准EgoCross,经测试揭示模型短板,验证改进方法潜力,研究入选AAAI 2026且数据集等已开源。

量子位
开源动态8

nanobot4,000行代码复刻Clawdbot

nanobot用4000行代码复刻Clawdbot,解决AI从‘被动回答’到‘主动服务’问题。它有核心架构Agent Loop,三主动触发机制,模块化设计,还坚持少即是多原则,让AI成自动化助手。

CourseAI