Claude新模型」共找到 10003 篇相关文章

开源动态8

用短视频成本生成长视频,字节Seed注意力机制让计算量降低85%

字节Seed与斯坦福等机构推出模型,其注意力机制MoC能让长视频生成计算量降低85%,质量不减且保持连贯性。团队将视频生成定义为上下文检索任务,提出MoC机制并阐述实现方法。

量子位
算法论文8

VLM 实现 10%的精度提高,13.1倍加速!纽约大学算法让视觉语言模型更小、更快、更准确

纽约大学研究团队用QSVD方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。

AIGC开放社区
开源动态8

这个生图模型有点夯:4K直出的,国产的,开源的!

商汤开源的生图模型SenseNova U1.5-Lite-Preview亮点十足,它是国产、4K直出、轻量且可指哪儿改哪儿的原生统一多模态模型。能应对复杂创作和编辑任务,技术源于NEO-Unify架构,评测成绩佳,不过还是早期预览版。

量子位
新闻资讯8

Cursor 套壳、Cloudflare 上架、老黄邀请,中国模型杀进了硅谷的 AI 供应链

3月19日,Cursor发布模型Composer 2,后被发现底层基于中国Kimi开源模型K2.5微调。此外,Cloudflare将K2.5上架到边缘计算平台,成本降77%;黄仁勋邀Kimi创始人演讲;马斯克两度点赞Kimi。

Founder Park
开源动态8

百川开源医疗增强大模型 Baichuan-M2:更符合中国临床诊疗场景,可 4090 单卡部署

百川智能发布并开源医疗增强大模型 Baichuan-M2,以更小尺寸反超 OpenAI 模型。它可 4090 单卡部署,成本低,在 HealthBench 评测表现佳,免费开源,更适配中国临床诊疗场景。

InfoQ
新闻资讯8

30人团队震撼英伟达!Jim Fan自曝三个教训,重押世界模型

英伟达Jim Fan带队创立GEAR实验室,30人团队产出惊人,涵盖机器人学习完整技术栈。团队有GR00T基础模型等成果,Jim Fan还分享三个教训,重注视频世界模型,提出仿真世界三阶段,指出物理AI未来是基础设施。

新智元
算法论文8

真实联网搜索Agent,7B媲美满血R1,华为盘古DeepDiver给出开域信息获取解法

华为诺亚方舟实验室提出 Pangu DeepDiver 模型,实现 LLM 搜索引擎自主交互范式。它用真实互联网数据训练,在 WebPuzzle 等基准测试中,7B 的 DeepDiver 媲美 671B DeepSeek - R1,展现强大信息获取与泛化能力。

机器之心
开源动态7

最强开源Agent!Kimi K2接入Claude Code,爽翻~【喂饭级教程+实测】

上周五Kimi开源最旗舰模型K2,它是1000B参数MoE大模型,专为Agent场景优化,API已上线且兼容多API。文章给出Kimi - K2接入Claude Code的喂饭级教程及实测,实测显示组合表现有亮点也有不足。

开源星探
开源动态8

别问树模型了!死磕结构化数据,清华团队把大模型表格理解推到极限

AI 时代处理结构化数据成痛点,LLM 大模型难以满足生产要求。清华大学与稳准智能联合发布的 LimiX 系列模型,做到真正通用,在跑分和实际落地表现出色,其轻量级版本 LimiX - 2M 适合边缘设备和科研场景。

机器之心
产品应用7

Claude Cowork 推出功能 Dispatch:Claude 从此开启「异地办公」

Anthropic为Claude Cowork推出功能Dispatch,能让用户用手机给电脑上的Claude派任务。它代码本地运行,保障数据安全,还支持持久对话。目前已对Max订阅用户上线,不过存在多设备支持等问题。

AGI Hunt