b(v)」共找到 1258 篇相关文章

开源动态7

美团也开源了大模型,但我觉得他们的野心是通用生活Agent。

美团发布并开源560B参数的MoE模型LongCat - Flash - Chat,推理速度快。与DeepSeek V3对比,输出速度优势明显。美团多个落地或内测AI功能服务C端生活场景,目标是打造通用生活Agent。

数字生命卡兹克
开源动态7

这可能是,全球最强开源Agent模型,走了一条反Scaling Law的全新范式!

MiroThinker v1.5开源,其30B小模型在Agent benchmark上击败万亿参数的Kimi K2T。它以交互深度为新Scaling维度,训练有严格时间管控,实测表现超Search Agent,“小模型+强交互”或成新方向。

探索AGI
开源动态8

第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力

新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B长文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。

新智元
新闻资讯7

禁令之下,黄仁勋再用“阉割芯片”抢夺中国市场

美国芯片出口管制冲击英伟达,其在中国市场损失大、份额降。黄仁勋计划7月推‘阉割芯片’B20、B40/B30抢市场。不同客户有选择倾向,同时国产GPU有机会也面临难题,企业还尝试海外训练模型。

芯师爷
开源动态8

百度开源视觉理解模型Qianfan-VL!全尺寸领域增强+全自研芯片计算

今天百度智能云千帆推出全新视觉理解模型Qianfan - VL并全面开源,含3B、8B和70B三个版本,基于自研昆仑芯P800计算。它特点多、性能优,应用场景广,未来还将推新产业级模型。

量子位
新闻资讯7

Qwen 3-235B Aider编程能力击败Claude3.7,成本便宜百倍

Qwen3-235B-A22B在Aider多语言编码基准初步测试中击败Sonnet 3.7 Thinking和OpenAI o1,成本便宜150到600倍。Qwen3-32B准确率超GPT-4.5和GPT-4o ,代码编辑格式正确率达100%。

AI寒武纪
产品应用8

B, 我去,新手小白也能使用InfiniteTalk搭建属于自己的数字人啦 ,真的太简单啦!!!

文章聚焦InfiniteTalk,剖析数字人视频制作痛点,阐述其以“稀疏帧视频配音”破题,具备无限长度、全身与表情同步等优势,介绍核心功能、使用方法,对比同类项目,凸显其多方面优越性。

小华同学ai
推荐文章7

本地LLM万字救场指南来了!全网超全AI实测:4卡狂飙70B大模型

文章围绕本地大语言模型(LLM)展开,针对实用性和经济性问题,用Dell Precision 7960塔式工作站对主流模型测试。涉及不同尺寸模型、推理框架等,给出不同配置下性能指标及使用建议,还模拟真实场景测试。

新智元
开源动态8

500美元刷新SOTA!训练成本砍到1/200,华人团队重构视频生成范式

香港城市大学等团队发布图像 - 视频生成模型Pusa V1.0,在基础大模型上引入VTA机制,用3860对视频 - 文字数据、约500美元微调,在I2V超越Wan - I2V - 14B实现SOTA,还解锁零样本任务能力。

量子位
开源动态7

Qwen3又又又发布了新模型~~~

Qwen3团队继发布`Qwen3-235B-A22B-Instruct-2507`和`wen3-235B-A22B-Thinking-2507`后,又发布`Qwen3-Coder-30B-A3B-Instruct`。该简化模型性能和效率出色,有多项关键增强功能,且是非思考模型,输出效率高。

CourseAI