大模型开源」共找到 10103 篇相关文章

开源动态8

首个自主数据科学的智能体

DeepAnalyze是业界首个能自主完成数据科学任务的智能体语言模型,可自动执行数据准备、分析等任务,支持多种数据源,且模型、代码等全部开源,还给出了使用和开发方法。

GitHubStore
开源动态8

Ilya刚预言完,世界首个原生多模态架构NEO就来了:视觉和语言彻底被焊死

当Ilya断言模型未来在于架构创新时,中国团队推出全球首个可规模落地的开源原生多模态架构NEO。它颠覆传统拼接模式,从根上融合视觉与语言,以简洁架构证明架构聪明才是下一代AI竞争力。

量子位
开源动态8

跨芯片统一优化,DLCompiler与DLBlas驱动算子极致表现

9月10日,上海AI实验室DeepLink团队开源DLCompiler和DLBlas。前者是扩展Triton的深度学习编译器,后者是面向模型的高性能算子库。它们有跨架构DSL扩展等亮点,在多芯片上实现性能优化,还解决了DSA芯片优化难题。

OpenMMLab
算法论文8

最新研究揭示视觉模型与人脑的对齐机制

FAIR与巴黎高等师范学院通过训练自监督视觉Transformer模型(DINOv3),评估脑 - 模型相似性。发现模型小、训练数据量和图像类型影响相似度,DINOv3学到的表征会逐步与人脑一致。

量子位
新闻资讯7

融资35亿后,Kimi神秘模型现身竞技场

模型竞技场上,神秘模型Kiwi - do现身,自报来自月之暗面Kimi。网友推测它可能是K2 - VL,其通过VPCT测试或改变多模态Agent格局。2025年末Kimi获35亿融资,将用于K3模型研发。

量子位
算法论文8

ICML 2025 | 如何在合成文本数据时避免模型崩溃?

随着生成式AI发展,合成数据成模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议上,上交等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。

机器之心
新闻资讯8

a16z 合伙人:AI 正将 10 倍工程师“降级”为 2 倍!应用层已无技术护城河,未来在基础设施和业务深耕

Andreessen Horowitz (a16z) 的合伙人 Martin Casado 在对话中指出,当前AI模型竞争格局似当年云计算战,寡头垄断将降临。他还谈到AI对开发者、投资决策、市场格局的影响,以及对AI安全、开源等问题的看法。

AI科技大本营
开源动态8

世界模型评测的最盲区,被这个新基准捅破了

过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出新基准MemoBench,测试了主流模型,揭示其短板。

机器之心
算法论文8

拒绝不必要Think:微软&北提出第一种自适应型混合推理模型

型推理模型冗长思考开销,微软研究院和北提出型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。

PaperAgent
算法论文7

英伟达说,小语言模型(SLM)是智能体的未来

英伟达论文指出小语言模型(SLM)是代理人工智能未来。SLM参数小于100亿,可装在消费电子设备。英伟达认为其强、适合代理系统且经济。微软、英伟达等多家厂商的小模型表现出色,文中还分析了SLM优势及代理架构。

AI与安全