大模型开源」共找到 10086 篇相关文章

算法论文8

别再用单选评测骗自己了!Amazon新论文揭示了模型在多选题中的3种系统性偏差

Amazon新论文揭示模型做多选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型多选题正确率。

深度学习自然语言处理
开源动态7

超越ZIP的无损压缩来了!华盛顿学让模型成为无损文本压缩器

华盛顿学SyFI实验室提出LLMc,利用型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。

量子位
开源动态8

彻底戳穿AI「失忆症」!超越OpenAI全局记忆,中国队开源LLM记忆操作系统

语言模型有「记忆」缺失问题,国内顶尖团队打造出操作系统级AI记忆框架MemOS并开源且可商用。它将「记忆」升为「一级资源」,用MemCube封装记忆,评测显示性能优于OpenAI全局记忆方案。

新智元
新闻资讯7

独家|RoboScience 机器科学完成10亿元融资,资金将用于强化 VLOA 模型与本体

AI科技评论独家消息,RoboScience机器科学近日完成10亿元A轮融资,将深化VLOA模型技术,推进自研机器人本体工程化与量产。其VLOA模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。

AI科技评论
开源动态8

清华姚班团队,开源具身智能视觉语言动作(VLA)模型工具箱,打造行业通用技术底座

清华姚班团队所在的原力灵机公司,开源了基于PyTorch的视觉语言动作(VLA)模型工具箱Dexbotic。它能打造通用底座,解决行业研发困境,其预训练模型表现出色,还与Hugging Face合作推出评测平台。

AIGC开放社区
开源动态8

最鲁棒的MLLM!港科开源「退化感知推理新范式」 | AAAI'26

多模态语言模型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港科等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。

新智元
开源动态7

年底,国产开源LLM又迎来一波爆发:Qwen、美团、智谱、腾讯、百川

年底国产开源LLM爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式。

PaperAgent
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现模型高效端到端长时记忆

机器之心发布文章介绍,模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的模型长时记忆框架。

机器之心
开源动态8

5Y News|Kimi发布并开源 K2.5 模型,带来全新视觉理解、代码和Agent集群能力

2025年1月27日,月之暗面发布并开源Kimi K2.5模型,它是迄今最智能全能的模型,在多任务有出色表现。支持多模态输入,具备新能力,还推出Kimi Code工具,集群能力也开启Beta测试。

五源资本 5Y Capital
开源动态8

腾讯开源具身基座模型,首席科学家张正友详解“三层脑”如何破解机器人反应慢

WAIC 2026 期间,腾讯开源三款具身基座模型。首席科学家张正友称此前用 OpenClaW 调度机器人效果差,后设计 TairosAgent 框架。腾讯将具身智能拆成三层,配合具身智能体和框架构成完整矩阵,还解决语言信息不足等问题,并在工业和养老场景测试。

InfoQ