「开放权重语言模型」共找到 1780 篇相关文章
腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式
过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。
GPT-5.2破解数论猜想获陶哲轩认证!OpenAI副总裁曝大动作:正改模型核心设计,吊打90%研究生但难出颠覆性发现
OpenAI 发布由 GPT - 5.2 加持的科研平台 Prism 并免费开放。副总裁 Kevin Weil 称目前模型难有颠覆性发现,但能加速科研。GPT - 5 能力超 90% 研究生,OpenAI 将优化其设计,让它更谦逊并自我核查。
谷歌发布 Gemma Scope 2,深化对 LLM 行为的理解
Gemma Scope 2 是谷歌推出的解释 Gemini 3 模型行为的工具,结合稀疏自编码器和转码器,能让研究人员检查模型内部表示。它从多方面扩展了原先的 Gemma Scope,还引入针对聊天机器人的分析工具,已发布权重。
“商业的HTTP”来了:谷歌CEO劈柴官宣 UCP,Agent 直接“剁手”下单,将倒逼淘宝京东“拆家式重构”?
谷歌CEO近日宣布开放标准UCP,目标是让Agent在线购物,将购物流程拆解成可复用组件。风险投资人认为其想成商业领域的“HTTP”,不少行业人士看好。它还能与其他协议协同,发布首日吸引众多伙伴。
人类记忆 vs 大模型记忆,到底差在哪?
这篇发表于 2025 年 10 月《Trends in Cognitive Sciences》的文章,探讨用人类“情景记忆”研究成果改进记忆增强型大语言模型。指出现有 AI 记忆系统存用数据低效,呼吁构建“类人情景记忆”AI,还剖析差异并给出评估方法和展望。
100万亿Token看懵硅谷!全球一半算力写代码,另一半在「搞颜色」 ?
OpenRouter和a16z联合发布报告,基于100万亿Token实证数据揭秘2025年AI发展。开源模型流量占比达30%,推理模型成主流,编程和角色扮演是主要使用场景,亚洲付费使用量翻倍,中文成全球第二大交互语言。
LLM算力告急?把文本变图片,推理成本直接减半!
大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。
AI也能换岗了!Anthropic教智能体交接班,不怕长任务断片
Anthropic设计出长时智能体运行框架,让AI跨越数小时任务渐进式推进。其采用双智能体架构,结合环境管理方法,提升全栈Web应用开发稳定性,但仍有通用与多智能体架构选择等开放问题。
清华、北大,上海交大等发布人机协同训练框架,让机器人零样本学会新技能
清华、北大等发布人机协同训练框架MotionTrans,能让机器人零样本学会新技能。它将人类数据翻译成机器人语言,构建数据集,经格式转换、速度调整等处理后训练模型,实验验证其有效性,且数据、代码和模型已开源。
顶会SOSP'25最佳论文,被一个国产自研操作系统拿下
国产自研开源操作系统星绽的学术论文获顶会SOSP'25最佳论文。它专注高可扩展内存管理研究,兼顾性能与安全。星绽由多单位联合研发,用Rust语言,解决传统系统难题,已有多篇论文被国际顶级学术会议录用。