小实验」共找到 2232 篇相关文章

开源动态8

阿里达摩院开源具身大脑基模:3B激活参数性能超越72B,转身就忘事的机器人有救了

阿里达摩院开源RynnBrain具身大脑基础模型,全系列7个。它是业界首个有 时空记忆的模型,在20项具身Benchmark上超顶尖模型。具而美优势,训练用自研架构提效,数据丰富,输入输出灵活。

量子位
算法论文8

AI看图一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华

随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看图方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。

量子位
产品应用8

MiniMax Agent 开年更新,好的 AI 产品,需要让工具来适应人了

2026年初,Claude Cowork引发关注,开源社区跟进,Anthropic下调功能价格。MiniMax升级Agent,推出桌面端和网页端新功能。通过整理文件、翻译、红书内容流水线等测试,展现其能力与局限,指出Agent应适应人的趋势。

Founder Park
算法论文8

TPAMI | DC-SAM:打破SAM交互限制,基于循环一致性的图像与视频上下文分割方法

北京邮电大学联合南洋理工大学等机构发表论文,提出 DC - SAM 框架及 IC - VOS 基准。DC - SAM 含特征融合、正负双分支循环一致性提示生成等部分,实验在多基准测试获 SOTA 性能,为视觉大模型落地提供方案。

机器之心
算法论文8

真·开外挂!MIT新研究:架构0改动,让大模型解锁千万级上下文

MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理能力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。

量子位
开源动态8

蚂蚁C2LLM:基于注意力池化的代码检索新范式

在Code RAG场景中,传统文本Embedding模型处理代码表现欠佳。蚂蚁集团与上海交通大学联合发布C2LLM系列模型,引入注意池化模块,在MTEB - Code榜单表现出色,还得益于优质训练流程,成果已回馈社区。

PaperAgent
产品应用8

Claude Code 2.1 发布:一口气更新了80多个功能特性

2026年1月7日Claude Code发布2.1.0版本,后又跟了2.1.1修复,更新内容超80条。有Skills自动热重载等新功能、大量bug修复及体验优化。作者建议大家升级,认为它想做完整开发环境。

花叔
开源动态7

Unsloth-MLX:在Mac上微调LLM,代码无缝迁移到云端GPU

对于Mac用户,在原型实验阶段反复租云端GPU是资源浪费。开发者推出Unsloth - MLX,基于MLX框架,让Mac用户本地高效微调大模型,改一行导入语句就能无缝迁移代码到云端,还介绍项目特点、状态等。

AI工程化
开源动态8

从「会表演」到「更会演」:KlingAvatar2.0让数字人拥有生动灵魂

近日快手可灵团队发布 KlingAvatar2.0 技术报告,数字人能‘生动表达’。它有三大创新技术,如时空级联框架等。实验显示其生动性大幅提升,性能超竞品,推动数字人在多领域规模化应用。

机器之心
算法论文7

LLM也会emo,Claude玻璃心、Gemini社恐,Kimi/GLM/ DeepSeek如何?

华东师大和复旦大学研究8大模型家族是否有“情感链”。实验覆盖8大家族20+模型,发现各家族有独特“人设”,如Claude像“文艺青年”。还揭示模型在不同情境下的情绪变化及影响,给出实用建议。

PaperAgent