超脑2.0」共找到 4227 篇相关文章

算法论文8

越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26

大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。

新智元
产品应用7

一个记忆库,N 个 AI 助手用!mem0 OpenMemory MCP 打通 Cursor/Claude/Windsurf ~

OpenMemory MCP是本地运行的共享记忆系统,基于MCP协议,让多个AI工具共享上下文记忆。它通吃主流MCP客户端,提供标准API,数据私密,有可视化面板且一键安装。官方列举应用场景,虽扩展性待考,但方向值得关注。

AI进修生
新闻资讯8

Figure机器人直播100小时打擂台,3秒一个不停分拣13万包裹!

Figure公司F.03机器人直播分拣包裹100小时,分拣13万个。10小时人机对决中,人类以不到200个包裹险胜。CEO称这是人类最后一次赢,具身智能飞轮或已过拐点。

新智元
开源动态8

一个级搜索Agent开源,低成本拉满搜索推理能力!小参数、慢思考。

MiroThinker 1.5发布,打响2026年AI模型进步第一枪。它以小参数实现高性能,解决信息雾霾、AI幻觉、决策无力等问题,通过交互式扩展和时序敏感训练沙盒技术,展现强大搜索推理能力。

开源AI项目落地
算法论文8

LLM助力突破尘封60年数学猜想!北大王立威团队大幅刷新斯坦纳比下界

北大王立威团队构建基于 LLM 的框架,聚焦 Gilbert - Pollak 猜想,将二维平面斯坦纳比从 0.824 改进到 0.8559。该进展被陶哲轩收录,工作已被 ICML 2026 接收,代码和证明均已开源。

机器之心
开源动态8

国产大模型持续开源的一周:DeepSeek、Qwen、字节、书生~

国产开源大模型持续发力,本周DeepSeek V3.1、字节Seed-OSS-36B等接连发布。此外,马斯克xAI正式开源Grok 2.5,英伟达也开源了Nemotron-Nano-9B-v2。PaperAgent专题进行了梳理盘点。

PaperAgent
算法论文8

纯靠“补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究

剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,文本推理至少40%,代码已开源。

量子位
产品应用8

基于浏览器请求录制与AI代码生成的E2E接口自动化测试实践

文章以阿里云DataWorks为例,介绍通过浏览器录制插件捕获请求数据,结合AI编程工具生成接口封装与测试用例,解决复杂平台自动化测试难题,对比传统与新范式,剖析新范式优势、协作机制等。

阿里云开发者
产品应用7

Qwen3接连放出No Thinking, Thinking两大模型,Gemini2.5 pro顶不住啦

Qwen推出非推理模型`Qwen3 - 235B - A22B - Instruct - 2507`后,又放出推理模型`Qwen3 - 235B - A22B - Thinking - 2507`。非推理模型在多方面功能增强,推理模型能力强,DeepseekR1,可试用。

CourseAI
开源动态8

刚刚!Meta把大模型塞进机接口,隔空读直逼开颅植入水平,代码全开源

Meta推出Brain2Qwerty v2,号称性能最强端到端方案,能基于非侵入式部记录实现实时句子级解码,准确率逼近开颅手术水平。还开源代码,公开数据集,旨在帮损伤患者交流。

AI寒武纪