「具身智能网络」共找到 3994 篇相关文章
LightMem用3招重新设计了LLM的记忆,结果出乎意料
LLM在超长多轮对话中有上下文窗口有限、记忆系统昂贵的痛点。LightMem借鉴人类记忆机制,用三招重新设计LLM记忆,实验显示其准确率超基线,还降低token使用量、API调用和运行时间。
开源屏幕感知AI助手,快捷键即调,随时看懂屏幕上的一切!
日常Windows桌面工作调用AI助手常打断专注流。GitHub新开源工具Everywhere,能自动感知屏幕内容,快捷键即调,支持多模型,有网络搜索和Markdown渲染功能,多种场景适用。
浙大提出Translution:统一Self-attention和Convolution,ViT、GPT架构迎来新一轮性能突破
近日,浙大与新加坡国立大学提出新型深度神经网络基础操作Translution,融合Self - Attention与Convolution优势,实现二者统一。基于它构建的网络在ViT和GPT架构下性能提升,但对算力要求更高。
KV-Cache 实战策略:生产环境中的分页、固定与复用技术解析
在大语言模型推理场景中,KV - Cache 是平衡性能与成本的核心技术,但生产环境中面临诸多问题。本文聚焦其分页、固定与复用三大战术,结合原理、实践与案例,为开发者提供解决方案,还探讨了未来演进方向。
从「会说」迈向「会做」,LLM下半场:Agentic强化学习范式综述
过去LLM训练多依赖PBRFT范式,但局限明显。2025年初起,Agentic RL新范式受关注。此综述论文梳理该方向,覆盖500+研究,构建理论框架,讨论未来挑战,助LLM从「会说」迈向「会做」。
仅需152个样本,性能提升48%:Memory-R1如何重塑Agent记忆能力?
这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在长对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。
小扎噩梦来了!MSL两月爆雷8人闪辞,PyTorch元老出走实验室人心崩盘
Meta的超级智能实验室(MSL)成立仅两月,至少八位核心员工离职,不乏PyTorch元老和新招募的硅谷天才,部分直奔OpenAI。内部重组频繁、战略摇摆,Meta AI大计或翻车。
EMNLP25 | "大模型在环"技术新突破:Dial-In LLM 推动中文客服意图聚类新范式
本文提出LLM-in-the-loop意图聚类框架,以传统聚类为骨架,微调后的中文LLM做语义裁判和命名批注。在10万+真实客服通话数据集上超越基线,解决现有方法依赖词向量、缺乏可解释性、调用大模型成本高的问题。
2025临界点:AI智商超越人类,经济规则即将改写
AI平均智商超110,2025年将参与经济全链条操作。AI经济浮现,具备全天候自动运行、无劳动力供给限制、或成非稀缺经济等特点,还能降低交易成本、减少非理性决策,或带来人类第三次理性化浪潮。
Claude Sonnet 4 支持百万上下文了,AI Coding 的想象力更大了
Anthropic宣布Claude Sonnet 4支持100万Token上下文窗口,容量为之前5倍。该功能已在部分平台公测,将推给更多用户。它支持复杂任务,有新定价和成本优化方案,获早期用户高度评价。