机制设计」共找到 2058 篇相关文章

算法论文8

扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧

上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量。

量子位
新闻资讯8

穿潜水服的蟑螂见过没?能搜救、巡管道,下一步还要奔外星

2025年缅甸地震,新加坡民防部队派出经新加坡南洋理工大学佐藤裕孝团队改造的蟑螂参与救援。团队还为蟑螂设计“潜水服”,使其能水下作业。赛博格蟑螂应用正从搜救拓展到巡检,未来或用于外星。

DeepTech深科技
开源动态8

清华发布智能体社会AgentSociety第二代:让社会科学研究真正「跑起来」

AgentSociety²是清华团队推出的社会科学研究新工具,让AI扮演研究助手和实验参与者角色。它打通研究断点,实现从「社会模拟」到「可执行社会科学」的转变,还构建工作流、创新实验环境和智能体设计

新智元
开源动态7

OpenClaw长期记忆:优秀管线与玄学效果

文章拆解 OpenClaw 记忆系统全链路,指出其虽设计理念好,但记忆效果不稳定。介绍 RDSClaw 记忆插件如何补强,该插件与原生系统协作,提升记忆稳定性,在 LoCoMo10 评测中成绩显著。

阿里云开发者
推荐文章7

一文搞懂 Coding Agent 和 Harness

文章介绍编码智能体和 Agent harnesses 设计,阐述 LLM、推理模型与 Agent 关系,指出 harness 是让 LLM 在特定任务更好用的关键。还详细讲解 Coding harness 六个核心组件,并对比了 OpenClaw。

特工宇宙
算法论文8

将注意力旋转 90 度!今天,Kimi 的「注意力残差」火了

Kimi团队发布技术报告Attention Residuals,用依赖输入的注意力机制取代标准深度递归,解决传统残差连接的信息稀释和隐藏状态爆炸问题。实验显示其有计算优势,下游任务表现佳。

机器之心
算法论文8

华为发布业界首个扩散语言模型Agent,部分场景提速8倍!

华为等团队研究发现,把Agent“底座”换成扩散式大模型(DLLM),执行速度提升30%以上,部分复杂任务效率达传统AR模型8倍。其优势源于生成范式,可重塑Agent设计

量子位
产品应用7

不止是玩!有人利用Clawdbot组建了一个虚拟团队接管公司业务

AI智能客服公司SiteGPT创始人分享利用Clawdbot构建AI智能体团队‘Mission Control’的经验。该团队含10个智能体,可协同工作。系统有心跳机制控成本,还有协同平台,已产出多种成果。

AI工程化
产品应用8

1人顶1个Infra团队!OpenAI前CTO新招,让大模型训练跌成白菜价

大模型训练正从‘作坊炼丹’进化为‘工业微调’。OpenAI前CTO创立的Thinking Machines Lab推出Tinker,潞晨云微调SDK兼容其范式,实现算法设计与基础设施解耦,降低成本,提升人效,适用于多场景。

新智元
算法论文8

2篇最新论文,把Deep Research讲透了~

阿里开源Tongyi DeepResearch热度高,文章分享两篇相关技术综述。介绍Deep Research是代理研究新范式,阐述其四大核心模块、优化方法、数据处理、奖励机制,还提及开源系统亮点及相关论文。

PaperAgent