计算机智能体」共找到 5557 篇相关文章

算法论文8

用动作分块突破RL极限,伯克利引入模仿学习,超越离线/在线SOTA

如今强化学习在多领域成果显著,但在长跨度、稀疏奖励任务中表现欠佳。加州大学伯克利分校研究者提出Q - chunking方法,将动作分块引入基于时序差分的强化学习,解决探索效率和值传播问题,实验表现优异。

机器之心
开源动态7

月之暗面硬刚Anthropic!开源万亿参数Kimi K2,Agent编码性直逼闭源最强!

上周五月之暗面发布并开源万亿参数Kimi K2,外网评价高。它或开启开源AI的“Agentic时代”,在智体和编码基准上表现出色,成本远低于竞品,但推理速度较慢,已可平替Claude。

探索AGI
开源动态8

碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用力超强

国内大模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用力强。测试显示其性碾压DeepSeek V3等模型,训练流程还有独特技术创新。

AIGC开放社区
产品应用7

vLLM 技巧: 在几秒钟内无需重启释放90%的 GPU 显存

EmbeddedLLM介绍vLLM新功“休眠模式”,可在不重启服务时几秒内释放约90% GPU显存,实现模型热插拔与高效轮转,还介绍使用方法、不同休眠级别,提醒生产环境要确保安全。

AI工程化
算法论文8

DeepMind揭示Reasoning内在机制

近年来大型推理模型在复杂任务表现出色,但推理机制成谜。本文提出用推理图解码其‘思考轨迹’,分析环状结构、直径大小和小世界特性,发现蒸馏模型等特点,为理解AI推理及模型优化指明方向。

深度学习自然语言处理
推荐文章7

未来,你的 Agent 怎么付钱?

借 a16z 文章,探讨 Agent payment 领域进展。实现 Agent 自主支付是未来关键方向,现已有迹象且部分企业推出解决方案,但 Agent 处理支付尚未真正自主,还面临角色范围、欺诈、责任归属等难题。

Founder Park
开源动态8

无损加速视觉语言模型推理!轻松剪掉视觉冗余Token|腾讯AI Lab

多图像、长视频让大型视觉语言模型推理成本暴涨,成算力瓶颈。腾讯AI Lab联合CMU提出VScan,通过两阶段视觉token筛选机制,在几乎不损性的前提下实现推理加速,且已在GitHub开源。

量子位
推荐文章8

Python语言从2.7到3.14的力变化与演进逻辑

文章从编程风格、类库生态、性优化等多维度,阐述Python从2.7到3.14版本的力变化与演进逻辑。如编程风格现现代化转型,类库生态战略性调整,性优化有突破性进展等,还分析了演进背后的推动力及未来趋势。

阿里云开发者
开源动态7

开源端到端语音大模型:直接从原始音频输入,生成语音输出

目前大模型大多只输出文本,人机音频交互不顺畅。Step - Audio团队开源端到端语音大模型Step - Audio - AQAA,直接听懂音频问题并合成语音回答,介绍了其架构和各核心模块。

AIGC开放社区
算法论文8

航空发动机用上大模型:解决复杂时序问题,性超越ChatGPT-4o实现SOTA|上交创智复旦

上海交通大学李元祥教授等团队提出ITFormer架构,构建EngineMT-QA数据集。ITFormer融合时序数据与大语言模型,适配多种编码器和模型,在EngineMT-QA预训练后达SOTA水平,实现高效数据分析。

量子位