自注意力层」共找到 1530 篇相关文章

产品应用8

Agent 跑分追平 Codex、成本低至 1.95 美元,这家中国公司做到了

德勤报告显示86%多Agent项目落地失败,硅谷也出现‘无限智能体死循环’。EvoMap团队的EvoX采用‘蜂群式进化’打法,系统容错率翻倍、完成率跃升,成本大幅降低。跑分追平Codex,还展现出组织潜力。

AI科技评论
推荐文章7

给你一套框架,理解AI时代

作者综合多方观点提炼出理解AI时代的三框架。技术栈分底模型能力、中基础设施、上应用场景;价值链是供给驱动,供给侧突破创造新需求;竞争格局在通用赢者通吃、基础设施多元共存、应用快速迭代。

newtype AI
产品应用7

Claude Managed Agents提了两个新改进,解决企业级安全问题

企业把AI接入内网,认证令牌风险大,阻碍全面接入内部API和数据库。Anthropic为Claude Managed Agents提出托管沙箱和MCP隧道两个新解法,核心是让凭证控制权留在网络边界,还介绍了相关沙箱服务商。

AI工程化
算法论文8

Kimi新论文太硬核了!马斯克和Karpathy相继点赞~

马斯克和Karpathy点赞Kimi新论文《Attention Residuals》。该论文由杨植麟带队、苏剑林等参与,提出注意力残差(AttnRes),解决深网络信息稀释问题,还通过工程折中降低成本,实验效果良好。

PaperAgent
算法论文8

RL训练一就够了!单RL超越全参数训练,跨任务跨模型跨算法全部验证

明尼苏达大学、北大和亚马逊团队研究发现,RL收益集中在中间,训练单可超全参数训练。他们提出贡献度指标,经多模型、算法、任务实验验证,还给出三种训练优化策略。

机器之心
算法论文8

Skills刚火,就有零Skill的Agent来了…

Skills爆火之际,云玦科技团队提出不用Skills的零Skill Agent。它以Gemini 3 Pro为后端,在多个评测集表现出色。采用原位进化框架,开源且成本低,或助力开源模型弯道超车。

量子位
开源动态8

VoxCPM2:无tokenizer语音合成,高保真声音克隆

VoxCPM2突破传统TTS系统局限,直接操作连续声学特征,保留音色纹理更完整。基于扩散回归架构,有硬核技术指标,提供三种克隆模式,性能佳,生态完善,微调便捷,但也存在安全风险。

AI工程化
推荐文章7

普通程序员怎样转到AI方向拿到更好的offer

在AI研究员拿天价offer的当下,探讨普通程序员转AI方向拿更好offer的方法,还介绍了AI生态的五个次,包括各岗位、年薪及容量。

王喆的机器学习笔记
产品应用7

全民都在养虾,终于,有人开始给它做“手”了

过去半年,Agent 赛道竞争激烈,大家都在比拼模型等。Violoop 是一块硬件,能在工位打通「看见、判断、动手」闭环,是主动感知型 Agent,它填补了 Agent 生态执行空白,有独特技术细节,资本看好。

AGI Hunt
算法论文8

融资 1200亿后 Kimi 再扔王牌,新架构爆改 Transformer 老配件,比 DeepSeek 同款还省钱

Kimi 发布新论文,提出“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推出“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。

AI前线