token定义权」共找到 1162 篇相关文章

算法论文8

TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文

由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。

机器之心
新闻资讯8

中国AI创业者重登GTC舞台:杨植麟用技术语言讲了一个智能上限突破的浪漫故事|甲子光年

美国当地时间3月17日,月之暗面(Kimi)创始人杨植麟在英伟达GTC演讲,介绍Kimi技术路线图。他提出开源模型要出色,给出Token效率、长上下文、智能体集群三个概念,还探索了未来架构,且将创新开源。

甲子光年
产品应用8

堆了一仓库GPU,却生产不出专业智能?九章云极用AI工厂给出解答

企业接入通用大模型到业务系统,却发现它难以执行任务。九章云极在发布会上推出‘AI工厂’战略,通过训练工厂和Token工厂填平执行鸿沟,前者用强化学习造专业模型,后者让专业智能规模化流通。

机器之心
推荐文章7

《动手写AI Agent》上下文工程:比 Prompt Engineering 更重要的事

文章围绕AI Agent的上下文工程展开,指出其比Prompt Engineering更重要。介绍了上下文工程的分层组织,包括角色定义、通用规则、项目状态和用户指令,还提及项目感知、.ling.md文件及完整System Prompt的组装。

AI Reading Hub
开源动态8

节前重磅:开源旗舰模型新SOTA,智谱GLM-4.6问世

国庆前智谱AI发布新一代旗舰模型GLM-4.6并将开源,它在多方面提升,如编码、上下文长度等,评测性能佳,token消耗降低。经实测,其代码、研究、开发等能力强,成全球开源AI领域重要力量。

机器之心
新闻资讯7

13人干翻Transformer!新架构SSA算力暴减千倍,成本仅Opus 5%

一款基于SSA架构的AI模型SubQ横空出世,其上下文高达1200万Token,计算量比Transformer暴减1000倍,成本不到Claude Opus的5%。打造它的Subquadratic公司仅13人,产品发布后引发AI社区不同反应。

新智元
新闻资讯7

一场由中国公司引发的全球热议:AI服务是否该“对结果兜底”?|甲子光年

2025年末软件行业寒冬,百融云创提出“结果即服务”(RaaS)战略及Results Cloud平台,引发全球热议。其将AI定义为员工,转变了商业风险承担模式,但也面临治理、责任归属等问题。

甲子光年
新闻资讯8

摩尔线程的野心,不藏了

上市15天后,摩尔线程在首届聚焦全功能GPU的开发者大会上,围绕MUSA推出诸多新品,包括新GPU架构、芯片、智算集群和硬件产品,还将开源核心组件,构建生态,其架构创新定义未来AI产业格局。

量子位
新闻资讯8

Google一口气发了多少东西?I/O 2026完整梳理

Google I/O 2026发布会成果丰硕。token处理量大幅增长,13款产品月活超10亿。对话式AI融入多产品,基础设施投入增至约1800亿美元。还发布新模型、平台及工具,构建从芯片到应用的Agent体系。

AI寒武纪
新闻资讯8

领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%

Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革新大模型扩展路径。

机器之心