Tokens服务」共找到 1237 篇相关文章

推荐文章8

Evolvent AI 胡梦康:Agent 可能会被模型吃掉,但帮助 Agent 进化不会

Evolvent AI 创始人胡梦康认为 AI 下一阶段是让模型自主迭代。公司搭建 Self - Evolving Agent Infrastructure,希望成 Agent 进化的数据基础设施供应商。胡梦康分享研究历程、对 Agent 方向判断及公司业务,探讨 Agent 数据等问题。

Founder Park
算法论文8

DeepSeek点燃大模型效率之争,阶跃火速接棒:JetSpec让大模型解码速度最高提升近10倍

近期,DeepSeek发布DSpark,阶跃星辰发表JetSpec论文,二者聚焦大模型推理效率。DSpark关注验证效率,JetSpec从Draft生成本身入手。结果显示,二者都有加速效果,共同表明推理效率正成Agent落地关键变量。

量子位
产品应用7

优步通过实时信号与 Listwise 排序改进餐厅推荐

优步在Uber Eats推荐系统引入实时用户信号与Listwise排序法,用实时信号处理层替换早期特征流水线,还引入Listwise排序优化候选餐厅排序,降低特征漂移,保障系统性能。

InfoQ
算法论文8

让思考更准更长!强化学习新算法FIPO来了

阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。

千问大模型
新闻资讯8

黄仁勋暴论核弹:AGI已经实现,Ilya错了,程序员有10亿

在Lex Fridman的专访中,黄仁勋抛出诸多惊人观点,如称已实现AGI,反驳Ilya“预训练触顶”言论,认为推理计算难且重要,还对未来技术、行业、职业发展等多方面进行展望。

量子位
新闻资讯7

多次全球性中断后,Cloudflare 推出了“Code Orange: Fail Small”韧性计划

Cloudflare 发布“Code Orange: Fail Small”韧性计划,防止重大网络中断致大规模服务中断。计划优先考虑受控发布等,逐步推进改善,预计 2026 年一季度末完成部分改进。

InfoQ
产品应用8

滴滴给我发了个赛博助理,专管出行的那种

滴滴上线的Agent小滴,让打车更智能个性。用户只需一句话,就能提出多样需求,小滴还能识别模糊需求。它激活了滴滴运营积累,体现行业新趋势,成了用户的赛博出行助理。

量子位
算法论文7

中移动九天团队MultiPL-MoE:全新Hybrid-MoE架构用于增强通用大模型低资源代码能力

大语言模型在有限计算资源下提升多语言代码能力面临挑战。中国移动九天团队提出 Hybrid MoE 架构 MultiPL - MoE,耦合两层专家选择机制优化,实验证明其在增强低资源代码能力、缓解高资源语言遗忘上有效。

机器之心
产品应用8

一站式 AI 短剧创作神器

Toonflow 是 HBAI-Ltd 开发并开源的一站式 AI 短剧创作工具,可将小说或剧本快速转化为动画短剧,集成多种功能,0 门槛全流程 AI 化,提升创作效率 10 倍+,支持多系统,兼顾易用性、扩展性和本地化部署需求。

GitHubStore
推荐文章8

Harness不是目的,知识才是护城河 —— 一个AI工程交付团队的知识沉淀实践

本文指出构建Harness工作流非最终目的,私域和团队知识沉淀才是技术护城河。分享AI Team工程交付编排系统中知识分层架构设计、团队知识库共建共享、工作流成知识沉淀载体、突破人机交互瓶颈及落地经验与思考。

腾讯技术工程