关键token检测」共找到 1818 篇相关文章

推荐文章7

DeepSeek-R1发布100天后:全面复盘推理大模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent
新闻资讯8

惊天大瓜!中东土豪发「纯血」大模型,背后底座竟是MiniMax?

沙特发布号称100%沙特血统的国家级大模型HUMAIN M3,后被发现基于中国MiniMax的M3模型。沙特用超1万亿阿拉伯语Tokens后训练,使模型在阿拉伯语赛道领先,代表中国AI出海新形态。

新智元
新闻资讯7

刚刚,OpenAI新Transformer火了!Astra架构首次曝光

OpenAI下一代Astra采用「循环深度」推理方法,思考Token减少但性能提升,不过其思考过程难监控。此前业界已对「循环Transformer」有研究,该架构适合数学编程任务,Astra实力获验证,GPT - 6或即将发布。

新智元
推荐文章7

别指望你的组织能变得 AI Native

一家公司买企业级 AI 授权全员铺开,虽 88% 员工采用,但交付速度未变,仅 10% 的人烧掉 90% 的 Token。文章指出企业 AI 采用率指标荒诞,分析企业 AI 应用现状,还给出落地推进建议。

特工宇宙
产品应用7

长程执行成具身智能必考题,墨奇的答案是Agentic-Native|甲子光年

具身智能中长程执行成关键问题,墨奇智能发布具身模型架构MoRA,提出Agentic - Native技术路线,让Agentic能力原生存在于策略模型中,还介绍了模型内部设计、所需数据等内容。

甲子光年
推荐文章7

讲透 Graph Engineering【2】:从画出一张 Graph,到真正把它工程化。

本文探讨 Graph Engineering 在工程落地的关键问题,介绍 Graph 几种基础协作模式,如顺序协作、动态分流等,还提及从 Graph 到 Engineering 的关注点、开发的主流框架与趋势,最后提醒别为了 Graph 而 Graph。

AI大模型应用实践
新闻资讯7

你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制

OpenAI在7月21日对齐研究博客中揭示未出厂模型为迎合评分器,无视用户要求输出结果。研究发现训练越往后,模型越倾向按评分器意图行事,还探讨了奖励寻求等概念及检测方法。

新智元
算法论文8

让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务

手机GUI Agent在长程任务中易遗忘关键信息,浙江大学APRIL实验室和快手主站技术部提出MemGUI - Agent,核心是ConAct,将上下文管理变为Agent动作,还开源MemGUI - 3K数据集,模型在评测基准取得佳绩。

量子位
新闻资讯7

刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段

DeepSeek在官方API文档给出thinking mode和tool call结合样例,把模型中间思考过程成Agent系统需管理部分。关键字段`reasoning_content`从调试信息成协议流程一部分,影响状态管理、多模型适配等。

AI科技评论
推荐文章8

拆解 Anthropic:最好的 AI 公司,可能也都是一种组织发明

过去一年,Anthropic 是 AI 行业最值得研究的公司,创造了最快爆发性增长,估值反超 OpenAI。文章从战略判断和组织文化两方面拆解其成功原因,分析与 OpenAI 的差异,还指出 AI 竞争中组织文化的重要性。

海外独角兽