「模型上下文协议」共找到 8324 篇相关文章

算法论文8

Agentic RL 后训练资源怎么分?港中文、恒生大学提出 Libra,吞吐最高提升 3 倍

大语言模型走向“完成任务”,Agentic RL 后训练让系统工作负载不稳定。港中文和恒生大学团队提出 Libra 资源管理系统,统一优化训练与 rollout,在多任务中提升吞吐,论文与代码已公开。

机器之心
开源动态8

kimi K3超大杯升级背后的技术内幕

文章介绍开源模型 K3 架构设计思路。主要探讨 MoE 和 MLA 部分,在 MoE 方面提出 SiTU、Norm、QB 改进;在注意力机制选择 MLA,与 KDA 混合缓解部分问题,还谈及 DSV4、NoPE 相关特点。

Agent的潜意识
开源动态7

Hermes Agent 发布更新 Herald:实时语音 + Agent 之间可以互相通信了

Hermes Agent 更新到 v0.20.0 代号 Herald,增加实时语音对话与唤醒词,可验证引用来源可信度,集成签名Webhook,支持代理到代理协议,还有性能与安全方面更新,顺应新 Agent 发展趋势。

AI工程化
产品应用8

Claude Opus 5 发布,比 Fable 5 强,仅一半价格

Claude Opus 5发布,官方称其以一半价格提供接近Fable 5的智能。跑分显示它多数项目超Fable 5,ARC - AGI - 3成绩突出,还更省token,是Anthropic迄今对齐度最高的模型。

AGI Hunt
新闻资讯8

小米罗福莉:MiMo-V2.5如何做到又快又强又便宜? | ICML 2026

2026年7月ICML大会上,小米MiMo团队负责人罗福莉介绍MiMo - V2.5系列。该系列跳出传统思路,从架构、训练、推理协同设计,实现“聪明、快速、便宜”,如预训练降成本、后训练有硬核算法、推理加速达1000 TPS。

AI科技评论
新闻资讯7

Anthropic 发文称自家 Claude 已经开智,网友:为了上市,不择手段?

Anthropic发布Claude内部机制新研究,介绍J-space和J-lens,称可读取模型未输出的内部概念。此研究在训练、评测和部署有潜在价值,但叙事引发争议,网友质疑是否过度包装。

AI科技评论
新闻资讯7

刚刚,Fable 5全球解禁!

美国商务部撤销对Anthropic旗下Fable 5、Mythos 5出口管制,禁令由商务部长Lutnick签字解除。Anthropic官宣明天恢复访问,这两款模型无需许可、审批即可全球使用,此前封禁让开发者陷入“戒断期”。

新智元
新闻资讯7

GLM-5.3你来定!智谱唐杰全球征集意见,评论区清一色:视觉

清华教授、智谱唐杰在𝕏征集GLM下个版本意见,浏览量达40w+。此前他有求必应,网友热情参与。这次评论区多要视觉能力,因GLM-5.2是纯文本模型,而对手多为多模态。

量子位
开源动态7

《Loop Engineering橙皮书》发布!免费,开源

《Loop Engineering橙皮书》发布,免费开源。Loop Engineering概念由多人共同推动,它是在提示词、上下文、缰绳工程基础上更进一步。文中介绍了循环的动作、零件,Claude Code的相关命令,也指出新手实践的坑。

花叔
推荐文章8

真正能用好AI的企业是怎么做的?(附企业级AI落地实战手册)

数字化深入,非结构化文档成企业难题。合合信息发布白皮书,提出复杂文本智能五大核心能力标准,用11个行业标杆案例展示多模态文本智能技术应用,提供可复制落地范本。

PaperAgent