「推理服务基础设施」共找到 2948 篇相关文章
国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测
文章深度实测MiniMax-M2.5编程能力,用其开发多款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。
内存涨价,千元机的天塌了
去年下半年起存储芯片涨价,因AI基础设施需求爆发,三大存储芯片厂产能被榨干。消费级产品供应受挤压,中低端手机成最大受害者,各厂商搁置低价产品线,中低端市场持续萎缩。
Agent框架各自为战?谷歌&微软:用Agent-KB让经验自由流动
当前不同框架的Agent知识无法互通,谷歌、耶鲁、字节、oppo等团队联合提出Agent KB,这是通用记忆基础设施,能让异构Agent框架共享经验。它有师生双阶段检索机制,实验验证其能带来显著增益。
Claude 5史诗级泄露,史上最强编程模型评测炸裂!核心秘密曝光
Anthropic的Claude Sonnet 5即将发布,已存在于谷歌基础设施中,性能领先谷歌‘Snow Bunny’一代。它价格比Opus 4.5便宜50%,有100万token上下文窗口,SWE - Bench成绩超80.9%,还有自动开发团队模型。
打造Jarvis,OpenClaw很野,但Agent Studio简直变态
文章介绍OpenClaw和Agent Studio两个AI Agent项目。OpenClaw能打通AI Agent与多消息应用,适合技术团队搭建基础设施;Agent Studio可打造个人Agent工作台,重点展示其接入企微流程,还介绍四大核心功能。
0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型
上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。
解锁任意步数文生图,港大&Adobe全新Self-E框架学会自我评估
香港大学与Adobe Research联合发布Self - E框架,可从零训练实现任意步数文生图。它改变训练范式,用两条互补训练信号,在GenEval基准表现出色,让文生图训练更灵活且具扩展性。
中美算力,站在2000亿美元的分岔路口
高盛报告称2025年全球人工智能投资规模或接近2000亿美元。中美算力发展站在分岔路,中国追性能,美国被能源限制。全球算力市场有新变化,中国本土芯片崛起,各方也在热议AI是否有泡沫。
Claude Code 起源:一个人的副业换歌脚本,变成最强 AI 编码工具
很多人以为Claude Code是Anthropic规划已久的大项目,实则最初是个人副项目。工程师Boris Cherny为熟悉API做了听歌脚本,后经改进让Claude能读文件、探索代码库,其在公司内部疯传,最终发布并发展成完整产品。
天下苦SaaS已久,企业级AI得靠「结果」说话
SaaS在AI时代问题凸显,推理成本高、交付质量不稳定。在此背景下,百融云创推出结果云Results Cloud,以RaaS模式提供全栈解决方案,解决AI落地难题,还呼吁共建智能体生态。