性能测试」共找到 3305 篇相关文章

推荐文章8

Anthropic万字Skills教程,把Agent工程的核心武功秘籍说明白了

Anthropic官方发布33页Skills构建指南,详细介绍构建高效Skill的方法,涵盖基础概念、规划设计、测试迭代、分发共享等内容。还提及openai用codex agent做项目的经验,指出人类审查成瓶颈,引出渐进式披露的核心秘籍。

探索AGI
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型

现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心
产品应用8

字节最强多模态模型登陆火山引擎!Seed1.5-VL靠20B激活参数狂揽38项SOTA

5月13日,火山引擎在上海发布5款模型和产品,其中豆包1.5・视觉深度思考模型(Seed1.5-VL)最吸睛。它激活参数20B,性能与Gemini2.5 Pro相当,38个评测基准达SOTA,推理成本低,已开放API。

机器之心
7

老黄怒怼玩家根本不懂AI!英伟达新AI功能遭全网抵制,游戏圈炸锅了

英伟达在GTC 2026发布DLSS 5,本应是“性能革命”,却遭游戏圈抵制。它用生成式AI“注入”光影和材质,从“帮放大画面”变为“帮重绘画面”,玩家不满AI网红脸,老黄称是“GPT时刻”。

量子位
开源动态8

刚刚,梁文锋署名开源「记忆」模块,DeepSeek V4更细节了

十几个小时前,DeepSeek 发布新论文,与北大合作,作者有梁文锋。针对大模型问题提出条件记忆,用 Engram 模块实现,已开源。结合此前研究,DeepSeek v4 模样渐清。模型性能、效率表现优,并发现 U 型扩展规律。

机器之心
新闻资讯7

融资35亿后,Kimi神秘模型现身竞技场

大模型竞技场上,神秘模型Kiwi - do现身,自报来自月之暗面Kimi。网友推测它可能是K2 - VL,其通过VPCT测试或改变多模态Agent格局。2025年末Kimi获35亿融资,将用于K3模型研发。

量子位
开源动态8

全球首次,「AI记忆」开源落地!MIRIX同步上线APP

加利福尼亚大学圣迭戈分校博士生王禹和纽约大学教授陈溪联合推出并开源全球首个多模态、多智能体AI记忆系统MIRIX,还上线桌面端APP。MIRIX性能远超传统方法,首次将记忆分六模块,用多智能体系统控制。

新智元
产品应用8

Kimi K2 详测|超强代码和Agent 能力!内附Claude Code邪修教程

作者熬夜带来 Kimi K2 模型详测及 CC+K2 邪修教程。K2 是 1T 参数量的 MoE 开源模型,基准测试成绩优异,在代码、Agent、数学推理任务表现突出,前端能力强,还能驱动 Claude Code,成本低。

歸藏的AI工具箱
算法论文8

8B模型可以超过GPT-4o!并行KV Cache压缩支持的128K长度外推方法ParallelComp

大模型长文本推理存在瓶颈,作者提出 ParallelComp 方案。它有并行 Attention 分块、KV 缓存智能淘汰与注意力偏差校准三大创新,能让 8B 模型性能达 GPT - 4o 的 91.17%,特定任务超 GPT - 4o。

机器之心
算法论文8

告别微调时代:拖拽式LLMs实现12000倍加速适配,输入描述,秒级定制LLM,效果、速度全面超越

传统高效微调技术成大规模部署瓶颈,论文提出Drag-and-Drop LLMs (DnD),仅需输入目标任务未标注提示,即可秒级生成适配的LoRA权重,实现LLM秒级免训练适配,效率、性能和泛化性上均有突破。

深度学习自然语言处理