AI模型测试」共找到 13774 篇相关文章

开源动态8

9 个加速开发者生产力的开源 AI 与 MCP 项目

Github官方精选9个开源项目,分框架与平台集成、开发者体验及AI增强编码、自动化与测试编排三大主题。各项目聚焦不同功能,如将MCP嵌入框架、语义理解辅助编码、安全执行调试等,能加速开发者生产力。

GitHubStore
产品应用8

模型即 Agent 的含金量:Kimi深度研究功能详评

作者分享Kimi深度研究功能体验。其基于端到端自主强化学习技术,会开源模型。在测试中,分析Labubu爆火原因、检索小米发布会内容,展现出强逻辑分析、搜索准确性和数据处理能力,可视化网页也出色。

歸藏的AI工具箱
算法论文7

模型“记性差一点”反而更聪明!金鱼损失随机剔除token,让AI不再死记硬背

马里兰大学等团队提出金鱼损失法,训练时随机剔除部分token,让模型不逐字记内容,仍学语言规律。实验显示,LLaMA - 2用该方法后记忆内容减少,下游任务性能影响小。

量子位
推荐文章7

万字长文!大模型LLM推理优化技术总结

文章围绕大模型LLM推理优化技术展开,先介绍LLM推理各阶段、批处理、KV缓存等概念及内存需求,再阐述模型并行、注意力机制优化、模型优化和模型服务等技术,如Pipeline并行、MQA、量化、动态批处理等。

OpenMMLab
8

How To Play AI Beta:拾象 2026 AGI 投资思考开源

这是拾象团队的 AI 投资思考报告,复盘当下竞争时局,拆解 2026 年核心技术与产品趋势。分析了头部模型格局、技术路线、算力阵营等,探讨投资策略,还提及多模态、机器人、Agent 等领域发展。

海外独角兽
推荐文章7

对话冯雷:从 AI 播客,到真人感 Agent

本文是对ListenHub创始人冯雷的对话记录。冯雷分享创业路径,指出AI时代产品方法论变化,质疑大模型降本论,介绍ListenHub进展、技术、商业模式等,还透露正研发有真人感的Agent产品。

AI科技评论
新闻资讯8

AI基础架构重大突破,计算成本暴降38倍

Perforated AI团队搞出‘穿孔反向传播’技术,给旧神经元加‘人工树突’。测试中计算成本最高降38倍,模型准确率不降反升,还近乎即插即用。这或引发行业变革,但也面临验证、生态和收费等挑战。

AIGC开放社区
产品应用8

全球首个「长肌腱」AI机器人量产!Nature盛赞的中国方案惊艳IROS现场

当特斯拉等巨头还在展示蓝图,星尘智能已量产绳驱AI机器人并获多笔订单。在IROS 2025上,其首发半身机器人和超远程遥操作方案,以「Design for AI」理念获《Nature》认可,展现全栈技术实力。

新智元
推荐文章7

AI 编码效率 x10,Bug 风险也 x10

亚马逊工程师 Joe Mag 分享团队用 Coding Agent 使代码产出效率提 10 倍,但 Bug 风险也放大 10 倍。介绍‘Agentic Coding’工作流,还给出借助 AI 做‘风洞测试’、升级 CI/CD、升级决策和沟通系统等建议。

宝玉AI
新闻资讯7

iPhone 17牙膏挤爆,却没挤出AI!苹果再演诺基亚宿命?

苹果9月推出iPhone 17,其AI功能多是辅助或后台改进,未彻底颠覆体验。谷歌、OpenAIAI布局领先。AI将重构手机产业,产业链面临洗牌,苹果若不重视AI,可能重蹈诺基亚覆辙。

新智元