测试全流程」共找到 3890 篇相关文章

开源动态8

16K星 Zep凭一张“动态记忆图”吊打一众Graph RAG

现有的RAG框架多依赖静态文档检索,无法满足企业对动态知识整合的需求。本次分享的Zep提供新型智能体记忆层服务,通过核心组件Graphiti动态整合数据,在LongMemEval基准测试中表现出色。

CourseAI
新闻资讯7

AI Agent平台Delve获3200万美元融资,估值3亿美元

21岁麻省理工辍学生创立的AI Agent安合规平台Delve获3200万美元融资,估值3亿美元。它从医疗记录助手转型,业务扩展到多合规框架,用AI智能体自动化流程,但也面临竞争。

AIGC开放社区
新闻资讯7

刚刚,谷歌AI路线图曝光:竟要抛弃注意力机制?Transformer有致命缺陷!

谷歌未来AI路线图曝光,Gemini模态是重点,模型向智能体转变,推理能力将扩展。谷歌还需突破现有注意力机制限制实现无限上下文。此外,文中盘点了OpenAI、DeepSeek等大厂AI年中表现。

新智元
推荐文章7

一文讲透程序编排的核心方式:从表达式语言到并行化实践

文章围绕程序编排展开,介绍单语句编排、类编排、流程编排、并行化编排等核心方式,分析多种编排框架特点及适用场景,还提及Lindorm泛时序数据解决方案,为开发者提供编排参考。

阿里云开发者
新闻资讯7

Claude Fable 5重新上线!GPT-5.6秒跟

Claude Fable 5重新上线,或为小范围灰度测试。此前因出口管制停产近两周。它能力强但烧Token,社区一直盼回归。同时,GPT - 5.6在Fable 5上线后秒跟,将分批发布。

量子位
开源动态8

腾讯混元CL-bench续作发布,让大模型读懂你的日常生活

腾讯混元团队推出CL - Bench Life,用于精准衡量AI在现实生活中的“上下文学习”能力。测试12个语言模型,结果显示模型处理高噪声零碎context能力不足,揭示当前顶尖AI模型还远未读懂日常。

机器之心
产品应用8

马斯克版微信,终于来了!

4月12日苹果App Store刷出XChat,开发者为X Corp.,将于4月17日上线,中国大陆区也开启预约。它被看作‘马斯克版微信’,无广告、不追踪、加密,集成AI Grok,或重塑球社交格局。

新智元
新闻资讯7

先进封装成为AI芯片胜负手

2026年先进封装企业在多方面有新进展,其对芯片性能等指标影响大,产业链都在加码布局。委外封测厂、代工厂看好其营收贡献,市场动能明确,各环节技术创新也多点突破。

芯师爷
算法论文7

真钱买假模型?187篇论文被「套壳API」坑惨,准确率暴跌

CISPA论文指出,第三方影子API可能用廉价替代品替换前沿大模型。研究追踪17个服务,发现已被187篇论文引用。测试显示,影子API在多领域性能差,安不可控,供应商有三种欺骗手段。

机器之心
算法论文8

重复一下提示词,Gemini准确率竟从21%飙升至97%!

Google Research团队研究发现,重复提示词可让Gemini准确率从21.33%升至97.33%。该策略能提升主流大模型非推理任务表现,在多模型多基准测试中优势明显,且不增加延迟。

AIGC开放社区