「测试效率」共找到 2780 篇相关文章
MIT & Google | 提出异步并行生成新范式,LLM推理效率大幅提升!
MIT与谷歌团队在研究PASTA中探索异步生成范式,开发标记语言PASTA - LANG,采用双阶段训练流程,设计推理系统。实验显示PASTA平衡性能与质量,有可扩展性,为LLM推理效率优化开创学习驱动新路径。
开发效率狂飙十倍!Claude托管智能体功能改写应用落地速度
Anthropic上线Claude托管智能体功能,让开发者告别底层基建搭建,只需几天就能让业务级智能体投入生产。该功能有四大核心流转模块,多家企业使用后效率大幅提升,还介绍了接入细则。
GPT-6 Astra发布,多个基准测试接近满分,“欢迎来到AGI时代”?
当地时间9月3日,OpenAI发布GPT-6 Astra,称其为“最智能、最对齐”的模型。它在多测试表现逆天,能力提升显著,还加入新特性。不过价格更高,也带来安全问题。
睡觉也在卷!伯克利Letta新作「睡眠时计算」让推理效率飙升
Letta和UC伯克利研究者提出「睡眠时计算」技术,能让LLM在空闲时间提前思考以提升推理效率,降低推理成本,在多数据集实验中展现优势,在软件工程任务中也有应用。
ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍
文章聚焦HyperGraphRAG模型,介绍其架构由知识超图构建、超图检索策略、超图引导的生成机制组成,阐述构建步骤,该模型能提升检索效率,或成ACL 2025爆款。
为什么AI总是"记错"你?我们造了一个"合成人生"来测试
现有AI记忆评测只记'事'不记'人',存在数据源窄、不重理解、注入成本高的问题。QuantaAlpha联合高校团队提出CloneMem基准测试,用'数字痕迹'评估AI Clone长期记忆能力,实验有反直觉结论并给出设计启示。
多模态卷王阶跃星辰Step 3登场,推理效率可达DeepSeek-R1 300%
新一代多模态推理基模Step 3登场,它采用原创MFA架构,具“多开好省”亮点,推理效率高、性价比优。7月31日将开源,能适配各芯片,还发起“模芯生态创新联盟”推动应用落地。
浙大校友打造AI代码测试神器,零代码零bug,30分钟创建网站
浙大校友打造的智能测试平台TestSprite 2.0,零代码零bug,30分钟创建网站,能让AI写代码准确率从42%跃升至93%,还可自动生成测试报告、调试修复错误,全程无需人工干预。
ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍
文章介绍HyperGraphRAG模型,它由知识超图构建、超图检索策略、超图引导的生成机制三部分组成。构建含知识超图构建、超图检索、生成机制等步骤,能提升检索效率与答案质量,或成ACL 2025爆款。
为 OpenAI 秘密提供模型测试, OpenRouter 给 LLMs 做了套“网关系统”
OpenRouter成立于2023年初,为用户提供统一API Key调用各类模型,OpenAI会用其秘密测试。平台token用量高速增长,还发布模型用量排行榜引关注。创始人认为大模型非赢家通吃,未来想成agent最佳推理层。