「性能提升」共找到 4063 篇相关文章
Jina Embeddings v4 的量化感知训练
文章聚焦Jina Embeddings v4的量化感知训练。介绍量化技术可压缩向量体积、提升检索效率,对比四种主流量化方法,重点实验PTQ和Output QAT,还测试非对称量化,给出实验结果与结论。
金属探伤微小缺陷:YOLOv11 改进,漏检率从 54% 降低到 19%
工厂质检工作累且易出错,用摄像头加AI检测,需模型在复杂车间环境识别微小缺陷。论文对YOLOv11改进,插入三个即插即用模块,降低漏检率、提升精度,还做了公平实验,公开数据。
港大赵恒爽团队论文:让扩散模型既拿高分又不「作弊」丨CVPR 2026
扩散模型虽能生成逼真图像,但存在“奖励作弊”问题。港大赵恒爽团队提出 GDRO 后训练方法,引入组级奖励优化机制,提升模型表现、缓解作弊,还提高训练效率,有明显工程价值。
Anthropic首份内部报告出炉!自家工程师亲述:生产力飙升50%,但感觉在亲手砸掉自己饭碗
2025年8月,AI巨头Anthropic对内部员工调查,揭示AI真实影响。员工使用Claude比例和生产力提升,还催生新工作。但大家对委托工作比例低,且在技能、社交和职业发展上有不同感受。
英伟达下一代GPU登场,Rubin CPX一次推理数百万Token,网友:这是头野兽
在周二的AI基础设施峰会上,英伟达宣布推出专为超100万token长上下文推理设计的Rubin CPX GPU。它将与其他产品组成新平台,性能卓越,还能复用现有平台,预计2026年底上市。
Claude翻车:Opus 4.1白天退化,Anthropic承认并回滚更新
发布即拿下各项SOTA的Claude Opus 4.1翻车,用户反馈其变得迟钝,官方承认处理某些请求时质量退化,如白天推理性能下降,使用限制不明确,还会暴露API密钥,官方已回滚版本。
AI 写 80%,人修最后 20%:这是什么新赛道?“ AI 代码补锅匠 ”了解一下。
Vibe Coding 成 2025 年 AI 驱动开发核心趋势,强调用自然语言提示让 AI 生成代码。虽可提升效率,但 AI 生成代码有质量、安全等问题,催生付费修复服务,未来“AI+专家”模式或成主流。
推理路径的动态调控:让大模型学会“恰到好处”的思考
当前大模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。
我在哪?要去哪?要怎么去?字节跳动提出Astra双模型架构助力机器人自由导航
当今机器人导航系统在复杂室内环境面临挑战,字节跳动研发创新双模型架构Astra,含Astra - Global与Astra - Local子模型。经实验验证其性能佳,未来有广阔应用前景,但也存在需改进之处。
西湖大学张驰团队:不重训,也能让视频生成更长更稳丨CVPR 2026
AI 视频生成目前存在长视频稳定性问题,西湖大学张驰团队提出 《Free-Lunch Long Video Generation via Layer-Adaptive O.O.D Correction》。研究表明 FreeLOC 方法能提升长视频生成质量,且具跨模型通用性,还揭示了问题机制,降低算力成本。