「有状态推理」共找到 7617 篇相关文章
IEEE TPAMI 2025 | 北京大学提出LSTKC++,长短期知识解耦与巩固驱动的终身行人重识别
北京大学周嘉欢团队在IEEE TPAMI发布LSTKC++研究成果。该框架引入长短期知识解耦等机制,保障模型学习新知识和记忆历史知识。代码已开源,研究在性能和效率上优势明显,有广泛应用价值和拓展空间。
ACL 2025 | 指令遵循不能仅靠常识?GuideBench 揭示大模型如何“踩雷”领域指南规则
这篇ACL 2025主会论文聚焦提升智能体指南规则遵循能力。提出评估基准GuideBench,涵盖7类1272个任务。实验显示多数主流大模型指令遵循能力不佳,尤其数学推理挑战大,为模型迭代提供评估基准。
DiffMoE:动态Token选择助力扩散模型性能飞跃,快手&清华团队打造视觉生成新标杆!
清华大学和快手可灵团队推出DiffMoE,通过创新的动态token选择机制和全局token池设计,拓展了扩散模型的效率与性能边界。实验表明,DiffMoE在多方面超越现有模型,未来集成先进技术或有新增益。
阿里Qwen3技术报告核心要点解读!
阿里Qwen3技术报告发布,披露模型架构、预训练及后训练等技术细节。其有密集与混合专家两种模型架构,预训练数据量和语种增多,后训练采用强到弱蒸馏提升性能,各模型表现优异。
DeepSeek之后,中国AI「自己出题」杀进Nature通讯!全球仅4家
一家成立不到两年的香港AI公司维纳智能,不堆参数、不依赖人工标注,靠让大模型自动生成高精度推理数据登上Nature通讯。其技术可解决Agent泛滥的困局,还推出特色产品,业务增长快。
OpenAI 和 Anthropic “杀”红了眼,谷歌成为最大受害者
6月AI人才市场,谷歌7天内损失四位技术元老,分别加入OpenAI和Anthropic。这引发外界关注,有人质疑谷歌AI处境。DeepMind CEO哈萨比斯回应称,判断AGI竞赛输赢不能只看短期,谷歌仍有优势。
月吞100万亿Token!AI中转站OpenRouter赚爆了
OpenRouter宣布完成1.13亿美元B轮融资,估值达13亿美元。它每周处理25万亿个tokens,全球用户超800万。其提供AI推理统一控制层,解决企业多模型管理难题,开源模型崛起使其价值凸显。
全球首个AI专家市场上线!把你的绝活打包,数字分身7x24小时变现
全球首个AI专家市场「袋袋」上线,降低「数字分身」变现门槛。非技术专家自然对话,技术大佬用CLI模式上传项目文件。买家可按需雇佣专家,获专业成品。袋袋有多项技术,保障安全且能自进化。
CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现
谷歌DeepMind推出多模态TIPSv2,解决图像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征图优势显著,且配套生态完善,为AGI预训练指明方向。
3.2K Star!这个开源字幕神器,对剪视频的创作者来说,救了大命!
视频创作中字幕制作耗时费力,剪映等工具各有局限。开源字幕工具 AutoSubs 能有效解决痛点,可一键生成高质量字幕、自动区分说话人,本地运行保障隐私,还具备多种亮点功能,使用简单。