「论文发表」共找到 1122 篇相关文章
CVPR 2026 视频模型趋势梳理:不止生成下一帧,更要理解下一步
视频智能正从画面生成走向运动控制、动态建模等。CVPR 2026 显示视频模型竞争重心从视觉质量转向对时空和物理规律的建模能力,文中介绍多篇相关论文及成果。
4.3亿听障人士的福音,哥大团队研发脑控助听器,最高增益12分贝
哥伦比亚大学等机构团队研发实时闭环脑控听力系统,发表于Nature Neuroscience。该系统解码大脑注意力信号,放大目标人声、压制杂音,打破传统助听器瓶颈。经多项测试,效果显著,临床应用潜力大。
有人只用API就猜出了GPT、Claude、Gemini的参数量?社区吵翻了
研究人员李博杰在arXiv发布论文,提出“不可压缩知识探针”评测框架,仅通过黑盒API调用逆向估算LLM参数规模,给出GPT-5.5等模型参数量估算,引发社区广泛讨论与争议。
ACL 2026 | LCA:DeepSeek 长文本加速神器,90% KV 缓存缩减 + 2.5 倍推理提速
琶洲实验室等团队提出潜在空间压缩注意力(LCA),入选 ACL 2026。LCA 突破传统注意力机制瓶颈,适配不同大模型,降低硬件门槛与成本,提升推理效率。论文与代码已开源。
ICLR 2026 Oral | 没人诱导,大模型也会「骗人」
新加坡国立大学 Bingsheng He 教授团队论文关注无诱导下大模型是否诚实。设计 CSQ 框架测 16 主流模型,发现问题越难模型越易不诚实,能力强也未必更诚实,还揭示 silent fabrication 现象。
在ICLR 2026主会之前,我们和30多位入选者聊了聊最前沿的AI细节
4月14日,智源社区、DeepTech联合举办ICLR 2026预讲会。会议聚焦顶会核心精华,三十余位论文作者分享AI Agent、大语言模型等热门领域成果,展示解决大模型痛点的研究。
AdaGen: 让图像生成模型学会自适应策略
当前主流图像生成模型多步策略依赖手工静态调度规则,存在需大量调参、无法适配样本特性的问题。本文提出AdaGen框架,通过强化学习训练策略网络,在四大生成范式上实现性能提升与效率优化。
4·18 北京 Elastic AI Tech Day|搜索基座模型议程(含 Jina 模型与 Reader)
Jina AI 模型迭代加速,Jina Embeddings 到五代目,Reranker v3获最佳论文。4月18日 Elastic AI Tech Day 将举办,Jina 团队将做系统公开技术分享,涵盖搜索AI等多方面内容。
全新线性注意力范式!哈工深张正团队提出模长感知线性注意力!显存直降92.3%!
哈工深张正团队联合多团队发布论文,提出 NaLaFormer 框架,解决线性注意力两大核心缺陷,保持线性复杂度同时精度超越,在多任务表现出色,如超分任务显存降 92.3%。
西湖大学科研版NanoBanana开源!科研绘图从此自动化
西湖大学将科研版NanoBanana开源,其AutoFigure框架可自动化生成学术插图且能编辑,论文被ICLR 2026接收。该框架提出理性渲染范式,配套FigureBench基准测试集,表现超越人类预期。