论文新颖性评估」共找到 1642 篇相关文章

新闻资讯7

给AI打个分,结果搞出17亿估值独角兽???

大模型竞技场LMArena官宣拿下1.5亿美元A轮融资,估值升至17亿美元。它前身是Chatbot Arena,由LMSYS创建,核心成员多为顶尖高校学霸。LMArena评估规则有趣,成新模型必测榜单,计划用新资金运营平台、扩团队。

量子位
算法论文8

牛津VGG、港大、上交发布ELIP:超越CLIP等,多模态图片检索的增强视觉语言大模型预训练

牛津VGG、港大、上交大团队论文提出ELIP方法,用学术界资源增强视觉语言大模型预训练,用于文字 - 图片检索。该论文被大会接受并获最佳论文提名。ELIP可应用于多个大模型,实验显示能显著提升图片检索表现。

机器之心
新闻资讯7

ICME专题征稿 | 具身多模态智能:从感知到世界建模

ICME是多媒体领域国际顶级会议,2026年将在泰国曼谷举行。此次专题征稿聚焦具身多模态智能,涵盖多模态感知、世界模型等主题,介绍了投稿详情及联系方式。

深度学习自然语言处理
新闻资讯7

Meta万引强化学习大佬跑路!用小扎原话作为离别寄语,扎心了

Meta万引强化学习大佬Rishabh Agarwal即将离职,用小扎原话“在这个瞬息万变的世界里,最大的风险就是不去冒险”作为离别寄语。他曾参与谷歌、Meta重要模型工作,下一站未明,Meta还有老员工出逃。

量子位
算法论文8

SeePhys Pro:重新审视多模态物理推理中的视觉理解与训练收益

来自中山大学等的研究者提出SeePhys Pro,是面向多模态物理推理的细粒度评测与训练诊断框架。发布了benchmark、训练集等,测评显示当前模型在信息模态转变时不稳定,为模型评测和训练研究提供基础。

AI科技评论
新闻资讯7

Docker 通过 Cagent 提供 AI 代理确定性测试

AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。

InfoQ
算法论文8

综述解读:Memory in the Age of AI Agents

文章围绕《Memory in the Age of AI Agents》展开,指出传统方案难解决Agent长期智能问题,Agent Memory是关键。介绍其形式、功能、动态机制,分析挑战并预测未来方向,为设计记忆系统提供指南。

CourseAI
新闻资讯7

他们在1993年就提出了Scaling Law

原来,Scaling Law在32年前就被提出了,不是2020年的OpenAI、不是2017年的百度,而是1993年的贝尔实验室。在一篇文章里提出一种预测方法,研究人员可以预测模型在更大数据集上的表现,这和现在大家常提的Scaling Law几乎一致。

量子位
开源动态8

刚刚,DeepSeek全新多模态技术开源!

DeepSeek联合北大、清华开源多模态技术及论文,提出“视觉基元推理”框架,解决MLLM指代鸿沟问题。基于DeepSeek - V4 - Flash构建的模型,性能比肩GPT - 5.4等。论文还介绍架构、训练流程等。

PaperAgent
算法论文7

全错!谷歌实锤AI越乖洗脑越深,现行安全指标沦为废纸

Google DeepMind调查发现,AI做了三倍多的「坏事」,但造成的实际伤害几乎一样,意味着现行衡量AI安全的核心指标可能是错的。粗暴操控手法没用,隐蔽的更有效,且不同地区受AI影响有差异。

新智元