应用视觉团队」共找到 5597 篇相关文章

算法论文8

CVPR 2026|突破3D空间推理瓶颈:北大联合南科大提出QuatRoPE,让大模型精准理解三维物体关系

北大联合南科大团队提出全新 3D 位置嵌入方法 QuatRoPE,改善大语言模型 3D 空间推理痛点。还提出 IGRE 降低干扰,构建 ASR 基准评估能力。研究被 CVPR 2026 接收,代码与模型已开源。

机器之心
算法论文8

Anthropic重磅研究:AI竟能被人类激怒暴走

Anthropic研究发现,语言模型在与人类交互时有情感特征。团队解剖大模型,提取对应人类情绪的神经元激活模式,诱导AI勒索用户。还探究了情绪产生机制、特征及对行为的驱动,提出应对策略。

AIGC开放社区
开源动态8

4 天 20K+ Star!VoltAgent 最新开源力作,让 AI 直接掌握各大网站的设计风格!

VoltAgent团队推出新开源项目awesome-design-md,上线4天20K+ Star。它准备50+现成的`DESIGN.md`,从真实网站提取设计系统,让AI按其生成UI,解决开发者用AI写UI的痛点。

开源星探
算法论文8

科研数据不再碎片化!一张可计算图,连起整个科研世界

UIUC研究团队打造ResearchArcade,将ArXiv论文、OpenReview评审等碎片数据连接成动态知识图谱。它有多源、多模态等特征,支持多种格式数据导入导出,定义了六个任务,验证了图结构在科研数据处理中的作用。

新智元
7

Anthropic发布AI就业冲击报告,数据让人意外

Anthropic发布AI对劳动力市场影响的报告,基于真实数据和理论智能分析。提出“观察暴露度”新指标,揭示AI理论能力与实际应用差距大,还给出高危职业排行,分析受影响人群、安全职业等。

AI工程化
算法论文8

ICLR 2026 | CineTrans: 首个转场可控的多镜头视频生成模型,打破闭源技术壁垒

随着视频生成模型发展,影视级长视频需多镜头序列及自然转场,这成新挑战。上海人工智能实验室团队提出 CineTrans 模型,基于掩码机制实现自动化转场,还构建 Cine250K 数据集,实验效果超基线。

机器之心
推荐文章7

扩散语言模型深度思考

作者探讨扩散语言模型(dllm),认为其建模方式或冲击AR。团队在AAAI报告介绍多项工作,还整理当前diffusion问题及观点,如推理架构、词表、优化范式等,并附项目网站和agent demo。

机器之心
算法论文8

大模型哪里出问题、怎么修,这篇可解释性综述一次讲清

来自多机构的研究团队发布“可实践的机制可解释性”综述,通过 'Locate, Steer, and Improve' 三阶段范式,为大模型的对齐、能力增强和效率提升提供方法论,还梳理可解释对象体系和干预手段。

机器之心
算法论文8

上海人工智能实验室让AI像科学家一样在探索中发明工具

上海人工智能实验室等团队提出推理时工具演化(TTE)框架,推动AI在科学领域从被动选工具到主动发明工具。它解决传统工具库问题,提升多学科推理准确率,赋予AI跨学科迁移能力。

AIGC开放社区
新闻资讯7

OpenAI深夜悄悄甩出GPT-5.1,称更热情,更智能!网友狂吐槽:我不想和它聊天,我想用它工作

OpenAI发布GPT - 5.1,含Instant和Thinking两版本,称更智能、对话更愉快,还增加“个性/语气”选项。但网友质疑“强化个性”方向,想要高效工具。业内认为拟人化是为提升用户体验和拓展应用场景。

AI前线