哥大团队」共找到 7329 篇相关文章

算法论文7

Anthropic 新研究:AI出错是“热混乱”

Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。

AI工程化
开源动态8

多模态长文本理解测评首发:46款模型无一攻克128K难关

香港科等研究者联合提出MMLongBench,用于评估多模态模型长文本理解能力。它覆盖5类型任务的16个数据集,对46个模型测试显示,闭源和开源模型在长上下文任务均面临挑战,OCR和跨模态检索能力是瓶颈。

量子位
算法论文8

《航空学报》综述 | 飞行器结构动载荷特征、测量及识别技术

东南学费庆国教授等发表综述,系统梳理飞行器结构动载荷从特征认知、响应测量到载荷识别的技术进展,分析典型位置载荷特征,总结测量技术,回顾识别方法,探讨挑战与未来趋势。

力学与人工智能
产品应用8

挑战Claude code和Cursor:阿里Qoder对标全球,AI编程迎来“上下文”革命

AI编程工具爆发式增长,‘上下文’成实用化难题。阿里推出Qoder平台,结合模型与Agent,可深度检索代码、理解上下文。本文采访Qoder团队工程师,解析其定位、成本、技术路线等关键问题。

InfoQ
产品应用8

面向UE5的智能数字人系统

GMTalker是光明实验室媒体智能团队为虚幻引擎5.3打造的智能数字人系统,集成多种能力,适用于科研等场景。具备多功能特点,与其他开源方案对比优势明显,还介绍了环境要求、启动方式、配置、API等。

GitHubStore
算法论文8

从平面几何出发:形式化验证如何驱动MLLM的推理能力跃迁

多模态语言模型在复杂数学与几何推理中有缺陷,现有训练方式让模型难有鲁棒推理能力。上海交团队提出“以形式化增强非形式化推理”方案,构建完整闭环,提升模型推理及泛化能力。

机器之心
新闻资讯7

Meta CTO打脸扎克伯格:首秀翻车全因致命bug,AI智商捉急、语音交互全面崩盘

Meta Connect开发者会上,Meta发布三款智能眼镜,现场演示却屡屡翻车。扎克伯格归咎于Wi-Fi,CTO Bosworth否认,称是资源管理失误和软件bug所致,但网友对此解释并不买账,质疑团队能力。

InfoQ
开源动态8

告别评估乱象!首个视觉解释综合性基准发布,附人类真值 | KDD'25

埃默里团队推出首个视觉解释基准Saliency - Bench,构建8个任务的数据集,提供标准化评估流程与开源工具包,解决评估缺乏标准等问题,推动可解释AI向可靠、透明发展。

新智元
算法论文8

DeepSeek刚解决了AI视觉最后一块拼图:极低成本+精准视觉定位,AI接管电脑已无死角

DeepSeek放出新论文《Thinking with Visual Primitives》,解决多模态模型中长期被忽视的“说不清位置”问题。提出将空间标记作为“最小思维单元”插入推理链条的方案,在多个任务上达前沿水平,但也存在精度、触发机制和泛化能力等局限。

AI寒武纪
开源动态8

The Batch: 929 | Qwen3.5 超越更模型,领跑视觉基准测试

阿里巴巴发布 Qwen3.5 系列,含 8 个开源权重的视觉 - 语言模型。其小模型表现超体量 OpenAI 开源权重模型,在视觉任务中整体出色,部分在语言任务也有竞争力。虽团队有人员离职,但阿里承诺加 AI 投入。

DeeplearningAI