大模型3.0」共找到 10074 篇相关文章

算法论文8

最强多模态模型也拿不到30分?DeepImageSearch定义相册搜索新范式,开启个人视觉记忆的深度搜索时代

窦志成教授团队联合OPPO研究院提出DeepImageSearch图像检索新范式,将其从“逐张语义匹配”推向“语料库级上下文推理”。团队构建评测基准DISBench,用ImageSeeker框架评测主流模型,结果显示最强模型单次完美解决查询比例不超三成。

机器之心
新闻资讯7

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

第三方评测机构Roboflow测试显示,GPT-5.6 Sol在目标检测、计数等视觉任务上表现出色,尤其在文档版面识别和密集场景处理上进步明显,但认字能力有退步,且尺寸图片检测框易飘移。

新智元
开源动态8

狂揽 11.8K Star!用厂 PUA 话术「驯化」AI,这个项目把 Claude 逼成了卷王!

GitHub上名为PUA的项目狂揽11.8K Star,作者用厂PUA话术‘驯化’AI,总结了AI的‘五摆烂行为’,建立‘心理学框架’,实测数据显示能提升AI编程效率,还介绍了安装方式和常用命令。

开源星探
开源动态8

加速量子计算到来!英伟达开源模型拉爆量子计算股

英伟达发布并开源全球首个加速量子计算应用的模型系列Ising,打破硬件校准和纠错耗时难题,提供比传统方法更快、更准的量子纠错解码能力,还推出校准基准测试,全方位开源吸引众多机构加入。

AIGC开放社区
开源动态8

AI智能体也有「蜘蛛感应」,防御延时骤降至8.3%

传统Agent防御机制易致延时积累,研究者联合推出Spider - Sense智能体防御框架,利用两核心技术将防御延时从200% + 降至8.3%,在主流数据集和新基准测试中表现优异。

新智元
算法论文8

ICSE 2026杰出论文 | 突破代码模型真实工程落地瓶颈,北团队提出SEAlign对齐框架:显著提升软件工程智能体决策质量

现有代码模型在经典基准表现好,但在真实软件工程环境表现差。北金芝、李戈团队提出 SEAlign 框架,通过识别与对齐智能体轨迹关键决策点,提升模型在真实工程任务表现,成果获 ICSE 2026 杰出论文奖。

机器之心
新闻资讯8

刚刚,OpenAI 发布 GPT‑5-Codex 新模型,专为编程而生

OpenAI 发布专为 Agent 编程优化的 GPT-5-Codex 新模型,在动态思考、性能、代码审查等方面表现出色。同时,Codex 平台升级,集成 GitHub,保障安全隐私,还公布了定价与可用性。

AGI Hunt
算法论文8

5秒完成3D场景编辑,北&港中文&上海AI Lab搞出VGGT-Edit,120倍加速太炸了

、港中文等团队提出原生3D编辑框架VGGT-Edit,不再绕回2D,直接在3D空间编辑。它采用残差场预测等机制,在DeltaScene测试集表现出色,单次编辑约5秒,最高120倍加速。

量子位
产品应用8

阿里Qwen 3.7 Max:35小时自主编程,Claude跟不上了?

阿里云峰会发布的Qwen 3.7 Max,在优化平头哥芯片推理内核任务中,35小时让推理速度快10倍。它在多基准表现出色,编程、推理、办公自动化全面开花,但闭源且实验室场景与现实有差距。

CourseAI
新闻资讯7

32岁,全球第一开源模型掌舵人,说了声bye就走了

3月2日阿里千问发布Qwen3.5小尺寸模型系列获马斯克点赞,次日林俊旸提交辞职申请。他带领千问三年成绩斐然,但开源竞争格局生变,且阿里组织调整与他理念冲突,他和团队成员选择离开。

花叔