人类科研人员未来」共找到 3303 篇相关文章

开源动态8

破解空间智能数据稀缺难题,影石开源DiT架构全景生成模型,在线可玩

影石研究院团队推出基于DiT架构的全景图像生成模型DiT360,设计分层混合训练框架,结合透视与全景图像数据,提升真实感和几何一致性。它支持多任务,优于现有方法,为三维场景生成提供新思路。

量子位
产品应用8

Claude Code 推出插件功能

Anthropic宣布Claude Code支持插件系统,开发者用一条命令就能安装定制化工具集合。插件把斜杠命令等打包,可按需开关。使用简单,已有多种插件,还能自行创建和托管,插件功能或成其生态重要进化。

AGI Hunt
算法论文8

机器人「看片」自学新技能:NovaFlow从生成视频中提取动作流,实现零样本操控

布朗大学和机器人与人工智能研究所团队提出 NovaFlow 框架,利用视频生成模型常识知识,让机器人“看片”自学。它将任务理解与控制解耦,通过生成视频提取动作流,实现零样本操控,为通用机器人提供新路径。

机器之心
算法论文8

大模型“精细化”对齐,真实性提升25.8%刷新SOTA!token级精准编辑,无需训练即插即用

北航团队在EMNLP 2025提出Token - Aware Editing (TAE)方法,从token层面解决传统表征编辑技术问题,无需训练、即插即用,在多个对齐维度显著提升,如在TruthfulQA任务上真实性指标提升25.8%。

量子位
新闻资讯7

谁是最强“打工AI”?OpenAI亲自测试,结果第一不是自己

OpenAI发布新研究,提出GDPval基准衡量AI模型在有经济价值任务上的表现。Claude Opus 4.1表现最佳,GPT - 5次之。OpenAI开源优质子集并提供自动评分服务,还指出了GDPval的局限。

量子位
产品应用8

OpenAI 内部揭秘:我们如何使用 Codex

文章揭秘 OpenAI 内部使用 Codex 的情况,介绍其在理解代码、重构迁移、性能优化等多方面的应用场景,还给出最佳实践,如用‘提问模式’开始、组织好提示等,展现了 Codex 强大的开发辅助能力。

宝玉AI
算法论文8

GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”

多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。

深度学习自然语言处理
算法论文8

OpenVision 2:大道至简的生成式预训练视觉编码器

多模态大模型浪潮中,视觉模块是关键。此前OpenVision训练管线复杂,成本高。研究者提出OpenVision 2,移除文本编码器与对比学习,引入随机丢弃视觉token技巧,性能佳且效率高,挑战了对比学习范式。

机器之心
产品应用8

重构开发体验:CodeFuse 智能代码助手的设计与实践

蚂蚁集团技术专家牛俊龙在 QCon 大会分享 CodeFuse 智能代码助手架构设计与实践,介绍本地核心服务设计策略,结合案例优化其 AI 能力,还分享落地经验、教训与未来发展路径。

InfoQ
开源动态8

首个MCP架构、只50行代码就能实现高效RAG的开源框架UltraRAG 2.0

检索增强生成系统(RAG)复杂度提升,使科研人员面临高昂工程实现成本。清华大学、东北大学、OpenBMB等联合推出UltraRAG 2.0,基于MCP架构,降低技术门槛与学习成本,让科研专注创新。

PaperAgent