领域应用」共找到 3571 篇相关文章

算法论文8

PixelRefer :让AI从“看大图”走向“看懂每个对象”

多模态大模型多停留在整体场景级理解,现实任务需细粒度、对象级理解。浙江大学等联合提出PixelRefer框架,可实现精细视觉指代与推理,在多项任务表现领先,轻量版性能优,还开源两类数据集。

机器之心
算法论文8

Thinking with Video:一种全新的思考范式

在人工智能领域,‘用文本思考’和‘用图像思考’存在局限。复旦大学等团队提出‘用视频思考’范式,通过视频生成模型统一文本与视觉推理,构建VideoThinkBench基准测试Sora - 2,全面解读这一开创性工作。

深度学习自然语言处理
新闻资讯7

AI武装的黑产背后,这群人正在打一场看不见的战争。

文章揭示AI在黑产中的应用,如换脸、薅羊毛、钓鱼等,还介绍网商银行安全团队以攻为守的防御策略,像用AI生成验证码、检测行为特征,目标是抬高黑产作恶成本。

数字生命卡兹克
新闻资讯8

英伟达发射了首个太空AI服务器,H100已上天

11月2日,英伟达首次将H100 GPU送入太空,搭载于Starcloud-1卫星测试AI处理应用。太空数据中心能源成本低、不占土地、少排温室气体,Starcloud计划未来大规模部署,还筹划后续任务。

机器之心
新闻资讯8

首次公开!奥特曼重新发明了浏览器

OpenAI首个浏览器Atlas背后技术秘密公开,关键创新是全新架构OWL。它将Atlas应用与Chromium运行时分离,带来即时启动等优势,还为AI智能体用例奠定基础,重构了UI体验。

新智元
新闻资讯7

刚刚,英伟达拟10亿美元砸向这家AI编码创企!Copilot 技术大佬带队、成立两年估值近千亿

10月30日消息,英伟达拟向AI初创公司Poolside投资最高10亿美元。该公司由微软技术大佬带队,定位生成式AI与软件开发交叉领域,开发自研模型,有独特强化学习方法和技术布局。

InfoQ
新闻资讯8

OpenAI首个GPT-5找Bug智能体:全自动读代码找漏洞写修复

OpenAI发布由GPT - 5驱动的白帽Agent——Aardvark,能在大规模代码库自动发现并修复安全漏洞。它不依赖传统技术,工作流程清晰,已开启内测。10月多家科技巨头也布局Agentic AI + 代码安全。

量子位
算法论文8

单条演示即可抓取一切:北大团队突破通用抓取,适配所有灵巧手本体

在灵巧手通用抓取研究中,传统强化学习面临挑战。北大及BeingBeyond团队提出DemoGrasp框架,以一次成功抓取演示轨迹为起点,通过编辑轨迹适应不同物体与姿态,提升学习效率和真机性能,实验效果出色。

量子位
开源动态8

用 Warpgate(5.8k star)在不装客户端的情况下,如何实现透明审计、统一堡垒与会话回放?

Warpgate 是完全透明的 SSH / HTTPS 等堡垒解决方案,无需额外客户端。能部署在 DMZ,提供会话录制等功能,以单一可执行文件发布,用 Rust 编写。文章介绍其痛点场景、功能、架构、上手步骤、应用场景等。

小华同学ai
开源动态8

美团重磅开源!13.6B通用视频生成大模型,能文生视频、图生视频、还能续写!

AI视频生成竞争激烈,美团团队在GitHub开源通用视频生成模型LongCat-Video,参数量13.6B,能文生视频、图生视频、视频续写,几分钟生成720p、30fps长视频,有核心优势,还介绍了安装部署等内容。

开源星探