研究能力」共找到 4735 篇相关文章

开源动态8

图文跨模态“近视”问题破局:360开源新模型 FG-CLIP,实现细粒度图文对齐突破|ICML2025

360人工智能研究院发布 FG - CLIP 模型,攻克图文细粒度对齐难题,成果被 ICML 2025 接收并开源。它采用双阶段训练等策略,在多任务评测中超越对比模型,推动跨模态研究产业化落地。

AI科技大本营
产品应用8

打破56年数学铁律!谷歌AlphaEvolve自我进化实现算法效率狂飙,堪比AlphaGo“神之一手”

谷歌DeepMind联合顶尖科学家打造「通用科学人工智能」AlphaEvolve,打破矩阵乘法领域56年效率基准,将4x4矩阵乘法标量乘法次数从49次降至48次,还在谷歌内部加速了运算、缩短训练时间。文中介绍其原理与技术。

量子位
新闻资讯8

李飞飞最新播客:AI 是一项文明级技术,以人为本是关键

AI教母李飞飞在High Signal播客指出AI是文明级技术,分享构建以人为本AI的见解,涵盖研究动机、好奇心作用、AI同心圆层级等话题,还强调空间智能重要性,给出AI发展建议。

AGI Hunt
产品应用8

AI重塑搜索:夸克“深度搜索”如何定义下一代信息入口|甲子光年

大模型发展推动搜索产品革新,“搜索”变“深度搜索”。夸克升级AI超级框发布“深度搜索”,即将推出“深度搜索Pro”。其“深度搜索”情商高,“深度搜索Pro”免费、快速、专业,夸克正打造AI全能助手。

甲子光年
新闻资讯8

客服智能体走到“上岗”前夜,企业还要跨过几道门槛?|甲子光年

本文聚焦客服智能体产业发展现状,指出当前已从“能对话”阶段进入“能办事”落地期,分析了真实生产场景落地面临的挑战,同时预告iRTE2026实时智能大会企业级客服智能体专场的相关议题。

甲子光年
算法论文8

复旦上线音视频模型新裁判:一万组数据对齐人类审美

现有音视频生成领域的奖励模型多依赖局部指标打分,不符合人类整体审美感受,易让模型“刷高分”却未真正提升生成质量。复旦大学团队推出VA-Judger,基于一万组人类偏好数据训练,可从整体维度判断生成质量,对齐人类审美。

量子位
新闻资讯8

华为首发企业AI白皮书:AI让员工更快了,怎样让整个企业受益?

本文为量子位报道,华为在全联接大会2026首发企业AI白皮书,针对当前企业AI单点提效难转化为整体业务收益的痛点,提出企业智能化建设的参考架构与工程落地路径。

量子位
开源动态9

拿下开源生图第一,千问Qwen-Image-2.1把生图卷出新高度

本文介绍阿里千问最新开源的7B参数量生图模型Qwen-Image-2.1,该模型拿下公开评测开源生图第一,实现文生图与图像编辑一体化,原生支持透明图生成,最多支持10张参考图输入,强化了局部编辑与人像商品保真,轻量且实用性强

机器之心
推荐文章9

TikTok SRE 技术负责人:AI Agents 说到底就是分布式系统

本文整理自TikTok SRE技术负责人Salman Munaf的公开演讲,提出AI Agent具备调用外部服务、执行状态变更能力后,本质就是分布式系统,需运用分布式系统领域成熟经验规避风险、保障安全可靠。

AI前线
产品应用9

实时编辑、实时互动视频双旗舰,Vidu S2发布即体验

本文介绍生数科技推出的Vidu S2,专为实时交互编辑设计的AI视频模型,覆盖三类核心能力,公开技术路线,发布当天开放体验与API,迭代仅用69天。

机器之心