「AI能力猜想」共找到 11260 篇相关文章

算法论文8

清华AI找药登Science!一天筛选10万亿次,解决AlphaFold到药物发现的最后一公里

清华大学团队在Science发表论文,研发AI驱动的超高通量药物虚拟筛选平台DrugCLIP。它24小时能完成10万亿次蛋白–分子配对计算,打通从AlphaFold到药物发现通道,完成人类基因组规模筛选,数据已开放。

量子位
算法论文8

TPAMI 2025 | AI对抗迁移性评估的「拨乱反正」:那些年效果虚高的攻防算法们

本文第一作者赵正宇来自西安交大,针对现有迁移攻击方法缺乏系统公平对比分析的问题,将其分为五大类,在 ImageNet 上对 23 种攻击与 11 种防御方法开展评估,证实评估缺陷会误导结论,解决后有新见解。

机器之心
算法论文8

腾讯网关TGW:用户无感知快速迁移及故障自愈能力 | USENIX ATC '25

腾讯与清华联合论文入选USENIX ATC '25,阐述稳定运行多年的TGW网关架构,展示无损迁移、故障自愈及定位系统。该架构应对业务流量挑战,有高性能、高可用等特性,还分享运营经验。

腾讯技术工程
开源动态8

GitHub连续霸榜,难怪别人的图表这么高级优雅!

作者让AI画系统架构图效果不佳,朋友推荐diagram-design项目。它是给Agent用的出图技能包,能让AI生成编辑级质量图表,有多种图表类型,具备诸多亮点功能,还介绍了安装使用方法。

开源先锋
算法论文7

CoT 之后,CoF 如何让帧间逻辑从「隐式对齐」变成「显式思考」?

CoT 虽提升语言模型推理能力,但在 C 端场景有局限,且被质疑并非真实推理。视觉领域提出 CoF 概念,Google DeepMind 团队引入理论,让视频模型通过帧链推理提升帧间一致性,还具强大泛化能力。

机器之心
开源动态8

数字人视频革命!MultiTalk开源:15秒多人对话一键生成,歌唱/卡通全驾驭!

在AI驱动的视频生成领域,创建多人对话场景是难题。MultiTalk是开源音频驱动多人对话视频生成框架,由MeiGen - AI等联合研发,输入多路音频等就能生成嘴型同步的视频,适用于多种场景。

开源星探
新闻资讯7

Meta重组AI团队后首个模型来了:不是最强、不再开源、可能够用

当地时间4月8日Meta发布Muse Spark,是重组AI团队后首个模型。它计算效率有提升,在多模态和健康任务领先,但在编程等场景落后。该模型闭源,适配Meta产品,未来优先产品再生态。

DeepTech深科技
开源动态7

「生化危机」女主用Claude手搓满分AI,一年0.7美元反杀大厂!

《生化危机》女主Milla Jovovich与工程师好友用Claude开源AI记忆系统MemPalace,在LongMemEval获全球首个满分。虽上线后被社区挑刺,团队公开认错,但其成绩和免费本地运行优势仍受关注。

新智元
开源动态8

CVPR 2026 | AI寒武纪时刻?字节世界模型新作,仅靠视觉学习真实世界知识

豆包大模型团队与北京交通大学联合提出视觉世界模型 “VideoWorld 2”,无需依赖语言模型,仅靠视觉信息让机器掌握复杂能力。它能完成复杂手工任务,成功率远超主流模型,代码与模型已开源。

机器之心
产品应用8

腾讯王者归来:混元图像3.0登顶LMArena!一手实测全球最强图像AI

LMArena最新榜单显示,腾讯「混元图像3.0」在文生图任务中夺冠,碾压谷歌Nano banana和字节Seedream 4。它9月28日开源,性能对标闭源模型,有强大推理、语义理解能力,支持中英文长文本渲染。

新智元