腾讯AI Lab」共找到 9941 篇相关文章

算法论文8

EvaLearn:AI下半场的全新评测范式!

OpenAI研究员指出传统基准测试难衡量AI实际效用。复旦大学与字节跳动等团队提出全新评测范式EvaLearn,以连续问题求解为核心,构建问题并设评分标准,对九个前沿大模型研究有诸多发现。

机器之心
推荐文章7

转译:AI 为啥这么爱用破折号?

文章探讨AI爱用破折号的原因,指出让模型不用破折号很难。分析了几种解释,如从训练数据学来、因“万金油”特性、受RLHF工作者方言影响等,认为训练数据混入大量纸质扫描书是最可能的原因。

宝玉AI
新闻资讯7

每周产业洞察 | 腾讯“元宝派”开启AI社交视听新时代?

北京AIGC视听产业创新中心位于朝阳区东坝乡,是朝阳区推动影视制作基地建设的重要举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚近百家生态伙伴。首创郎园拓展服务边界,项目延伸多地。

郎园Station
算法论文8

AI胡说八道这事,终于有人管了?

AI大模型幻觉问题棘手,GPT - 5幻觉率降低。苏黎世联邦理工学院和MATS研究提出低成本、可扩展检测法,精准识别实体级幻觉,分类器超现有基准,还能识别逻辑错误,团队已公开数据集。

机器之心
开源动态9

谷歌开源移动端AI自动化测试神器

本文介绍谷歌最新开源的移动端AI自动化测试工具ARTEMIS,它可将自然语言指令转化为Android自动化操作,支持跨App测试、多模态定位,在AndroidWorld基准评测中取得99%+任务完成率,提供多场景使用方式,可一键快速上手。

GitHubStore
新闻资讯8

腾讯出手了!彻底入局Agent

腾讯云入局智能体赛道,将大模型知识引擎升级为智能体开发平台。该平台亮点多,如可一键发布到企业微信,具备多工具调用、多Agent协作能力,工作流有全局视野Agent节点,还有Excel检索增强功能,经测试表现出色。

开源星探
新闻资讯8

黄仁勋砸千亿兆瓦算力,押注下一个“Open AI

3月10日,前OpenAI高管Mira Murati创办的Thinking Machines Lab与英伟达达成长期合作,英伟达将提供1吉瓦下一代NVIDIA Vera Rubin系统。这一合作规模巨大,显示英伟达全面布局,也体现该创业公司野心,不过其面临组织动荡考验。

AI前线
算法论文8

AI"学霸"也解不出高中题?耶鲁、复旦发布MMSciBench,揭示AI理科推理能力短板

耶鲁、复旦等推出MMSciBench评测基准,揭示主流模型复杂科学推理短板。它有高质量数据、多模态多题型测试和精细知识分类体系。测试发现模型图文融合及推理能力弱,英文推理或效果更好。

深度学习自然语言处理
新闻资讯8

台积电不相信AI有泡沫

台积电2025年四季度财报多项指标超预期,2026年资本开支大幅上涨。其3nm制程和先进封装优势明显,产能供不应求。AI算力需求爆发让英伟达成新大客户,预计2026年超苹果,台积电未来营收增长可观。

远川科技评论
推荐文章8

企业软件研发AI转型的坐标系:奇点智能研究院发布《AISMM 2026 AI原生软件研发成熟度模型白皮书》

奇点智能研究院发布《AISMM 2026 AI原生软件研发成熟度模型白皮书》。当下模型发展快,但组织转型慢。白皮书构建5×5矩阵,助企业明确自身位置与路径,还剖析软件形态、工程变革等关键内容。

AI科技大本营