蚂蚁数科」共找到 632 篇相关文章

新闻资讯7

陶哲轩都惊了!o3首战「AI奥」碾压夺冠,开源军团仅差5分狂追OpenAI

AI界奥杯重启,OpenAI o3首参赛,算力拉满时以47分夺冠。测评显示在奥学推理上,商用和开源AI差距缩小,开源即将追上商用模型。报告完整测试结果已放出。

新智元
产品应用8

技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务

技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。生技双轨布局,Vidu与MotuBrain同根。

量子位
新闻资讯7

政企研联手发力!N 个实战案例!企业智化转型的石景山企业专属方案重磅登场 | Q推荐

全球人工智能开发与应用大会暨石景山智化转型峰会(AICon 北京站)将于 2025 年 12 月 19 - 20 日在北京石景山举行。大会围绕企业智化转型与 AI 实战落地,设项目启动会、全国性论坛和行业峰会,助企业明确转型路径。

AI前线
开源动态8

AI医生终于有了硬标尺!全球首个专病循证评测框架GAPS发布,蚂蚁联合北大王俊院士团队出品

蚂蚁健康与北大王俊院士团队发布全球首个大模型专病循证能力评测框架GAPS及评测集GAPS - NSCLC - preview,解决现有医疗AI评测局限,成果已应用于“蚂蚁阿福”,并客观评价了大模型临床能力。

量子位
开源动态8

蚂蚁开源 x SGLang Meetup技术回放解读系列之面向DeepSeek系列模型的深度优化与实践

文章是对蚂蚁开源x SGLang Meetup中「蚂蚁Theta面向DeepSeek系列模型的深度优化和实践」分享的解读,详细介绍了在H20-96G上对DeepSeek系列模型推理的优化方案,包括Prefill和Decode阶段的优化、通信优化、观测诊断等,并给出了评测结果。

GiantPandaLLM
产品应用7

蚂蚁即将上线通用 Agent

蚂蚁百宝箱团队将在今年外滩大会正式上线 Tbox 超级智能体,其产品形态与部分平台相近,能让不同角色分工协作。实测显示它在多方面表现不错,但也存在细节不足,官网有诸多案例。

特工宇宙
新闻资讯7

蚂蚁阿福对打ChatGPT Health,哪家强?

全球技大厂在健康赛道竞争激烈,OpenAI推出ChatGPT Health,与蚂蚁阿福功能相似。对比发现,阿福在功能精细度、打通专业医疗服务上领先,二者都引入专家团提升专业性。

AI科技评论
推荐文章7

蚂蚁武威:下一代「推理」模型范式大猜想

文章围绕下一代「推理」模型范式展开,蚂蚁技术研究院武威提出不同观点,认为长思维链推理未必最优,未来推理模型或更低维稳定,还探讨推理定义、重要性及解法猜想,如结合快慢思考等。

AI科技评论
新闻资讯7

大模型玩不好独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异独”正确率仅2.9%

Transformer作者初创公司Sakana AI公布AI解决独能力排行榜,用全新基准Sudoku - Bench考验大模型创造性推理能力。结果显示大模型总体正确率仅15%,9×9独中高性能模型o3 Mini High正确率2.9%。

量子位
算法论文8

图谱检索全面 or 效率?蚂蚁&浙大Deep GraphRAG:全都要

传统 RAG 遇复杂 Query 易失效,GraphRAG 带来新三难。蚂蚁与浙大提出 Deep GraphRAG,有层次化检索、Beam - Search 重排、DW - GRPO 强化学习三板斧,实验显示其性能优、延迟低。

PaperAgent