「蚂蚁报告」共找到 544 篇相关文章
秘塔AI也终于悄悄上线了DeepResearch。
秘塔AI搜索上线新功能DeepResearch,作者测试后评价颇高。它有可视化界面,能展示思考执行过程,打破AI黑盒。输出报告质量好、精准度高,还可生成互动网页,且免费额度多,虽有小问题但仍值得肯定。
扩散语言模型真的会比自回归好?理论分析结果可能恰恰相反
北京大学和蚂蚁集团研究表明,扩散语言模型虽理论上有并行生成优势,但实践中在某些任务推理成本更高。研究通过实验对比,分析了扩散与自回归模型在不同评估指标下的效率,指出选择模型要视任务需求。
120页深度报告,搞懂今年大模型和应用的现状与未来
Innovation Endeavors合伙人Davis Treybig发布《State of Foundation Models》(2025),从七个维度剖析AI产业现状与趋势。报告指出,AI发展迅速,模型成本高且迭代快,应用渗透各行业,智能体崛起,市场结构变革,公司运作方式也在重塑。
一个极度实用的Prompt,帮你挖掘出自己的隐藏天赋。
作者朋友被裁后认为自己没天赋,作者由此思考天赋问题,花时间迭代出挖掘天赋的Prompt,借助AI与人深度对话,根据回答输出天赋报告,还举例自己找到天赋的经历,强调找到天赋的重要性。
KAG-Thinker:「结构化」思考新范式,支持逻辑严谨的大模型复杂推理
近日,蚂蚁集团知识引擎团队协同高校发布 KAG-Thinker 模型,是 KAG 框架重要迭代。它聚焦复杂推理,建立结构化思考范式,实验显示其性能在多数据集上有提升,还在医疗问答验证了专业领域有效性。
AI Infra 工程师们如何应对大模型流水线里的“暗涌”?
InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。
揭秘大模型评测:如何用“说明书”式方法实现业务场景下的精准评估
文章系统性介绍业务场景下大模型评测流程,包括需求分析、评测集设计生成、维度设定、任务执行和报告输出。指出评测挑战,如设计维度和集,还给出评测方法及案例,像蚂蚁评测集、业务自动化评测。
SOTA级的Embedding模型!F2LLM模型、数据、代码全部开源,人人可用
Embedding 模型应用广泛,但主流模型训练困难。蚂蚁集团与上海交大推出 F2LLM,含 0.6B、1.7B、4B 系列模型,仅用六百万数据微调基座,在 MTEB 榜单领先且完全开源。介绍了其数据、训练、测评等情况。
告别功能内卷,产业AI需要一记“ACE球” | 甲子光年
文章指出产业AI在金融等行业落地面临挑战,投入产出错配。蚂蚁数科在外滩大会推出‘按效果付费’模式,提出‘ACE’方法论,以行业大模型和实战经验助力落地,成果初显,有望推动AI to B行业变革。
马斯克懂王闹掰!70亿美元砸出全球最大AI超算巨兽,奥特曼偷笑太早
Epoch AI报告揭示,不到10年顶级AI算力或暴涨8万倍。马斯克与特朗普决裂,奥特曼或成受益者。xAI砸70亿美元打造全球最大AI超算Colossus,还分析了算力、成本、电力等趋势及格局变化。