阿里通义Lab」共找到 921 篇相关文章

算法论文7

估值840亿AI实验室再放大招,他们要给大模型戴上「紧箍咒」

新智元报道,OpenAI前CTO创办的Thinking Machines Lab发布研究「模块流形」,将传统数值修正转为「预防式」约束优化。它提出新范式,为训练大模型提供新思路,还介绍了流形优化器及相关算法。

新智元
开源动态8

ROLL:面向大规模语言模型的高效强化学习框架

本文介绍阿里推出的ROLL强化学习框架,专为LLM训练优化。它设计灵活,不同用户可用其满足业务、探索或线上指标需求。在多任务训练中性能出色,还采用创新机制提升效率,支持自定义操作,适合学术和业务场景。

阿里云开发者
推荐文章7

评估工程正成为下一轮 Agent 演进的重点

文章指出传统软件工程测试方法难用于 AI 系统,促使评估工程成 Agent 演进重点。它贯穿 AI 生命周期,正走向体系化。介绍评估工程发展阶段,还提及阿里云 RM - Gallery 和云监控 2.0 实践。

阿里云开发者
算法论文8

GraphRAG太慢LightRAG延迟高?华东师大新方法一招破解双重难题

华东师大李翔老师带领的Planing Lab团队推出E²GraphRAG方法,解决GraphRAG索引慢、LightRAG查询延迟高的问题。该方法用SpaCy识别实体,结合图和树查询,在构建和查询时间上表现出色。

量子位
产品应用8

云栖大会演讲实录:Qoder 产品背后的思考与未来发展

这是云栖大会上关于 Qoder 产品的演讲实录。Qoder 是阿里推出的 Agentic 编程平台,上线一月收获数十万用户。介绍了 AI Coding 三阶段,阐述 Qoder 定位、功能模式、技术优势,展望 AI Coding 未来。

阿里云开发者
新闻资讯8

李飞飞发布世界模型新成果:一个提示,生成无限3D世界

李飞飞创业团队World Labs宣布能生成持久、可导航且能自定义操控的3D世界。该模型专注构建3D环境,有更好几何形状、多样风格、更大规模,还支持无限畅游,已推出beta版。

量子位
新闻资讯7

Mira Murati新公司获20亿美元融资,估值100亿美元

金融时报消息,前OpenAI首席技术官Mira Murati创立的AI公司“Thinking Machines Lab”获20亿美元种子轮融资,估值100亿美元。公司致力于开发人工通用智能,目前对产品和技术细节高度保密。

AIGC开放社区
新闻资讯7

Sutton、OpenAI 联创押注的持续学习,有中国团队带着模型进场了

7 月,TML 发布 Inkling 模型,Mind Lab 发布 Macaron V1,二者均针对持续学习场景。持续学习走「参数空间的迭代」路线,让模型用得越多越好用。硅谷已有不少新尝试,产业链正在形成。

Founder Park
算法论文8

大模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion

上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。

量子位
开源动态8

本地Opus你要不要!Qwen3.8-27B开源

阿里Qwen团队开源Qwen3.8-27B,上线2天登顶Hugging Face全球大模型趋势榜,下载破百万。其性能超Opus4.6,与顶尖模型相当,量化后普通电脑就能跑,原生多模态,编程、Agent、多模态跑分表现出色。

AIGC开放社区