「阿里通义Lab」共找到 921 篇相关文章
上海AI Lab新研究:SFT能泛化,只要满足这三个条件
上海人工智能实验室等团队研究指出,“SFT泛化能力差”定论有局限。SFT泛化能力受优化过程、数据质量与结构、模型基础能力共同制约,研究还揭示其训练中的现象及副作用。
媲美Claude 4,支持100万上下文!阿里开源超强代码AI Agent模型
阿里巴巴开源超强AI Agent模型Qwen3 - Coder - 480B - A35B - Instruct,测试分数媲美Claude Sonnet 4,超越DeepSeek。它参数多、支持大上下文窗口,训练数据优质,还进行代码强化学习扩展训练等,有对应命令行工具。
告别随机性:Thinking Machines Lab如何实现了LLM推理的完全确定性?
文章指出LLM推理非确定性根源并非GPU并发和浮点非结合性,而是批大小变化致核函数非不变性。作者提出实现批不变操作的策略,实验验证有效,还阐述其对训练、系统可靠性等方面的意义。
再造一个10亿爆款!Ins之父卸任Anthropic CPO,空降一线写代码
Anthropic高层大调整,Instagram之父Mike Krieger卸任CPO,转岗加入核心神秘部门Labs成技术团队成员。Anthropic扩展Labs团队,欲围绕Claude快速迭代产品,应对竞争。
Synk收购Invariantlabs-AI安全技术的强强联手
2025年6月24日,安全AI软件开发领导者Snyk宣布收购AI安全研究公司Invariant Labs。Snyk CEO称收购增强了抵御新兴威胁能力。Invariant Labs在MCP领域领先,成果丰富,Snyk也有多样产品,合并有望带来1+1>2效果。
林俊旸从阿里离开后首度发声:推理模型的时代快结束了
前通义千问Qwen负责人林俊旸离职后发长文,指出AI正从「推理思考」转向「智能体思考」,分析推理模型发展,谈混合思考模式失败,还提及智能体思考挑战及相关企业、学术界进展。
我花12小时深度实测,阿里Qwen-3 Coder被Kimi K2“吊打”!
作者花12小时在真实项目中实测阿里Qwen - 3 Coder和Kimi K2。结果显示,Kimi K2在任务成功率、指令遵循、Bug修复、代码重构等方面全面领先,成本还更低,作者更推荐Kimi K2用于代码开发。
我烧了上亿token玩Clawdbot,结果发现国产平替更香,还免费。
作者花上亿token研究Clawdbot,发现其虽火但贵,Cowork也因收费和网络限制被盖过热度。作者转而探寻国内平替,介绍阿里云上线Moltbot云服务,重点推荐阿里QoderWork,测试后认为它是能打的免费平替。
刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude
阿里巴巴突袭发布新一代基座大模型Qwen3.8 - Max,它总参数量达2.4万亿,在多场景表现出色,在权威榜单冲进全球第一梯队,性能直逼Claude,且价格实惠,实测反馈良好。
OpenClaw大考!上海AI Lab InternLM团队WildClawBench 60题,把「龙虾」AI打回原形
上海人工智能实验室InternLM团队推出WildClawBench,含60道高难度任务,在真实OpenClaw环境端到端评测AI Agent。评测涵盖多类别任务,已测14个模型,国产模型表现亮眼,项目开源可复现。