「开源深度学习框架」共找到 4655 篇相关文章
Stripe x Cursor,硅谷两代“金童”对谈: 未来5年IDE里将不再是代码
本文是 Cursor CEO Michael Truell 和 Stripe CEO Patrick Collison 的深度对谈,讨论了 Stripe 的技术实践、编程的未来。如 LLM 会改变 IDE,未来编程更重需求描述;还提到 Stripe 的技术选型、API 重写计划等。
Qwen3-Next:迈向更极致的训练推理性价比
文章发布Qwen3-Next架构及Qwen3-Next-80B-A3B系列模型,通过混合注意力等改进提升训练推理效率。介绍模型结构、性能优势,还说明使用方法,包括在多平台部署及处理超长上下文,展望持续优化架构。
VerlTool重塑Agentic RL的训练生态
当前LLM像‘缸中的大脑’,缺乏与外界互动能力。新范式ARLT兴起,但构建训练框架面临诸多挑战。VerlTool作为统一、模块化、高效的开源框架应运而生,解决难题,在多任务实验表现出色,推动LLM向智能体转变。
83岁用DeepSeek抢单,96岁凭AI挣养老钱!这群80+老人比你还会玩AI
文章讲述美国不少八九十岁老人积极学习AI,如Luis Bautista创办科技公司,Katherine Cavanaugh用AI接单。不过也有老人反对,担心其带来脑力退化等问题。研究称年长员工受AI影响或更大,还面临职业偏见。
图像编辑太慢太粗糙?全新开源自回归模型实现精准秒级修改 | 智象未来
AI图像编辑中扩散模型有两大难题,智象未来团队提出全新自回归图像编辑框架VAREdit,引入视觉自回归架构,提升编辑精准度与速度。模型和代码已开源,还提出SAR模块优化,在基准测试表现出色。
Crossplane 2.0 发布:在云基础设施之上全面支持应用管理
Crossplane 开源项目发布 2.0 版本,将管理范围从云基础设施拓展到应用与基础设施协同编排。解决了基础设施与应用需分开管理的问题,新增应用支持,改进组合资源,采用命名空间优先设计,还引入新 Operation 类型。
2025年如何学AI?如何用好AI?
文章围绕2025年学AI、用AI展开,作者黄益贺分享问答,涵盖学习指引、工具使用、产品赛道选择等多方面内容,如建议新手边用边学,对比不同工具功能,还分析了各模型和工具的特点与适用场景。
一句话搞定多任务出行,高德用空间智能重新定义地图
高德地图推出业内首个专精“出行与生活”的智能体“小高老师”,依托时空感知多智能体协作系统ST - MAC,可满足复杂出行与生活需求。它重新定义地图,将出行与生活服务融合,引领行业体验深度竞争。
刚刚,智谱开源了他们的最强多模态模型,GLM-4.5v。
智谱接连开源GLM - 4.5和GLM - 4.5V,后者为多模态模型,总参数106B,在42个评测基准中41个达到SOTA。经测试,它视觉推理强、速度快,还有视频理解等功能,API定价良心,体现持续开放精神。
Chatbot 落幕,企业 LLM 才是 AGI 关键战场|AGIX PM Notes
文章围绕 AGI 展开深度思考,指出企业市场是 AI 革命原爆点,让企业数据适配 LLM 是前提。还提及本周市场情况,如对冲基金资金流向,以及多家公司财报超预期、微软和 Meta 加入 GSE 等动态。