「阿里云无影」共找到 1454 篇相关文章
LM Studio宣布支持在Mac上跑Qwen3-Next 80B模型
LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。
⼤模型是万能的吗?探索机器学习+⼤模型在某出海投资业务的应⽤
本文基于公共云大客户出海投资业务案例,探讨用AI大模型结合机器学习算法构建投资预算预测与分配系统。历经三版方案迭代,从纯大模型到引入机器学习算法,目前项目处于落地阶段,有望实现多方共赢。
CS博士求职8个月0 offer,绝望转行!斯坦福入学停滞,全美仅增0.2%
曾经热门的计算机专业渐成「冷门」,全美入学率仅增0.2%,斯坦福等校招生下滑。AI自动化初级编程岗位,致就业前景暗淡,如田纳西大学博士生求职8个月无果。不过也有人认为低迷或为短期,专家建议选培养可迁移技能学科。
传言称:Llama 4 团队80%成员集体辞职!
有爆料称Meta的Llama 4团队约80%成员集体辞职,引发AI圈关注。但Meta员工澄清该消息不准确,且无权威媒体证实。不过Meta和Llama 4项目确实面临高层动荡、模型延期等问题,还分析了可能的深层原因。
企微的这些新功能,补齐了AI在你公司的最后一公里
文章指出企业中大量数据不在线上,影响AI落地,过去补数据入口有问题。企业微信5.0.8版升级从组织级入口切入,新增‘记录面聊’和升级‘智能表格’,接住沟通和数据的context,让AI看见完整公司。
突发:SpaceX 或 600 亿美元收购 Cursor
SpaceX官宣与Cursor合作,打造编程和知识工作AI。Cursor授予SpaceX今年晚些时候以600亿美元收购的权利,或支付100亿合作费。Cursor增长快但无自研模型,合作可助其训练模型。此外还介绍了编程AI市场竞争情况。
【实测&解读】全球首个手机通用Agent——AutoGLM 2.0发布!我喝到了AI为我点的第一杯咖啡~
智谱更新的AutoGLM 2.0是全球首个手机通用Agent,适配苹果和安卓手机,无需交出手机使用权。它配备云手机和云电脑,由GLM - 4.5和GLM - 4.5V驱动,能完成点咖啡等多场景任务,因风险控制付款需人确认。
大模型刷数学题竟有害?CMU评估20+模型指出训练陷阱
CMU团队评估20多个大模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。
超越 GoF:现代 AI 系统实用设计模式
文章指出AI系统需要设计模式,如GoF塑造软件设计,云计算引入新模式,机器学习社区也有相关模式。文中介绍现代AI系统的5类实用设计模式,含提示和上下文、负责任的AI、用户体验、AI - Ops和优化模式等,并举例说明。
一篇多模态大模型推理技术最新综述
华东师大&字节跳动系统回顾基于强化学习的MLLMs推理进展,涵盖关键算法设计、奖励机制创新及实际应用,探讨了RL在LLMs/MLLMs中的关键设计与优化策略,还涉及多模态大模型推理多方面内容。