「选择」共找到 341 篇相关文章
中移动九天团队MultiPL-MoE:全新Hybrid-MoE架构用于增强通用大模型低资源代码能力
大语言模型在有限计算资源下提升多语言代码能力面临挑战。中国移动九天团队提出 Hybrid MoE 架构 MultiPL - MoE,耦合两层专家选择机制优化,实验证明其在增强低资源代码能力、缓解高资源语言遗忘上有效。
一名员工用个 AI 工具,直接把 Vercel “送”进黑客手里!AI 还在替你决定技术栈,vibe 产品危?
当地时间4月19日,云开发平台Vercel确认内部系统遭未授权访问,黑客出售窃取的数据。攻击源于员工使用的AI平台Context.ai安全事件。此外AI编程助手正重塑技术生态入口,影响工具选择。
关于多模态大模型Token压缩技术进展,看这一篇就够了
多模态大模型跨模态融合带来高计算成本,催生MLLM Token Compression研究。北大等机构人员基于压缩位置对方法系统归类,讨论特定场景压缩机制选择,还探讨了挑战与前景方向。
全球AI算力大战变天!十万卡算力集群爆表,国产IB真香?
大模型竞赛进入万卡、十万卡时代,网络取代算力成新瓶颈。过去RoCE因成本优势受青睐,但集群规模扩大后运维复杂。IB架构以其稳定性迎来价值重估,国产IB方案突破或改变技术路线选择。
很多创业者都没意识到,Deep Research 也是做 Go-to-Market 的利器
用好 Deep Research 可提升 AI 产品 GTM 效率,主流 AI 产品都有该功能。前 Meta 战略总监写实用指南,从技巧、提示词公式、工具选择等阐述,还给出 5 个 GTM 用例及提示词模板。
别再用单选评测骗自己了!Amazon新论文揭示了大模型在多选题中的3种系统性偏差
Amazon新论文揭示大模型做多选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型多选题正确率。
硅谷的企业级AI正在这样赚钱|2025人工智能现状报告
ICONIQ Capital发布的2025年人工智能现状报告聚焦企业级AI变现。报告基于对300名软件公司高管的调查,分析了模型选择、支出、工具使用等情况,指出AI产品战略进入新阶段,定价策略在重塑等。
一文读懂:数据中心“拥抱”ARM架构,为何如此艰难?
文章探讨企业数据中心采用ARM架构面临的难题。如现有x86架构主导,切换有兼容性问题;ARM硬件选择有限、性能不足;云服务功能难对等;软件支持和许可证问题也阻碍其应用。
Anthropic长文:多智能体协作模式,五种方法及其适用场景
Anthropic官方长文总结5种多智能体协作模式及适用场景,指出何时用多智能体或单智能体更好,还分析各模式工作机制、适用场景、易翻车点,给出架构选择和新手操作建议。
CS专业爆冷,失业率达艺术史2倍!年入千万只需5年,大学却在禁Cursor
在AI浪潮下,CS专业情况两极分化,25岁辍学生用不到2年打造百亿美金Cursor,而CS毕业生失业率达艺术史2倍。美国创业机构YC举办圆桌讨论,探讨AI时代职业选择、学校价值等问题。