「百炼模型服务」共找到 8291 篇相关文章
a16z 合伙人:AI 正将 10 倍工程师“降级”为 2 倍!应用层已无技术护城河,未来在基础设施和业务深耕
Andreessen Horowitz (a16z) 的合伙人 Martin Casado 在对话中指出,当前AI大模型竞争格局似当年云计算大战,寡头垄断将降临。他还谈到AI对开发者、投资决策、市场格局的影响,以及对AI安全、开源等问题的看法。
李建忠:关于AI时代人机交互和智能体生态的研究和思考
在2025全球产品经理大会中,奇点智能研究院院长李建忠分享了大模型驱动的AI产业生态和产品创新。他谈到推理范式转换使模型进入“经验数据时代”,还分析了应用开发、人机交互范式转换及智能体生态演进,预言孤立App时代终结。
破解AI对不同上下⽂位置的敏感度不⼀致,新框架使出“解铃还须系铃人”
语言模型存在位置偏见,影响复杂推理等任务。论文提出Pos2Distill框架,将模型优势位置能力迁移到劣势位置缓解偏差,设计了Pos2Distill - R1和Pos2Distill - R2,在检索和推理任务表现好且有跨任务泛化能力。
MOE RL实战:统一FP8全流程训练
SGLang RL团队等联合完成工作,实现RL中全流程FP8训练与采样。介绍FP8训练硬件基础、格式、scale选择等,指出训练难点,分析KL Loss异常归因,验证其在MoE模型RL应用效果,还探究模型规模对训推不一致性的影响。
27M参数战胜GPT-4!脑启发的分层Reasoning引擎如何重塑LLM
当前大语言模型(LLM)核心架构存在根本性缺陷,受大脑分层处理和多时间尺度启发,本文提出仅2700万参数的分层推理模型(HRM),免预训练与CoT标注,单次前向传播解决复杂任务,在ARC - AGI上超越GPT - 4等LLM。
LeCun炮轰Hinton:他认可LLM就是想摆烂退休了!
Yann LeCun在播客专访中火力全开,炮轰Hinton认可LLM是想摆烂退休,直言LLM不是通往智能的路,还吐槽Meta卷入LLM竞赛后无法专注研究。他介绍了新公司AMI和世界模型、JEPA等技术,认为JEPA类世界模型五年内将统治AI圈。
【博客翻译】使用PyTorch加速生成式AI第四部分:Seamless M4T,快速优化
这是使用纯原生PyTorch加速生成式AI模型系列博客的第四部分,专注加速FAIR的Seamless M4T - v2模型。通过torch.compile + CUDA Graph,在不损失精度下实现text decoder模块2倍、vocoder模块30倍加速,端到端推理2.7倍加速。
阿里云的野心,不在 Agent Builder
近期云厂商动作整齐,如阿里云推出企业级 Agent 全栈服务平台 Agent Studio。企业做 Agent 面临基础设施难题和高成本问题,业内探索了自建、用开发框架、企业级 Agent 平台三种路径,阿里云 Agent Studio 在多方面替企业解决麻烦,还可能改变云服务模式。
R-HORIZON:长程推理时代来临,复旦NLP&美团LongCat重磅发布LRMs能力边界探测新范式
复旦大学与美团LongCat Team联合推出R - HORIZON,它是首个系统性评估与增强LRMs长链推理能力的方法与基准。提出Query Composition方法构建评测基准和训练数据,评测发现主流模型长链推理性能断崖式下降,还分析出三大瓶颈,训练后模型性能双重提升。
AI 的终极护城河不是模型
硅谷风投投资人Jaya Gupta指出,当AI领域趋同,产品易被复制时,公司组织形态才是难以复制的护城河。如OpenAI、Palantir围绕新型工作创造新型机构,吸引特定人才。公司应匹配叙事与组织形态,选人要注重结构认可。