「设计语言」共找到 2302 篇相关文章
Hinton突然对AGI乐观了!“Ilya让他看到了什么吧…”
Hinton接受独家访谈,将AI风险分短期和长期,认为长期是AI接管人类。他观点大转变,从“养虎为患”到提出赋予AI“母性本能”实现共存,还批评马斯克和奥特曼,看好AI医疗应用。
苹果新研究:不微调、不重训,如何让AI提问效率暴增6.5倍?
苹果与牛津、港城大合作提出 BED - LLM 方法,能让 AI 解决问题能力提升 6.5 倍,无需微调重训。它基于序贯贝叶斯实验设计框架,通过三重智慧设计,经测试全面超越基准方法,或开启‘智慧对话’时代。
秋招超强助攻:零基础1小时上手GPT微调!全流程教程免费开源
新一年秋招季,岗位对AI能力要求提升。OpenAI发布新开源大模型GPT - OSS,博主Lorentz Yeung开源本地部署和微调训练GPT - OSS的教程,助零基础者上手,还介绍环境搭建、代码和训练前后效果对比。
EMNLP 2025 | 动态压缩CoT推理新方法LightThinker来了
随着AI发展,大语言模型处理复杂推理任务能力提升,但推理产生大量中间步骤和文本,拖慢计算速度、增加资源压力。研究者提出LightThinker,模仿人类思考模式,动态压缩推理步骤,削减tokens数量,降低成本。
OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式
现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。
大模型解数学题是真懂还是 “死记硬背”?|首个反例驱动的数学推理基准揭穿 “刷题式假象”!
随着大语言模型在数学领域应用渐广,其是否真具备数学推理能力成焦点。清华等团队提出反例推理评测基准COUNTERMATH,测试20+主流模型,结果不佳,而小样本微调能显著提升模型能力。
唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力
大语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。
波士顿动力Atlas人形机器人再现逆天进化:通用AI机器人真的要来了
波士顿动力为Atlas人形机器人训练全新大型行为模型LBMs,它是语言指令驱动的策略模型,能完成复杂操作任务。构建模型有四步骤,实践遵循三大原则,还展示了其多方面操作能力与特点。
Kimi 大模型训推混部的稳定性与资源优化实战
月之暗面系统工程师黄维啸在 QCon 大会分享 Kimi 大模型训推混部实践。介绍了训推集群挑战,如故障多、资源利用低等,还阐述了全链路稳定性提升、资源高效利用及强化学习混合部署等方案。
竞购 Chrome,正面竞争 OpenAI,Perplexity 为什么要做 AI 浏览器?
今年 Perplexity 推出 AI 原生浏览器 Comet,OpenAI 也计划发布浏览器,Perplexity 还出价 345 亿美元收购 Chrome。文章梳理了 Perplexity CEO 观点及 a16z 测评,介绍 Comet 特点、目标、优势,还对比了 Comet 与 Dia。