「国科大」共找到 5061 篇相关文章
全新 AI 消息模型:Apache RocketMQ 如何让 AI 应用拥抱事件驱动架构?
AIGC浪潮下,大语言模型重塑应用开发范式,开发者构建AI应用面临诸多挑战,需可靠高效的异步通信机制。Apache RocketMQ在AI时代演进,有轻量化通信与智能化资源调度两大创新,还介绍了多场景实践。
KV-Cache 实战策略:生产环境中的分页、固定与复用技术解析
在大语言模型推理场景中,KV - Cache 是平衡性能与成本的核心技术,但生产环境中面临诸多问题。本文聚焦其分页、固定与复用三大战术,结合原理、实践与案例,为开发者提供解决方案,还探讨了未来演进方向。
3B激活参数!商汤绝影Sage登顶PinchBench,端侧第一
商汤绝影Sage端侧大模型在PinchBench评测中,以94%任务完成率超越Claude、GPT - 5.4等主流大模型。它激活参数仅3B,算力需求低,还具备多项实用场景能力,靠SCOUT和ERL两项自研技术提升性能。
推荐系统进入「双动力」时代!首篇LLM-RL协同推荐综述深度解析
强化学习是推荐系统主流建模范式,但传统 RL 推荐系统有诸多瓶颈。大语言模型崛起带来新机遇,LLM 与 RL 结合开启新范式。研究团队发布首篇相关综述,提出五大协同范式,总结评估体系,分析挑战与方向。
内行被外行指导、时刻担心被裁,Meta 人现在迷茫又内卷
据《金融时报》报道,Meta首席AI科学家Yann LeCun计划离职创业。他不满公司内部变化,与扎克伯格战略分歧大。Meta近年受大模型冲击,内部现‘外行指导内行’、员工迷茫内卷等问题,还要求元宇宙部门用AI提效5倍。
李飞飞一年前究竟说了啥?怎么又火了
AI教母李飞飞一年前访谈再引关注,她指出大语言模型或许并非真正智能,其基于一维语言信号训练,在理解三维物理世界存在局限。相关实验也证实大模型在物理任务表现差,不过也有人提出不同观点。
卷疯了!这个清华系Agent框架开源后迅速斩获1.9k stars,还要“消灭”Prompt?
随着大模型能力突破,Agent 从概念走向应用,各类框架不断涌现。清华系团队发布开源框架 Cooragent,获 1.9k stars。创始人王政分享 Agent 发展洞察,指出大模型能力提升推动 Agent 商业化,还探讨 MCP、框架等多方面问题。
AI折叠!Fable 5和GPT-5.6,正沦为少数人的特权
当前AI体验出现严重“阶层折叠”,极少数人用Fable、GPT - 5.6等顶级大模型,大众用的是低参数的平庸产品。算力成本让普通人难以触及顶级AI,在医疗等领域也存在使用差距,不过也有人认为普通工作无需顶级模型。
中国芯片就差一台EUV
中国芯片代工取得佳绩,全球前10大晶圆代工厂中大陆占3个。但与台积电差距大,核心在于缺EUV光刻机。9位业内大佬联名呼吁造中国版ASML,国家也将推动产业链协同攻克此技术。
黄仁勋不信泡沫,OpenAI需要“印钞机”
文章围绕OpenAI与AMD、英伟达等的“股权换订单”合作展开,分析AI行业泡沫问题。指出OpenAI收入与投入落差大引发担忧,但也有人认为这次泡沫或不同。还提及科技公司资本支出增长,AI发展空间大。