「加速框架」共找到 2172 篇相关文章
硅谷AI初创重新拥抱996
AI创业高潮下,硅谷初创公司竞相采用996模式,甚至沿用其名追赶中国。虽有公司提供福利,但遭部分人声讨,有人认为制造风险、透支生活,也有人觉得报酬可观。
DeepSeek推理最高提速6倍!开源研究:加装「思维进度条」,计算量减少30%
特拉维夫大学团队开发新方法,给LLM推理任务装进度条,控制推理深度和速度。提出“思维进度向量”TPV预测推理位置,干预TPV可“超频”“降频”,模型已在GitHub开源。
独家揭秘OpenAI核心文件:AGI五级突破实锤!微软130亿投资或打水漂
新智元揭秘OpenAI核心文件,Ilya Sutskever曾预言AI无所不能,也担忧其失控后果。OpenAI与微软的合同中AGI条款成谈判核爆点,未公开论文划分AGI五级,让微软130亿投资或打水漂。
不会搭工作流?ComfyUI-Copilot迎来更新,说话就能搞定!
几个月前阿里推出ComfyUI - Copilot提升ComfyUI易用性与效率。近期它迎来更新,用智能节点推荐等功能解决新用户难题,核心采用分层多智能体框架,还具备参数探索等功能。
MCP Server的五种主流架构与Nacos的选择
文章剖析MCP Server五种主流架构模式,结合Nacos服务治理框架,为企业级MCP部署提供指南。介绍各架构优缺点与适用场景,展示Nacos赋能及实战集成,还给出架构选型指南。
中国需要什么样的机器人?
当下具身智能火爆,人形机器人虽吸睛但商业化难。工业智能体已落地产线,如思谋科技产品进入全球300家龙头企业流水线。行业存在算法不成熟、发展慢等痛点,工业具身智能有望成下一个热门赛道。
华为曝光两大黑科技!打破推理延迟魔咒,大模型从此「秒回」
华为通过FusionSpec和OptiQuant两大技术创新,对MoE模型进行推理优化。FusionSpec依托昇腾特点,将投机推理框架耗时降至1ms;OptiQuant支持灵活量化,为大模型推理提供高性价比。
斩获20K星!再见PDF排版噩梦,这个开源神器让文档处理爽到飞起!
MinerU是上海人工智能实验室推出的开源数据提取工具,能将多模态文档解析为Markdown,支持精准提取图片、表格、公式,具有多语言支持、高性能等特点,应用场景广泛,还开源免费。
想给产品加一个 AI 搜索,是上向量数据库还是用 MongoDB 就够了?
本文解答产品添加AI搜索时,选用专用向量数据库还是MongoDB的选型疑问,理清两类检索的能力边界,讲解MongoDB检索的架构、用法与踩坑点,给出可复用的选型判断框架。
北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%
随着模型规模增长、新应用兴起,大模型基础设施面临管理「张量状态」挑战。北大、阶跃星辰与北邮联合提出 TensorCast,解耦张量状态,复用管理能力,在多场景测试中表现出色,为大模型基建提供新范式。