「推理系统优化」共找到 4400 篇相关文章
英伟达为何持续押注VASTData?AI存储正在成为新的“算力”|甲子光年
AI产业曾聚焦GPU,如今数据存储设施重要性凸显。VAST Data完成约10亿美元F轮融资,估值300亿美元,英伟达持续跟投。它重构AI数据基础设施,国内焱融科技有相似技术路线且具自主可控优势。
Lovart第一时间上线Image 2:每个人真的可以瞬间拥有一个设计部了
Lovart上线Image 2,有去AI味的写实感、强大文字生成与泛化推理能力,完爆Nano Banana 2。它结合独家工作流,带来设计体验飞升,还给出五个使用场景案例,并对比了与Claude design的差异。
论文解读:一个运算符能导出所有基本函数
波兰雅盖隆大学Odrzywołek发现二元算子EML,结合常数1能生成科学计算器所有标准功能。EML算子简化运算符集合、将离散问题转化为连续优化问题,但存在数值稳定性、表达式非唯一等局限。
告别「想完再做」卡顿!清华StreamingVLA让VLA边想边行动,提速2.4倍
视觉 - 语言 - 动作(VLA)模型“观测 - 生成 - 执行”串行模式致交互卡顿,清华与联想合作提出StreamingVLA框架,引入两项技术实现并行处理,在测试中显著提升效率和流畅度,为VLA模型部署提供新方案。
全球1100万台出货,追觅打造最聪明的扫地机
追觅扫地机将AI打造成完整链路,实现从感知到决策的闭环。其X60 Pro采用超广角双目灵动导航避障技术,提升感知能力,引入强化学习优化决策,全球出货超1100万台,营收增长显著。
ThinkingAI硅谷首秀,发布企业级Agent平台Agentic Engine|甲子光年
美国当地时间4月16日,ThinkingAI在硅谷举办发布会,宣布更名并发布企业级Agent平台Agentic Engine,还与Minimax达成合作。该平台有行动闭环、全域感知、私有化部署三项核心能力,能让系统替企业完成业务全流程。
分享2篇最新Harness论文,一篇谷歌,一篇微软
在LLM Agent迅速发展的当下,如何为其设计合适的Harness成关键问题。本文分享微软M⋆和谷歌AutoHarness两篇论文,分别从记忆系统和动作约束维度提出自动化的Harness进化方法,并介绍了实验结果。
别盯着GPU了,CPU正成为AI时代的“新瓶颈”
进入2026年,AI系统性能越来越取决于执行与调度能力,CPU正成为AI时代的“新瓶颈”。目前CPU市场供应紧张,英特尔、AMD、英伟达等大厂应对策略各有不同,智能体时代算力天平正回摆。
你花80%精力调的AI,效果被 PDF 解析卡死了
做RAG时,花80%精力优化embedding和检索,效果上限却被PDF解析卡死。OpenDataLoader PDF靠不同架构在基准测试获第一,采用混合架构,还做了三件其他解析器不做的事,思路值得学习。
刚刚,Anthropic首超OpenAI!暴买谷歌TPU,Claude杀疯了
Anthropic与谷歌、博通合作打造3.5 GW TPU集群,预计2027年上线。其年化收入破300亿美元首超OpenAI,客户呈指数级增长。但训练和推理成本高,与OpenAI都在冲刺IPO,竞争激烈。