计算资源报告表」共找到 1288 篇相关文章

算法论文8

成本降70%!清华、阿里通义带来智能体长程任务新解法

AI智能体处理长程任务常遇上下文超载问题。清华与阿里通义研究人员提出MemPO算法,赋予大模型主动管理记忆能力,准确率提升,计算资源消耗降近七成,不过评价机制有局限。

AIGC开放社区
开源动态7

本周 5 个实用的 Github 开源项目,真香!

文章介绍本周5个实用Github开源项目。有资源聚合媒体中心stremio-web,AI原生安全测试平台CyberStrikeAI,本地优先AI编程远控工具hapi,智能股票分析系统daily_stock_analysis,纯前端JavaScript GUI智能体框架PageAgent。

开源先锋
新闻资讯7

惊爆提示词漏洞?Prompt 工程师开始失业

Noma Labs披露Salesforce Agentforce的“ForcedLeak”链式漏洞,攻击者串联“提示注入”致敏感数据外泄。ESET也告AI勒索软件PromptLock。Prompt正转向Context,Prompt工程师或失业,价值向能组织语境流程者转移。

MacTalk
7

7亿人每周狂发180亿条消息!OpenAI首次揭秘ChatGPT最火用途

OpenAI联合杜克、哈佛发布ChatGPT首份使用告,显示周月活达7亿,成高学历白领办公利器,编程冷门。同时,Anthropic告称人们交给Claude完成任务比例涨至49%,Claude主战场是代码编写。

新智元
算法论文8

大模型「越用越快」!SpeedupLLM首次验证,大降56%推理预算

Emory大学研究者提出SpeedupLLM框架,利用动态计算资源分配和记忆机制,使LLM处理相似任务时推理成本降56%、准确率提升,论文系统性验证了LLM“越用越快”,为AI模型发展提供新思路。

新智元
开源动态8

Meta 新成立超级智能实验室,让大模型RAG推理速度飙升30倍

Meta新成立超级智能实验室(MSL),首篇论文REFRAG将RAG推理速度提升30倍以上。它先把上下文压缩成摘要再解码,减少计算量和延迟,在多任务测试中表现出色,为大模型部署提供实用方案。

AIGC开放社区
产品应用8

英伟达发布物理AI和机器人顶级开发平台Nvidia Jetson Thor

英伟达官网发布专为物理AI和类人机器人打造的顶级平台Nvidia Jetson Thor。其AI计算能力强劲,相比NVIDIA AGX Orin性能和能效大幅提升,硬件配置、存储、多媒体处理及相机支持等方面表现出色,能应对复杂场景。

AIGC开放社区
新闻资讯7

成立五年,这家国产EDA公司冲刺IPO

据上海证券道,上海合见工业软件集团股份有限公司于12月26日提交IPO辅导备案申请。合见工软作为国内EDA领域领军企业,填补多项空白,助力国产替代。“超节点计算”带来新挑战,也为国产企业提供机遇。

芯师爷
算法论文7

低延迟、高吞吐,LLM优化与高效推理引擎综述

LLM计算成本高,用户要低延迟,企业要高吞吐。工程师开发优化技术,如动态批处理、KV缓存、模型量化。论文对比25款推理引擎,还探讨了多模态支持、手机端推理、新型架构支持等进化方向。

深度学习自然语言处理
新闻资讯8

2025 AI巨头「全员恶人」:恩怨、爱恨与算计

2025年AI巨头纠葛不断,OpenAI与微软关系生变,苹果找谷歌合作,Meta开源受挫且内斗,马斯克的xAI崛起。各方在商业、技术、人才等方面展开博弈,背后是资源争夺和对未来的焦虑。

新智元