「AI智能体推理框架」共找到 12206 篇相关文章
上线12天跑赢ChatGPT!Meta爆款AI自曝老底,灵魂文件来自OpenClaw
Meta推出的个人智能体Muse上线12天累计装机280万次,下载量跑赢ChatGPT登顶美区App Store,随后被曝核心设计沿用开源项目OpenClaw框架,Meta高管承认借鉴,本文梳理事件始末并分析行业趋势。
当 GPU 成为主角:解锁 AI 集群中那 85% 的闲置 CPU 算力
全球AI算力规模增长,GPU成主角,但GPU满负荷运转时CPU利用率低,传统调度机制无法保障优先级,造成资源浪费。TencentOS如意(RUE)的在离线混部技术改造Linux内核调度体系,高效释放算力。
告别随机性:Thinking Machines Lab如何实现了LLM推理的完全确定性?
文章指出LLM推理非确定性根源并非GPU并发和浮点非结合性,而是批大小变化致核函数非不变性。作者提出实现批不变操作的策略,实验验证有效,还阐述其对训练、系统可靠性等方面的意义。
一家新能源大厂,如何撑起全球最大AI算力超级单体?
8月6日,远景科技集团在乌兰察布宣布「远景乌兰察布星河基地」投产,全球最大AI算力超级单体亮相。随着算力扩张,电力从配套成核心,远景将新能源转化成稳定算力能源,交付可承载大规模算力的基础设施。
地理学的AlphaEvolve?MIT斯坦福让AI自我生长、懂地理、懂世界
MIT和斯坦福学者提出GeoEvolve,把地理知识「嵌入」AI,让其成为能自主改进算法的科研合作者。它有双循环机制和四个核心模块,输入简单,开源为Python包,改进Kriging模型效果显著。
谷歌预览Code Wiki:你能信任AI来记录你的代码库吗?
谷歌预览Code Wiki,为代码库生成并更新文档,预览版含数百开源项目文档,Gemini CLI扩展将支持内部代码库。它有聊天界面,但AI生成文档缺乏权威性,开发人员看法不一,且非真正维基。
AI 大牛刘威创业公司完成 5000 万美元融资,12 月将发布新模型
当地时间11月5日,刘威创立的Video Rebirth完成5000万美元种子轮融资,用于打造视频生成模型。公司计划12月发布Bach模型及AI视频生成平台,将与OpenAI Sora竞争,虽对手强大,但刘威认为小团队有机会。
人大高瓴-华为诺亚:大语言模型智能体记忆机制的系列研究
中国人民大学高瓴人工智能学院与华为诺亚方舟实验室聚焦大语言模型智能体记忆能力,形成含综述论文、数据集和工具包的研究体系。探讨记忆概念、重要性、实现与评测方法,还构建评测榜单、实现工具包。
刚刚,OpenAI官宣自研造芯,联手博通开发10吉瓦规模的AI加速器
今天凌晨,OpenAI宣布与博通战略合作,共同部署其设计的10吉瓦规模AI加速器,预计2026下半年起部署机架,2029年底完成。此次合作将减少其对英伟达GPU依赖,采用多元化算力策略。
AI模型守法率提升11%,港科大首次用法案构建安全benchmark
香港科技大学KnowComp实验室从法律合规视角研究LLM安全,提出「安全合规」新范式。基于法律条文构建benchmark,用GRPO微调Qwen3 - 8B得推理模型,在新benchmark测试中性能提升显著。