「记忆增强型大语言模型」共找到 1920 篇相关文章
ICCV 2025 | 跨越视觉与语言边界,打开人机交互感知的新篇章:北大团队提出INP-CC模型重塑开放词汇HOI检测
北大团队提出 INP - CC 模型重塑开放词汇 HOI 检测。它提出交互感知提示生成和概念校准两项创新,结合输入图片特性构造提示集合,引入‘困难负样本采样’策略,在两大数据集上表现超 SOTA。
DMLR 2026 | RPI Shaowu Pan(潘韶武)团队 Nithin Somasekharan等:CFDLLMBench——首个面向计算流体力学的大语言模型综合基准评测
文章介绍针对CFD领域的综合LLM评测基准CFDLLMBench,构建三层递进挑战体系。实验揭示主流LLM在‘知道’与‘做到’间有差距,多智能体框架可提升成功率,代码与数据集已开源。
抵制AI,CEO炒掉了80%的员工!老板亲自面试新人,自曝工程师可不懂语言但4天就能交付产品
老牌企业软件巨头 IgniteTech 公司 CEO Eric Vaughan 在 2023 年全力推动公司向 AI first 转型,解雇 80% 员工。转型虽艰难,但成果非凡,各部门流程改进成效提升 300%,还推出两项 AI 解决方案。
Qwen 3-235B Aider编程能力击败Claude3.7,成本便宜百倍
Qwen3-235B-A22B在Aider多语言编码基准初步测试中击败Sonnet 3.7 Thinking和OpenAI o1,成本便宜150到600倍。Qwen3-32B准确率超GPT-4.5和GPT-4o ,代码编辑格式正确率达100%。
姚班传奇陈立杰入职OpenAI!16岁保送清华,30岁拿下UC伯克利助理教授
最新消息称姚班大神陈立杰加盟OpenAI负责数学推理。他16岁保送清华,30岁成UC伯克利助理教授,长期从事理论计算机科学研究,近期聚焦扩散语言模型。
LLM不是所有!这几个模型你需要知道!
AI时代不止大语言模型,复合AI系统成共识。掌握各类模型特点对构建高质量AI应用关键,文章介绍了LLM、LCM、LAM等多种模型。
我去,真有这种,Openclaw 增强工具,ClawRouter 让 AI Agent 自己选模型、自己付钱,还能把 LLM 成本打下来 90%,爽~~
ClawRouter是开源本地LLM Router / Proxy,支持55+模型,能让AI Agent自动选模型、付费,将LLM成本降90%。它解决路由、支付等问题,适合做AI Agent、编程工具等产品的开发者。
智商276的世界第一持有者,正式向马斯克申请加入Neuralink!
韩国人YoungHoon Kim自称智商276,公开向马斯克发加入Neuralink的“求职信”,介绍其开发的认知增强软件及商业模式,网友反应不一,同时文章探讨了其智商数值的可信度。
Helidon 引入 Agent 能力,Java 框架开始内建 AI 编排
Oracle 发布 Helidon 4.4.0 版本,对齐 OpenJDK 发布节奏,纳入 Java Verified Portfolio。引入新核心能力、Helidon JSON 库,还增强与 LangChain4j 集成,支持智能体编排。
当AI开始过度思考「hey」这个字…
两张对话截图展现语言模型缺陷,用户发简单问候,模型过度分析,从问候语正式程度到表情符号语义权重,这种过度分析让对话不自然,错过人类交流重点。