大模型技术」共找到 10426 篇相关文章

开源动态7

Mem0,用LLM给智能体解决记忆问题,开源

模型训练后知识和记忆不再增加,智能体记忆能力发展不理想。国外Mem0针对AI记忆技术发表论文并开源,提出Mem0和Mem0g两种方案,在不同场景表现出色,已获多应用,还提供SaaS服务。

AI与安全
新闻资讯7

对话蚂蚁 AWorld 庄晨熠:Workflow 不是“伪智能体”,而是 Agent 的里程碑

文章围绕AI Agent展开,蚂蚁集团AWorld算法负责人庄晨熠认为,当前AI陷入‘应试狂热’,Workflow是智能体发展的里程碑,群体智能与模型相辅相成,还分享了智能体应用实例及对未来的规划。

AI科技大本营
开源动态8

Meta最新REFRAG框架引爆RAG圈!KV缓存暴降90%,速度狂飙30×

Meta推出REFRAG框架解决RAG难题。它能在不修改解码器参数下压缩上下文、复用文档向量等。实验显示,它降低KV缓存、加速TTFT,在多任务表现佳,为模型与知识库结合提供新范式。

CourseAI
新闻资讯7

为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体

LinkedIn推出认知记忆智能体(CMA),作为生成式AI技术栈一部分,解决语言模型缺乏状态记忆问题。CMA有三层记忆,集成多种机制,在多智能体系统中作用关键,还将人工校验融入招聘应用。

InfoQ
推荐文章8

骂谷歌干蠢事、炮轰甲骨文、AI在真实数据库测试得分为0!83岁图灵奖数据库教父的硅谷“狂人日记”

本文是对图灵奖得主、Postgres 奠基者 Mike Stonebraker 的访谈。他直言模型 Text - to - SQL 在真实数据库测试得分低,批评谷歌、甲骨文等公司做法,还探讨数据库未来,如 Agent 读写与数据库结合、DBOS 技术等。

AI科技大本营
算法论文8

唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力

语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。

机器之心
新闻资讯7

凭借 27 万小时真机数据,Generalist 可能是最接近“GPT-1 时刻”的顶级机器人团队

Generalist是机器人领域有潜力的公司,凭借27万小时真机数据或达GPT - 1量级,领先6 - 12个月。团队成员来自顶尖机构,技术强,demo展示出模型灵巧性。不过也面临Scaling Law不确定、数据缺口、商业化场景缺失等风险。

海外独角兽
算法论文8

想知道你的LLM API被过度收费了吗?隐藏的Tokens终于可以被审计了

马里兰学CASE Lab团队研究商业不透明模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制性且审计开销低,为构建信任提供技术支撑。

机器之心
推荐文章7

百度AI+ DeepSeek 豆包等GEO怎么做出排名?5个技巧,附快排与白帽操作区别

文章介绍GEO优化在AI模型2 - 3天出排名的5个技巧,包括官网SEO梳理、词库挖掘整理、内容数据投喂、市场竞对分析和技术策略微调,还对比快排与白帽GEO服务商,强调合规操作。

白杨SEO优化教程
开源动态8

快手在 AI 上,渐入佳境

文章介绍快手多模态模型 Keye-VL 1.5,参数 8B 适合中小企业。它侧重短视频场景,视频理解能力强,能与业务结合,提升推荐等场景效率。还详述其架构、预训练、后训练及训练架构优化等技术细节。

MacTalk