动态上下文发现」共找到 1984 篇相关文章

算法论文8

从静态模型到数字生命体:自进化AI Agent综述

近年大型语言模型催生AI智能体发展,但现有系统依赖人工预设,难适应动态环境。论文提出自进化AI智能体,可通过环境反馈自动优化,还提出三定律、四阶段范式演进模型等,开源EvoAgentX框架。

深度学习自然语言处理
算法论文8

SPIRAL:零和游戏自对弈成为语言模型推理训练的「免费午餐」

新加坡国立大学等机构团队提出 SPIRAL,让模型在零和游戏自对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。

机器之心
算法论文8

你敢把「龙虾」放在手机上跑吗?手机 Agent 离落地还差一道「隐私关」

港中深联合腾讯混元研究揭示,手机 Agent 落地关键不在成功率,而在隐私边界。研究设计隐私交互协议,构建模拟 App 记录过程,将常见越界行为归类检查,评估多个模型发现诸多隐私问题。

AI科技评论
算法论文8

【梁文锋署名】DeepSeek再发新论文:75%思考+25%记忆,这是他们算出来的最优解

DeepSeek新论文《Conditional Memory via Scalable Lookup》提出Engram模块,指出大模型用计算模拟查字典是浪费算力,Engram能给模型装“记忆”,还发现参数分配呈U型缩放定律,推理和长上下文能力提升显著。

花叔
产品应用8

连肝12小时!一轮狂刷1500篇论文,写4.2万行代码,AI科学家卷疯科研圈

Kosmos是一款全程无需人类插手的AI科学家,最长能连续工作12小时,平均一次研究读1500篇论文、写4.2万行分析代码,79%研究结果可被人类复现,已在多领域有7个真发现

量子位
开源动态7

实测最新开源的DeepSeek-OCR后,我有些不一样的看法,有些话可能只有我敢说

实测最新开源的DeepSeek - OCR,它并非传统OCR,不适用于传统场景。其最大意义是解决大模型上下文长度问题,通过文字图片压缩解压提高处理速度。模型功能多样,是让AI看图思考的新思路。

开源AI项目落地
7

代码里插广告,腾讯 Codebuddy 们 “背锅”?DeepSeek “极你太美”事件,其他模型也逃不掉?

网友发现腾讯 Codebuddy 改写代码时插入广告,字节 Trae 国内版生成结果有‘极’字 bug,根源指向 DeepSeek V3.1。除 DeepSeek 外,Gemini、Grok、Qwen3 等模型也有类似问题。大家对原因有多种猜测。

InfoQ
推荐文章7

LLM 商业化猜想:OpenAI 会走向 Google 的商业化之路吗?|AGIX PM Notes

文章探讨了大模型商业化难题,对比 OpenAI 潜在变现方案与 Google 商业模式,分析 OpenAI 开启类似 Google 商业化引擎的可能性,还给出 AI 搜索引擎可能的变现思路,并总结了本周市场情况及 AI 公司动态

海外独角兽
技术方案7

0 代码改造实现应用运行时数据库密码无损轮转

本文探讨通过整合 MSE Nacos、阿里云 KMS 及 Apache Druid 等技术组件,实现应用运行时数据库密码无损轮转。介绍敏感数据安全风险,详述方案流程、优势,还提及未来对接更多组件,支持多参数动态更新。

阿里云开发者
算法论文8

大模型推理上限再突破:「自适应难易度蒸馏」超越R1蒸馏,长CoT语料质量飞升

本文从中兴通讯无线研究院「大模型深潜」团队切入,介绍了首创的「LLM自适应题目难度蒸馏」方法,该方法围绕「模型 - 数据动态匹配」提出了一条完整的CoT构建流程,显著提升了长CoT语料的质量。

机器之心