滚动讨论机制」共找到 1145 篇相关文章

算法论文8

GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到可玩水平

香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整可运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端可玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。

AI科技评论
7

DeepSeek V4还能更省!新工具缓存命中率高达99.82%,2折稳定到手

DeepSeek V4系列发布1个月,官方永久降价,开源社区的Reasonix项目将缓存命中率干到99.82%,能大幅降低成本。它专为DeepSeek打造,实现思路基于其缓存机制,安装使用简单。

量子位
算法论文8

你的AI Agent越用越蠢?港中大、浙大戳破「记忆」的谎言

香港中文大学联合浙江大学发布论文指出,当前主流的Agent记忆方案只是「备忘录」,而非真正的记忆。论文归纳出三大结构性缺陷,提出双系统共存架构,引发学术界广泛讨论

新智元
算法论文7

近期,不错的LLM Agent统一记忆框架综述~

随着GPT、Qwen、Claude等大模型能力提升,LLM-based Agent走向长期任务。论文提出统一框架拆解Agent Memory为四组件,围绕两个数据集复现比较10个方法,还设计出新的低token开销框架。

PaperAgent
新闻资讯7

Claude封号潮失控!300 万用户企业一夜断供,无理由、无回应,受害者被迫抱团反抗

Claude 出现封号潮,Belo App CTO 等众多用户被封却无解释,申诉只能填 Google 表单。用户不满累积,上线“Banned by Anthropic”网站呼吁改进封禁与申诉流程,还引发“单一厂商锁定”讨论

AI前线
算法论文8

Agent不是关键!人大AiScientist实现23小时、74轮长程记忆

中国人民大学团队打造的AiScientist,旨在解决长程机器学习研究工程的持续性难题。它通过File - as - Bus机制稳定保存项目状态,在多轮实验中表现出色,提升科研效率,推动AI真正接手科研流程。

新智元
推荐文章8

白春礼:人工智能促进科学研究范式变革

白春礼在浦江论坛探讨AI对科研范式变革的影响。他指出,当下科学研究体系面临发现机制、组织方式、知识生产方式的结构性重组,呈现新特征,同时也面临竞争、组织变革等挑战。

力学与人工智能
产品应用8

迎接智能体的「觉醒时刻」:EverOS全球公测开启Agent Memory自进化序章

随着主动执行型 Agent 爆发,AI 向自我演化智能体跃迁,但现有 Agent 有诸多痛点。EverMind 团队公测专为自我演化智能体设计的记忆底座 EverOS,它依托核心算法与进化引擎,提升任务成功率,解决多项技术难题。

机器之心
开源动态8

深度解析 OpenClaw 在 Prompt / Context / Harness 三个维度中的设计哲学与实践

文章从Prompt、Context和Harness三个维度解析OpenClaw设计思路。Prompt工程有动态组装与文件驱动特点;Context工程含可扩展技能、上下文压缩修剪及双层记忆管理;Harness工程为模型套“马具”,保障其可控运行。

阿里云开发者
产品应用7

李飞飞World Labs双模齐发,能「造」超复杂大场景,一手实测

李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。

机器之心