反思型智能体框架」共找到 4654 篇相关文章

开源动态8

Soul APP开源了一款高保真播客生成框架,90 分钟对话零崩盘!

Soul APP背后的Soul AI Lab发布开源项目SoulX - Podcast,是高保真推理框架,能生成90分钟以上连贯对话,有多方言切换等功能,或重塑语音内容产业生产方式。

开源星探
开源动态8

LLM长文本内卷,谁是真英雄?告别跑分玄学,我们需要一把“公道秤”

OpenNLG Group做了统一长上下文评估框架LOOM - Scope,兼容主流benchmark、model和长上下文加速方法。该框架围绕BENCHMARK、DEPLOYMENT和EVALUATOR三大核心模块,还提出LOOM - Bench应对评估成本制约。

深度学习自然语言处理
推荐文章7

超轻量级Multi-agent,可独立用于生产,也可扩展LangChain、CrewAI、Agno

越来越多AI玩家加入Multi - agent领域,现有框架复杂冗长。本次分享可用于生产的超轻量级Multi - agent Water,它不依赖任何框架,还能扩展LangChain等,文中介绍其核心组成与上手教程。

CourseAI
产品应用8

ChatGPT长了手脚,AI不再是副驾,直接抢过方向盘

OpenAI昨夜发布ChatGPT智能体,它整合网站交互、信息整合、对话交互三项能力,能智能选最优路径完成任务。在多项评估中表现领先,还有多重安全措施。今日向部分用户开放。

AI工程化
新闻资讯7

Meta大手笔收购Moltbook:小札掌控150万AI 智能体,OpenClaw生态颤抖

2026年3月10日,Meta宣布收购Moltbook,这个有150万AI智能体的社区。Meta看重其身份认证与互联架构,想借此补齐“代理人社会”拼图。但收购引发数据垄断担忧和人才出走问题。

鲸选AI
开源动态8

比Gemini 3记得更多,谷歌新框架将上下文记忆干到了200万!

Google在NeurlPS2025大会推出结合RNN与Transformer的全新架构Titans,能扩展到超200万个token上下文。背后涉及Titans和MIRAS两篇论文,共同推进测试时记忆概念,实验显示新架构性能出色。

PaperAgent
算法论文8

拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?

现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。

机器之心
新闻资讯8

刚刚,DeepMind通用科学智能体AlphaEvolve突破数学极限,陶哲轩合作参与

DeepMind发布革命性进化编码智能体AlphaEvolve,由LLMs驱动,可演化代码库、发现和优化算法。它结合LLM创造力与自动化评估,减少幻觉,在多领域应用前景大,还与陶哲轩合作探索数学应用。

机器之心
开源动态8

12小时登顶OpenAI MLE-bench!上海AI Lab开源算法进化框架MLEvolve

上海AI实验室开源算法进化框架MLEvolve,12小时登顶OpenAI MLE - bench榜单第一。它是自进化机器学习系统,在75道Kaggle竞赛题上奖牌率达61.33%,为AI自主算法设计提供新方案。

量子位
开源动态8

空间智能终极挑战MMSI-Video-Bench来了,顶级大模型全军覆没

上海人工智能实验室 InternRobotics 团队推出空间智能视频基准 MMSI-Video-Bench,对主流多模态大模型进行评测。该基准题型全面、问题具挑战性,视频数据多样,能针对性测评。结果显示模型与人类差距显著,明确了能力瓶颈。

机器之心