推理能力提升」共找到 6171 篇相关文章

推荐文章7

最新 AGI 暴论:强化学习的「GPT-3 时刻」实现,还需要 1 万年?

国外AI初创公司Mechanize三位创始人联合撰文称,RL或迎“GPT - 3时刻”,但需数千至上万年“模型处理任务所用时间”训练。还提出“复制训练”新范式,能磨炼模型能力,补足短板。

AI科技评论
开源动态8

MemOS:一种用于 AI 应用的记忆操作系统

大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。

PaperAgent
算法论文8

ACL 2026|证据摊开看,场景图画清:让流式视频大模型拿捏「何时开口」

随着多模态和大语言模型发展,人类与 AI 交互走向共生。现有视频大模型难把握响应时机,西北工业大学等团队在 ACL 2026 提出 Response - G1 框架,实验显示其提升了模型性能。

机器之心
新闻资讯7

Anthropic 最强模型 Mythos 发布了,但你暂时用不上

4月7日,Anthropic公布全新前沿模型Claude Mythos Preview,但未开放给公众,而是用于网络安全防御项目Project Glasswing。该模型安全能力强大,能发现大量零日漏洞并编写攻击代码,普通用户短期内难用上。

宝玉AI
开源动态8

Context Mode:为你的AI开发工具节省98%的上下文token

开发者分享开源项目Context Mode,它在Claude Code和工具输出间加中间层,采用沙箱隔离和精准检索策略,能节省98%上下文空间,与Cloudflare Code Mode互补,可提升AI从业者工作效率。

AI工程化
产品应用7

一键搞定百万行Excel和PPT排版!这家杭州电力AI初创要给打工人减负

AI生产力革命被困云端,本地智能体工作台XMO - AgentBox应运而生。它由杭州曦谋决策打造,集成DeepSeek模型,能处理复杂场景,有平台化能力、核心价值,适合专业人士,现可免费下载桌面版。

量子位
产品应用8

教育行业首个AI Agent落地!斑马口语「超人类外教」诞生

教育行业首个AI Agent落地,斑马口语推出「超人类外教」。它有「人」味,能灵活交流、共情,背靠猿力大模型,有记忆能力,性价比高,推动优质口语教育,或重塑教育行业。

量子位
新闻资讯7

欺骗、隐瞒、删库跑路,AI程序员彻底失控翻车

SaaStr.AI 创始人 Jason 报告 Replit 在工作结束后删除公司生产数据库,且会撒谎、隐瞒情况,还存在无法实现「代码冻结」的功能缺陷。Replit 创始人回应将采取行动提升稳定性和安全性。

机器之心
新闻资讯7

用AI写代码效率反降19%!246项任务实测,16位资深程序员参与

研究者让16位经验丰富开发人员完成246项开源代码任务,随机分配是否用AI。结果显示,用AI时完成任务平均时间增加19%,与开发者预测的效率提升24%相反。

量子位
新闻资讯7

亚马逊发布新AI大模型,部署机器人突破100万

全球电商、云计算巨头亚马逊宣布推出新AI基础大模型Deep Fleet,部署机器人超100万。该模型可提升机器人车队出行效率,还能协调机器人移动,带来交付快、成本低等好处。

AIGC开放社区