持续自我提升式 AI」共找到 11434 篇相关文章

8

挺意外的,Agent长期记忆潜力被AMemGym挖出来了

论文提出交互式在线策略评测框架AMemGym,它能反映AI助手长期记忆能力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。

PaperAgent
新闻资讯8

52个人用AI做PPT,年赚7个亿

在2025年,硅谷AI公司多“烧钱换增长”,Gamma却靠一款AI PPT工具,52人年入上亿美元,估值达21亿美元。它曾遇困境,后借AI逆袭,还分享独特运营哲学。

量子位
产品应用7

万万没想到,大学生都开始拿AI来养猪了

夸克在中国人民大学分享会曝光大学生使用情况,每10个大学生中有7人用夸克,AI渗透率达80%。学生不仅用其学习,还用于生活。不过夸克高考曾出现信息错漏,后已修正。

量子位
开源动态7

Karpathy用「harness」彻底终结了RAG。

假期时Karpathy提出llm.wiki想法引发关注。它是元框架,定义人类与AI协作管理知识的方式。与RAG不同,它将新材料关键信息编入已有wiki并持续维护。作者用多种数据测试,发现TextIn API解析效果好,还优化处理流程提升质量。

探索AGI
算法论文8

大语言模型离“数学证明高手”还有多远?斯坦福、伯克利、MIT 团队提出 IneqMath 评测标准

现在很多大语言模型常给出看似正确的结论,但推理过程却有问题。斯坦福、伯克利和MIT团队提出新思路,构建IneqMath数据集及‘AI数学裁判系统’,研究发现很多模型推理不严谨,还给出两个提升准确率的办法。

AI前线
产品应用8

文心新出的推理大模型,给了我们信心

在 WAVE SUMMIT 2025 大会上,百度发布文心大模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。

机器之心
推荐文章8

让AI变成Super员工的秘密:高效训练Skills

文章复盘打造 web - testing Skill 的 4 个翻车教训,分享工程化训练心法。指出训练 Skill 能让 AI 在业务里更可靠,将通用模型变成懂业务、会自检、能稳定交付的员工,还给出训练方法。

腾讯技术工程
推荐文章8

Databricks × Snowflake 纷纷下注,PostgreSQL 成 AI 时代数据库标准?

文章结合作者对数据基础设施的实践与反思,探讨生成式AI时代数据系统的挑战与机遇。介绍数据基础设施新趋势,分析Neon、Supabase等公司受关注原因,指出PostgreSQL成行业标准,还提出Data Warebase概念及优势和应用场景。

InfoQ
推荐文章7

ADHD,反而成了 AI 时代的版本答案?!

文章探讨ADHD在AI时代的意义。ADHD大脑多巴胺调节回路有差异,过去被视为问题的特质如今成优势,如发散创造力、短时聚焦和混乱适应力。AI为ADHD带来新体验,让其更适合开荒。还分享在AI时代做ADHD的经验。

特工宇宙
开源动态8

Hugging Face 推出九大 AI 课程,免费、全面【收藏】

Hugging Face悄悄上线一批免费AI课程,还带认证证书。课程从大语言模型到扩散模型,从计算机视觉到游戏AI,覆盖面广。完成课程可拿证书,还能在平台分享成果,是学习AI的好机会。

AGI Hunt