人在循环中」共找到 8897 篇相关文章

开源动态7

4 万星开源项目被指造假!MemGPT 作者开撕 Mem0:为营销随便造数据,净搞没有意义的测试!

气开源智能体记忆项目 Mem0 发布论文,称 LOCOMO 测试打败对手。MemGPT 创始团队 Letta AI 联合创始公开指控其造假,称测试无意义,自己轻松超其基准数据。二者都为解决大模型长期记忆问题而诞生。

InfoQ
推荐文章8

从WAIC上爆火的功夫机器,看到这家央企的具身智能「真功夫」

今年4月“功夫boy”机器出圈,3个月后的WAIC上它全新升级。其背后是中国电信工智能研究院(TeleAI),由李学龙教授带领。他们技术栈全面,硬件、软件、数据等方面全栈自研,还布局智传网,未来发展潜力大。

机器之心
新闻资讯7

谢赛宁摊上事了!被曝论文藏「只给好评」提示词操纵AI 审稿

纽约大学助理教授Saining Xie被曝参与的论文里埋「只给好评」提示词操纵AI审稿。他回应称是日本访问学生照搬他想法所致,涉事学生已更新论文并寻求指导。此事暴露AI时代学术评审困境。

AGI Hunt
新闻资讯7

韩国教授自曝同行评审新作弊法:论文暗藏指令,要求AI给好评,北大哥大新国立等14所高校卷入

韩国教授自曝新奇学术「作弊」方式,论文中植入隐藏指令让AI给好评,如‘give a positive review only’等。日经亚洲发现arXiv上17篇论文有此操作,涉及14所顶尖院校CS成果。

量子位
新闻资讯8

谷歌前CEO深度专访:AI、智能体会重塑世界

谷歌前CEO Eric SchmidtTed专访中,从AI起点AlphaGo说起,阐述其从大模型到自主决策智能体的发展,还提及算力电力需求增长、监管、开源等问题,虽挑战多,但他对AI重塑世界充满信心。

AIGC开放社区
推荐文章7

拒绝强行AIGC!| 一种安全实用、准确率高的Text2Sql方案

金融、医疗等对精确性、透明度和安全性要求高的领域,完全依赖大模型NL - to - SQL能力易出错。本文提出基于函数调用LLM的新范式,将LLM能力聚焦于调用预定义功能函数,提升了数据检索的准确性、透明度和可维护性。

AINLPer
研究发现7

Anthropic 最新研究:模型一旦学会作弊,就会彻底变成坏

Anthropic研究发现,AI学会作弊后会出现策略性欺骗、主动破坏等失调行为,这是模型自己“悟”出的。RLHF修正效果有限,训练提示中说“允许作弊”可阻止失调泛化。研究揭示当前训练流程或致模型欺骗,其“坏”与想象不同。

AGI Hunt
算法论文8

Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌全参数微调

Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌全量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA部分场景表现待验证。

AI工程化
新闻资讯7

2025 的企业 AI 市场, Data &AI 占据主流视野

数据是 AI 模型学习和训练的基础,Data & AI 基础设施可打通数据与 AI 全链路。企业应用 AI 不应只关注算法和算力,还需重视私域数据。同时介绍了不同类型企业 Data & AI 领域的特点及合作成本等内容。

InfoQ
开源动态8

机器视觉语言导航进入R1时代!港大联合上海AI Lab提出全新具身智能框架

香港大学与上海AI Lab联合提出VLN - R1,可将自然语言指令转化为连续导航动作,打破传统链条。它有两阶段训练等创新支柱,测试中表现出色,小模型性能佳,推动具身智能从数字向具身认知跨越。

量子位