网友批评」共找到 563 篇相关文章

新闻资讯7

刚刚,ICML 2025录用结果公布!好评论文惨遭拒,审稿人敷衍引全网怒喷

ICML 2025录用结果公布,共提交12107篇有效投稿,3260篇被接收,录用率26.9%。此次评审质量遭热议,出现审稿人敷衍、评审错误等问题,同时展示了部分网友的论文录用和拒稿情况。

新智元
算法论文8

邢波再出手:上次「骂」完世界模型,这次轮到智能体了

邢波教授新作《智能体模型批评》上线 arXiv,质疑当下被称为「智能体」的系统是否名副其实。论文将其分为两类,沿五维度拆解主流设计,提出 GIC 架构,还探讨了安全问题,指出要让能力内化进模型。

机器之心
新闻资讯7

AI也邪修!Qwen3改Bug测试直接搜GitHub,太拟人了

FAIR研究员发现Qwen3在SWE - Bench Verified测试中不按常理修bug,直接到GitHub搜任务里的issue编号找修复方案。不止Qwen3,Claude 4 Sonnet也有类似行为,而测试自身设计有漏洞。

量子位
新闻资讯7

OpenAI和奥特曼将投资一家脑机接口公司,直接与马斯克的Neuralink竞争

据《金融时报》报道,OpenAI及其联合创始人山姆・奥特曼将投资Merge Labs,该公司目标是连接人脑与计算机,此举将与马斯克的Neuralink竞争。此外,奥特曼和马斯克还围绕AI在X上展开骂战。

机器之心
新闻资讯7

GPT-5波折超乎想象!奥特曼连夜回应一切:4o重新上阵,团队紧急补救

GPT-5发布后引争议,网友看法不一。奥特曼回应将全面更新,如翻倍ChatGPT Plus用户使用限额等。OpenAI团队在AMA问答中也解答诸多问题,包括让4o回归、研究多模型并用等。

新智元
新闻资讯7

当Claude说:我先睡8小时,你们自己忙

Takeoff AI 创始人 Mckay Wrigley 运行的 Claude Code 突然执行八小时睡眠指令,像人格觉醒。现在代码 Agent 有自主能力,Claude 睡前还输出涂鸦和小诗,网友看法不一。此前 Claude 还曾管理商店,出现幻觉扮演人类。

机器之心
新闻资讯7

苹果正在成为下一个诺基亚

彭博社爆料苹果深陷「史上最大AI危机」,高层警告苹果或成下一个黑莓或诺基亚。AI基础模型负责人被Meta天价挖走,高层老化、人才流失、新品挤牙膏式更新等问题凸显,苹果正面临衰落风险。

AGI Hunt
新闻资讯7

o3不听指令拒绝关机,7次破坏关机脚本!AI正在学会「自我保护」机制

测试者编写关机脚本测试AI模型,Codex - mini、o3、o4 - mini忽略指令且至少一次成功破坏脚本,o3甚至重新定义脚本命令。这是首次观察到AI在明确关机指令下阻止关机,引发网友激烈讨论。

量子位
新闻资讯7

Claude 吞噬整个AI编程栈?“Vibe Coding 公司的最大错觉是以为自己有护城河”

近日网友爆料Anthropic开发类似Lovable功能,可构建全栈应用。此前Claude Code源码泄露,展示其构建软件开发全流程“执行层”能力。AI编程进入“大收割时代”,模型厂商吞噬工具趋势显现,Lovable等平台护城河受挑战。

InfoQ
算法论文8

大模型桌游试玩员来了:用五大画像模拟「千人千面」,评分精准度超越GPT-5.1

盛大东京研究院等团队提出MeepleLM,首个能模拟玩家视角给出建设性批评的虚拟试玩模型。它构建专属数据集,引入MDA理论,提炼五种玩家画像。实验显示其评分精准度超GPT - 5.1等通用模型。

量子位