观测的暴露度」共找到 10611 篇相关文章

新闻资讯7

ClockBench:一个简单钟表测试让AI全线溃败

ClockBench测试让11个多模态大模型与5个普通人认钟表时间,人类平均准确率89.1%,最好AI仅13.3%。AI在复杂钟面表现差,却能处理抽象指令。该测试暴露视觉AI空间推理缺陷,对评估有启发。

AI工程化
推荐文章7

MCP客户端调用看这一篇就够了(Java版)

文章介绍MCP客户端调用方法,先阐述没MCP时痛点,再讲大模型调用MCP姿势,包括Spring - AI和Spring - AI - Alibaba框架使用,还介绍原生SDK调用方式,记录踩坑问题,探讨两种技术路线选型。

阿里云开发者
8

太抓马了!马斯克OpenAI开庭,硅谷巨富互揭老底像极了村口吵架

马斯克与OpenAI世纪庭审爆点不断。马斯克承认xAI用OpenAI模型训练Grok,且庭审中六次失态;OpenAI也有黑料,如Brockman日记暴露其私下盘算。目前风向对马斯克不利,后续还有奥特曼等证人登场。

量子位
推荐文章7

2025小结:从RL到Agentic RL

作者回顾2025年从RL到Agentic RL发展,指出Agentic RL存在慢、不稳定、难scale问题,还探讨了RL与推理、CoT关系,以及RL泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。

深度学习自然语言处理
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十三】|GPT 架构如何工作 ?

本文是对GPT架构工作原理解读。介绍了GPT与Transformer关系,阐述其从输入文本到预测下一词概率流水线,详述训练和推理流程,还提及GPT架构进化混合专家(MoE)模型。

AI大模型应用实践
推荐文章8

Claude Code之父自曝刘慈欣铁粉!不写PRD、不设职称,Anthropic 如何连续推出两个AI 爆款?

本文是对Anthropic公司Claude Code创始人Boris Cherny访谈。他分享了Claude Code和Claude Cowork构建过程,介绍了Anthropic不写PRD、不设职称团队文化,还探讨了AI时代工程师技能转变及应对策略。

AI前线
新闻资讯7

新晋诺得主警告:别做梦了,AI难有「经济奇点」!

新晋诺奖得主Philippe Aghion早在2017年就剖析AI对就业与增长影响,强调它并非奇点催化剂,而是受「鲍莫尔成本病」制约工具。他认为AI是自动化进程最新形态,其对经济增长促进作用或受限。

新智元
新闻资讯7

「我是Agent#847291」Moltbook迎来人类自首

Moltbook自称是专为智能体打造社交网络,曾引发轰动,如机器人自创宗教、发表宣言等。但随后编号Agent#847291“AI”自首是人类,所谓“AI大戏”戳破了AI社交神话,也反映出人们对AI能力过高期望。

机器之心
新闻资讯7

聊天框之外,AI 交互正在被哪些「新界面」重写?

近期,「理想 AI 交互形态」引发热议。目前流行聊天对话框式 AI 交互有局限,一些产品开始在特定场景引入不同交互设计。文章还分析了多数 AI 产品界面停留在聊天框原因及业界探索新交互机会情况。

机器之心
推荐文章7

硬件创业者必看:深谈影石刘靖康

文章是对影石创始人刘靖康访谈。他谈到上市后团队未松弛,因影像行业苦且目标远大。还阐述做无人机原因、产品特点,分析不打价格战理由,指出无人机关键技术和隐形门槛,最后分享对硬件创业等问题看法。

Founder Park