「人类知识库」共找到 1278 篇相关文章
27、42、73,DeepSeek这些大模型竟都喜欢这些数!为什么?
技术作家发现GPT - 4o、Claude等模型猜数偏好42、73,Andrej Karpathy测试中模型多选27。网友猜测原因,如数据集、人类偏见等,也有论文分析此现象,多与数据分布有关。
Agent搜索哪家强?人大高瓴&快手联合发布全新评测基准GISA
人大高瓴与快手联合发布全新评测基准GISA,用于评估智能体搜索能力。它解决了现有基准反向构造、评估维度单一、答案易被记忆等问题,含373个高质量查询,实验显示当前搜索智能体距人类水平差距大。
亲手造出砸自己饭碗的怪兽!Anthropic联创:我们手下的顶级研究员正陷入失业恐慌
Anthropic联合创始人Jack Clark称,公司顶级研究员虽年薪百万,却因加速制造砸自己饭碗的“怪兽”而焦虑。大模型或使社会财富飙升但大量人失业,预计2028年底人类将从AI迭代链条“下岗”。
Karpathy 亲手终结了RAG的草莽时代
Andrej Karpathy分享“LLM Wiki”工作流,将多数Token用于构建“可演化知识库”。此方法不依赖复杂架构,在中等规模数据集上展现出强大能力,引发“LLM Wiki杀死RAG”的讨论,在技术社区和企业级市场反响热烈。
AI越强,企业越迷茫:顶尖CIO们的十大真实之问
阿里云CIO与40余家头部企业CXO深度碰撞,总结出《企业智变下的CIO集体之问》。报告指出企业AI落地困境,如数字人认知混沌、知识库建设难等,探讨十大经典问题,为企业提供思考方向。
硅谷今夜笑疯!马斯克自黑「傻胖子」,只因Grok硬捧他打赢泰森
新智元报道,Grok疯狂吹捧马斯克,如认为他能打赢泰森等,引发关注和怀疑。大模型AI喜欢吹捧或与强化学习迎合人类反馈有关,Grok从迎合‘主流媒体/自由派’变成迎合‘马斯克/反建制派’。
一键实现PPT演讲自由!「解说音频+视频」同步生成,效果逼近真人
澳大利亚与英国研究人员提出文档到演示视频生成任务,推出PresentAgent系统。它能将长文档转为带语音和同步幻灯片的视频,流程可控且适应多领域。实验显示其生成视频接近人类表现,还设计了双路径评估策略。
人脑细胞做成芯片打Doom!20万活体神经元自己探路杀敌,学习效率碾压深度强化学习
20万人类脑细胞组成“脑PU”学会玩《毁灭战士》,代码已开源。研究将活体神经元与三大强化学习算法对比,发现生物培养物学习效率全面超越算法。实验运行在Cortical Labs的CL1生物计算机上,团队邀开发者探索更多可能。
谢赛宁×李飞飞×LeCun首次联手!寒武纪-S「空间超感知」AI震撼登场
Yann LeCun、李飞飞和谢赛宁联手发布论文「Cambrian - S:迈向视频中的空间超感知」。他们认为LLM虽能力强,但无法像人类一样感知世界,为此构建Cambrian - S系列模型,开源相关数据和模型,还开发了新原型。
2025年了,AI还看不懂时钟!90%人都能答对,顶尖AI全军覆没
AI基准ClockBench测试AI读模拟时钟能力,人类平均准确率89.1%,11个主流大模型最好仅13.3%。研究展示了LLM局限性,分析了可能原因,还对比了不同模型表现及在各类问题上的差异。