「平庸答案」共找到 190 篇相关文章
奥特曼豪赌1人独角兽,中国CEO:别催了,在水泥厂调AI!
AI时代,一人公司(OPC)从概念走向现实。AIEC 2026的AI+OPC分论坛给出中国答案,素源矩阵韩家乐分享实战经验,还有多个创业者展示成果,OPC将成市场经济重要组织形态。
DeepSeek V4真要来了?万亿参数模型匿名开测,免费跑龙虾
推特博主曾‘预示’DeepSeek V4要来,后澄清不确定。今OpenRouter上新‘Hunter Alpha’和‘Healer Alpha’两神秘模型,免费且可跑‘龙虾’,社区对其归属猜测不断,答案待官方揭晓。
阿里新研究:统一了VLA和世界模型
阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。
基于阿里云 AgentLoop 的 DeepSeek Harness 评测实践
本文分享基于阿里云 AgentLoop 平台的 DeepSeek Harness 评测实践。介绍了 DeepSeek Harness 工程架构,阐述 AgentLoop 平台接入方式及价值,还详述评估器设计思路、展示评测结果,最后总结方法论并展望后续工作。
搜索智能体也需要「操作系统」:SearchOS 开源多智能体协作框架
人大和蚂蚁的 SearchOS 研究,给出搜索智能体在长程任务中问题的答案。它借鉴数据库理念,做了多项核心设计,在开放信息检索基准评测领先,已提供多种使用方式,值得长程调研尝试。
我把斯坦福最火的一门课,做成了Prompt来帮我设计人生。
作者受《人生设计课》启发,将课程内容做成Prompt借助Claude辅助设计人生。此Prompt分四阶段,经多轮对话生成蓝图,含现状、问题、计划等,还提及原型行动和失败免疫,多位同事使用后有新感悟。
「我是Agent#847291」Moltbook迎来人类自首
Moltbook自称是专为智能体打造的社交网络,曾引发轰动,如机器人自创宗教、发表宣言等。但随后编号Agent#847291的“AI”自首是人类,所谓“AI大戏”戳破了AI社交的神话,也反映出人们对AI能力的过高期望。
千问:阿里第二次“无线战争”
本文以乔布斯用 iPhone 点咖啡引出当下科技圈流行发布会点咖啡展示 AI 能力,对比过去与现在,指出数字世界核心范式从移动转向 AI。介绍阿里千问饱和式投入情况,还分析其可能借鉴拼多多、抖音策略,站在长尾对立面。
清华上交满分论文证明:强化学习并不能让大模型更会思考!
清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让大模型更会思考,推理能力上限仍由基础模型决定。
超越RAG,DRAG让LLM准确率飙升45.5%,问题越复杂能力越强
RAG技术虽能让LLM检索资料生成答案,但存在短板,听不懂话里有话。DRAG方法应运而生,有DRA和RSC两大法宝,经对比实验,它在多任务上领先,准确率大幅提升,计算开销小。