「人类技能」共找到 1472 篇相关文章
AI海啸将至,全人类还没准备好!Anthropic CEO警告
Anthropic CEO Dario Amodei从百度时就隐约发现Scaling Law,推动OpenAI接受。他不满OpenAI发展方向,离开创立Anthropic。他认为智能爆炸后影响巨大,要做对AI,还警告人类要重视AI风险。
Claude code让程序员消失,Anthropic却说用AI编程会让你变傻
Anthropic科学家实验发现,新手过度依赖AI编程,概念理解、代码阅读和调试能力显著退化,效率未提升。研究识别六种AI使用模式,指出主动思考才是技能形成途径,应保留人脑训练的“摩擦力”。
字节发布全球首个预测未来基准FutureX,Grok-4 拿下冠军
字节跳动发布全球首个实时未来预测基准测试FutureX,杜绝模型作弊。在25个模型评测中,Grok - 4夺冠。它从多网站构建问题,分四级难度。人类专家在部分等级仍领先AI 。
写代码从来不是瓶颈
Pedro Tavares认为软件开发瓶颈并非写代码,而是代码审查、知识传递等“人类开销”。LLM让写代码变容易,但理解、测试代码成本更高,未解决根本问题,团队理解代码成本才是瓶颈。
提示词工程、RAG之后,LangChain:上下文工程开始火了!
AI时代,上下文工程正兴起。它是构建动态系统,为LLM提供合适信息和工具以完成任务。随着应用复杂度增加,提供完整结构化上下文比提示词更重要,正成AI工程师重要技能。
复杂空间推理新SOTA,性能提升55%!中山大学新作SpatialDreamer
中山大学等机构推出SpatialDreamer,模拟人类空间认知过程,构建闭环推理流程,还提出GeoPO解决奖励稀疏问题,构建SpatialDreamer - SFT数据集。实验显示其在多基准达SOTA,为AI空间智能发展开辟新路径。
OpenAI 万字报告: 不要再卷Agent了~
OpenAI《How People Use ChatGPT》报告显示,73%的ChatGPT用途与工作无关,用户多将其用于实用建议、信息查询和写作。Asking对话占比及满意度更高,机会藏在人类惰性里。
复旦等推出「第一人称视听基准」,补齐多模态模型「听觉拼图」
多模态大模型在真实世界会“失聪”,现有第一人称视频问答/理解基准长期偏“视觉中心”。复旦等团队推出首个系统评测第一人称声音理解能力的基准EgoSound,能让模型听懂世界,评测显示当前模型与人类差距大。
让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方
上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。
立省499!我给你们找到了最傻瓜的OpenClaw安装方式。
作者应读者需求,寻找简单的OpenClaw安装方式,发现智谱的AutoClaw。它本地部署,支持Mac和Win,配置简单,还优化技能、显示用量,支持多模型API,能建分身,让普通人感受Agent魅力。