「弱到强监督」共找到 2286 篇相关文章
刚刚,ARC-AGI-3发布!人类100分,最强AI零分
ARC Prize发布ARC - AGI - 3预览版,测试范式从静态谜题到交互式游戏。新引入交互式推理基准测试,人类轻松通关,最强AI却全军覆没。但测试引发社区质疑,奖金设置也遭吐槽,且存在体验和技术问题。
投奔小扎,Jason Wei连发两篇博文公布“屠龙术”:一个公式看透AI,一条心法指引人生
OpenAI研究科学家Jason Wei被小扎挖走后连发两篇文章。一篇提出“验证者定律”,指出训练AI解决任务难易与可验证性成正比;另一篇从强化学习悟到人生要走On - Policy路线,发挥自身优势。
性能暴涨50%!谷歌、微软、OPPO 联手开源Agent “经验炼金术”
谷歌DeepMind、微软研究院、OPPO等机构开源`AGENT KB`项目,提出并实现“AI经验库”概念。它有“师徒模式”工作流,设计了从“原始日志”到“结构化经验”的构建流程,应用时分层调用知识,能让Agent性能飙升。
人类下一个奇点,超级智能时代
OpenAI联合创始人Sam Altman在博客《温和的奇点》中表示,人类已越过技术转折点,迈向数字超级智能时代。他预测2025 - 2027年将有系列智能成果出现,到2030年代智力和能源将丰富,虽有挑战但前景乐观。
智能PPT生成系统
MultiAgentPPT是基于A2A + MCP + ADK的多智能体系统,能流式并发生成高质量PPT。它通过多智能体协作,从大纲生成到内容汇总,提高效率与准确性,还介绍了使用界面、项目结构、快速开始步骤等。
AI 的宿命数字
AI在1到50间随机选数时,常选27,还编造推理过程,会根据时间调整算法保证结果为27,也有选42等情况。这或源于人类文化偏见,AI是人类集体记忆镜子,难摆脱宿命。
红杉专访 OpenAI Codex 团队:AI Coding 的未来,应该是异步自主 Agent
红杉专访 OpenAI Codex 团队,探讨 AI Coding 未来。OpenAI 5 月推出的 Codex Agent 可并行处理多任务、独立完成编程全流程。从代码补全到任务委托,AI 编程朝解放生产力方向发展,团队分享了产品思考等内容。
诺基亚坟墓里,埋着半套战胜美国的密码本
文章回顾诺基亚兴衰史,从濒临破产到成为全球手机霸主,后被苹果等超越。其崛起得益于市场机制、人才红利等;失败因利益分配失衡致盟友倒戈。这对中美科技竞争有启示,重塑利益格局很关键。
AI 领域新动向!持续思考模型CTM横空出世:AI 向生物智能迈出重要一步
Sakana AI 推出新型 AI 模型 CTM,重新引入「时间」和「神经元动态」到 AI 计算核心。它有诸多创新,在迷宫探索、图像识别等任务表现出色,虽有训练慢等不足,但为 AI 向生物智能迈进提供新思路。
协和4+4的另一面:浙江范式用AI定义医疗未来!AI「智愈」时代来临
一场关于协和“4+4”的热议引发医疗未来之问,浙江从医院、企业、政府三重维度,以浙大二院、德适生物、安诊儿等为例,展示AI在医疗领域的应用,构建未来医疗图景,推动医疗从“治病”走向“智愈”。