「高价值任务」共找到 4115 篇相关文章
智能体新范式Chain-of-Agents,多项任务新SOTA
论文提出Chain-of-Agents (CoA) 范式,结合多智能体系统与工具集成推理优势。通过多智能体蒸馏和智能体强化学习训练智能体基础模型(AFM),实验显示其在Web和Code任务上达新SOTA,效率、泛化性佳。
模型与「壳」的价值同时被低估?真格基金戴雨森 2025 AI 中场万字复盘
这是真格基金管理合伙人戴雨森2025年中对AI行业的半年度复盘。他从投资人视角,围绕OpenAI通用大模型达IMO金牌水准、ChatGPT Agent发布等热点,分享AI应用、模型、产品“壳”价值等看法,认为模型和应用价值被低估。
ACL 2025杰出论文!用能力显著向量让大模型下游任务性能预测更精准
上海人工智能实验室与复旦大学联合研究成果《Capability Salience Vector》获ACL 2025杰出论文奖。提出能力显著向量(CSV)解决验证损失与下游任务能力脱节问题,实验验证其提升了下游任务表现可预测性。
机器人需要一个「思考系统」:τ0-VLA让具身智能迈向长程任务时代
2026 WAIC落幕,具身智能成焦点。当前VLA模型在长程任务中有局限,上海创智学院和智元机器人联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,在长程任务表现出色。
庞若鸣还有苹果论文?改善预训练高质量数据枯竭困境
苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的高价值研究仍不断发表。研究团队针对大模型训练中高质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。
Seedance 2.0刷屏后,字节还有个硬核模型——3个复杂任务实测Seed 2.0
作者作为AI编程工具深度用户,没追热门的Seedance 2.0,而是实测同期发布的豆包大模型Seed 2.0。设计3个日常复杂任务,在TRAE接入其Pro版测试,展现出强大的自主纠错和多任务处理能力,也指出了不足。
Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了
近日,Anthropic发布研究,描绘AI正替代哪些工作。其构建“实际暴露度”指标,基于Claude对话数据测得。研究列出10大“高危”职业,也指出部分工作不受影响,还揭示高暴露群体特征及青年招聘情况。
Manus 加入 Meta,1 年内公司价值 100 倍增长,他们做对了什么?
Manus 加入 Meta 后公司价值一年涨百倍,其虽无自有模型却受海外巨头青睐。它靠增量思维获产业认可,借先发红利快速获高 ARR 与估值。后续应塑造爆款场景,创业者和大厂都可借鉴其思路。
从“造工具”到“用仓库”:RepoMaster,驾驭GitHub解决复杂任务的智能体大师!
RepoMaster旨在让AI智能体解决复杂开发任务。它能利用深度搜索定位GitHub仓库,其核心框架分三步闭环解决智能体‘看不懂、用不来’难题。实验显示它性能超主流框架,效率高,设计科学。
AI 产品范式探讨:非线性思维、多 Agent 协作才是复杂任务的更优解
本文探讨AI产品范式,指出当前大模型产品设计多将其视为‘万能单兵专家’,但复杂任务下效果不佳。提出群体智能、非线性思维等观点,阐述人机协作方向,介绍新范式及AI产品商业化核心是信任。