任务冲突」共找到 2037 篇相关文章

算法论文8

同时监督和强化的单阶段大模型微调,告别“先背书再刷题”,推理泛化双提升|中科院&美团等

中国科学院自动化研究所联合美团提出单阶段监督 - 强化微调方法 SRFT,结合监督微调与强化微调,解决传统两阶段方法的不足,在多任务中提升推理和泛化能力。

量子位
产品应用7

Sora 为什么输给 Codex?

本文探讨Sora输给Codex的原因。奥特曼称因Sora太吃compute,Codex优先级更高。Sora算力连续独占,成本难摊薄;Codex算力碎片可复用,能交错服务多任务,资源回报曲线更好。

AI科技评论
产品应用8

Claude Managed Agents 公测发布!Agent 开发成本直降 500 倍

Claude 宣布 Managed Agents 进入公测,可大幅降低 Agent 开发成本。它能自动生成配置和代码,接管多项任务,实现长时间自主运行。多家早期客户使用后效果显著,还介绍了定价、接入方式及与自建的差异。

AGI Hunt
推荐文章8

Agent失忆怎么办,Anthropic教你做好工作交接

文章指出AI Agent跨上下文窗口执行长任务时易失败,Anthropic用Opus 4.5实验发现,问题根源是交接差。解决办法是让Agent像人类工程师一样留文档、进度和测试,拆分流程,严格规范,提升测试覆盖率。

CourseAI
新闻资讯7

刚封杀就反杀!Claude逆天1400亿暴击OpenAI,250万人抛弃ChatGPT

Anthropic一路狂飙,全美市场份额飙至70%,年化收入近200亿美金。Claude表现强大,Claude Code爆火,众多巨头排队付费。但Anthropic与五角大楼冲突,或失去Palantir合作。同时,250万人“退订”ChatGPT,OpenAI紧急修约。

新智元
新闻资讯7

DeepSeek 推出快速模式和专家模式

DeepSeek web 端灰度测试快速模式和专家模式,快速模式用于日常会话,专家模式适合复杂任务,但不支持文件上传,上下文仅 128k。目前两模式能力与 v3.2 没差别,或为 v4 做准备。

AI寒武纪
新闻资讯7

他们想用AI发现不存在的物理学,然后用它去半人马座

美国初创公司 Physical Superintelligence(PSI),计划用 AI 加速物理发现。其核心平台 Emmy 能拆解研究问题。商业应用从 AI 数据中心切入,还参与费米探索者星际探测任务,目标平衡学术与商业。

DeepTech深科技
新闻资讯7

谷歌「推理之王」也跑路Meta了,当年还是李飞飞挖来的

谷歌「离职潮」含金量提升,「推理之王」周登勇跳槽Meta。此前Noam Shazeer、John Jumper等也相继离开。谷歌全力「武装」AI Coding突击小队,重构Gemini训练方式,与原世界模型AGI路线冲突

量子位
算法论文8

将注意力旋转 90 度!今天,Kimi 的「注意力残差」火了

Kimi团队发布技术报告Attention Residuals,用依赖输入的注意力机制取代标准深度递归,解决传统残差连接的信息稀释和隐藏状态爆炸问题。实验显示其有计算优势,下游任务表现佳。

机器之心
新闻资讯8

AI 会取代你的工作吗?Anthropic 用 200 万对话告诉你答案

Anthropic发布Economic Index第四期报告,分析200万次Claude对话,提出“经济原语”框架。发现AI对高学历任务加速效果更好但成功率低,还揭示Claude.ai与API差异,引入“有效AI覆盖率”等。

宝玉AI