「两阶段训练法」共找到 3093 篇相关文章
Anthropic联创公开劝退套路码农!94%编程将被接管,去学点哲学吧
Anthropic联创Jack Clark在峰会上称大学生应避开「套路化编程」,未来需跨学科综合、分析思考能力。Anthropic雇哲学家训练Claude,工程师工作转向管理AI智能体,AI接管编程趋势明显。
高效Agents的尽头是,Harness
文章指出玩Agent久了会出现问题,很多人简单将其视为“模型+工具”组合远远不够。以OpenDev为例,介绍了Harness架构,包括核心理念、扩展ReAct循环、上下文工程等,还提及安全架构、多模型路由等内容。
110万美元悬赏!AMD发起全球战书:谁能打破DeepSeek与Kimi的推理速度极限?
AMD与GPU MODE联合发起2026线上黑客松,向全球发榜。挑战赛设110万美元奖池,分预选赛和决赛,要对核心GPU算子打磨、挑战明星模型,代码须可合并,给出了赛程安排及参赛方式。
迎接「万物皆可RAG」时代:最新综述展示50多种多模态组合的巨大待探索空间
大模型常采用RAG技术,多模态崛起使RAG向MM - RAG发展。目前MM - RAG研究初级,华中科技大学等研究者发布综述,覆盖所有模态组合,剖析工作流,提供构建系统的一站式指南。
2025年第二届「兴智杯」全国人工智能创新应用大赛正式启动,线上报名开启
2025年5月8日,第二届「兴智杯」全国人工智能创新应用大赛启动,由多机构主办。大赛聚焦关键能力设赛题,分主题赛和总决赛,有激励机制。深圳产业优势突出,共同主办助力人工智能融合发展。
grok 4一图流
文章展示grok 4核心数据,涵盖训练成本、模型定价,还列举其在通用、专业、数学、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。
ACL'25首届博士论文奖 | 重新思考 LLM 中的数据使用
近日,第一届 ACL 计算语言学博士论文奖获得者是 Sewon Min,其论文《重新思考大型语言模型中的数据使用》围绕大型语言模型如何使用训练所用的庞大文本语料库展开研究。
Anthropic 发文称自家 Claude 已经开智,网友:为了上市,不择手段?
Anthropic发布Claude内部机制新研究,介绍J-space和J-lens,称可读取模型未输出的内部概念。此研究在训练、评测和部署有潜在价值,但叙事引发争议,网友质疑是否过度包装。
中科院甩出多模态“核弹”!类GPT-4o多模态模型开源!支持语言-视觉-语音任意组合交互!
中国科学院计算技术研究所(ICTNLP)开源类GPT - 4o多模态模型Stream - Omni,支持文本、视觉和语音任意组合交互,核心是高效模态对齐技术,少量多模态数据即可训练,有多种使用场景。
独家 | 前理想汽车联创沈亚楠成立「赫宇机器人」,布局家庭机器人
AI科技评论独家消息,前理想汽车联合创始人沈亚楠创立「北京赫宇机器人科技有限公司」,进军家庭机器人方向。赫宇机器人是其智能住宅品牌「栖息地」体系内新业务,项目处早期团队组建阶段。