「开源策略」共找到 3713 篇相关文章
追平GPT-4o,数学基测96.3%高分,Hermes4 来了
Nous Research推出新一代大模型Hermes 4系列,其有混合推理和长度控制机制,还能用DataForge“造”数据,经Atropos质检。它在数学等领域表现佳,追平GPT - 4o,是开源AI对巨头的挑战。
Kafka 如何实现零停机迁移
随着企业将 Kafka 迁移至云原生架构需求增加,AutoMQ 成云端优选。但传统 Kafka 迁移方案难满足高可用需求,AutoMQ 推出 Kafka Linking 创新方案,支持双向写入与消费位点同步,实现零停机迁移。
LeetCode刷够100小时,学会找人内推,OpenAI员工下场教你拿Offer
OpenAI新研究员Bas van Opheusden分享长达8页的面试指南,涵盖心态调适、准备策略、编程技巧等方面。他强调身心健康、享受过程,给出准备时间建议,还介绍各面试环节技巧及通过后注意事项。
梳理SGLang中DP Attention及其Padding问题
作者梳理SGLang中DP Attention及其Padding问题。介绍DP Attention背景、流程,指出padding分max和sum模式,旧版sum padding浪费计算、影响cuda graph使用,v0.4.10后有优化,max padding仍待完善。
奥特曼出新招防挖角!员工期权变钞票,按5000亿美元估值兑现
被挖怕了的奥特曼开启新一期员工期权兑现计划,按5000亿美元估值兑现。这一计划若推进,既能留人,也能推高OpenAI估值。目前OpenAI发展态势好,但也面临与微软谈判等挑战。
LangChain CEO 再聊 Agent:chat 模式只是起点,Ambient Agents 才是未来
LangChain CEO Harrison Chase 和企业 Agent 平台 Dust 的 CEO Stanislas Polu 在播客中探讨 Agent 发展。他们认为 Agent 是光谱,Agentic 程度更重要;chat 模式只是起点,Ambient Agents 才是未来;还谈及多智能体系统及 AI 创业等话题。
刚刚,阿里发布最强推理模型Qwen3-2507,用疯狂一周暴击美国AI行动计划!
美国发布AI行动计划,欲成“世界AI冠军”,但阿里在7月22 - 25日三连发,推出Qwen3 - 235B非思考版本、Qwen3 - Coder、Qwen3 - 235B - A22B - Thinking - 2507推理模型,冲击美国计划。千问3在多领域表现出色,不过也有使用费用等小问题。
爆肝一周看6小时长视频,解读AI时代程序员价值几何
作者花一周看完Lex Fridman对丹麦传奇程序员DHH的6小时访谈。DHH分享编程经历,谈对流行技术看法,认为AI不能取代人类创造力,还谈及创业、开源等观点,展现深刻认知与独特态度。
揭秘白宫「AI甄嬛传」!奥特曼篡位马斯克,美国迎来AI「新教皇」
从‘冷板凳’到‘白宫座上宾’,奥特曼用不到一年完成华丽转身,替下马斯克掌控美国AI舵盘。他与特朗普从立场相左到同台亮相,OpenAI调整策略迎合特朗普,其政策目标也逐步落实。
LLM「拒绝回答」难题有救了!最新研究让AI学会人情世故 | COLM'25
最新研究发现模型规模和通用语言能力与处理敏感内容判断能力无直接关联,开源模型表现不错。通过提出的训练方法,在非推理和推理型模型上缓解过度拒绝问题,提升AI实用性和可靠性。