「超脑2.0」共找到 4227 篇相关文章
深度|Karpathy为何突然加入Anthropic,只能当Dario的「-2」?
5月19日,OpenAI联合创始人Andrej Karpathy宣布加入Anthropic预训练团队。他将组建新团队,用Claude加速预训练研究。文章分析了他加入的原因,以及Anthropic招聘他的动机,还指出这一变动标记着技术拐点。
AI实践|基于 Spring AI 从0到1构建 AI Agent
本文是基于Spring AI构建AI Agent的实践分享。该项目集成RAG、Function Calling等核心能力。文章从六个核心模块剖析其架构与实现,涵盖配置、访问方式,还介绍各模块工作机制、代码及应用场景。
李飞飞World Labs双模齐发,能「造」超复杂大场景,一手实测
李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。
不拼GPU!中兴扔出AI超节点,把token价格打下来
在万亿级大模型时代,传统‘芯片堆砌’方式面临通信开销剧增等痛点。中兴通讯推出超节点技术,从系统级协同架构出发,通过六大维度创新,绕开单GPU芯片瓶颈,重构AI算力基础设施,推动行业向开放、融合发展。
成本仅0.3美元,耗时26分钟!CudaForge:颠覆性低成本CUDA优化框架
CUDA代码性能对模型训练与推理重要,但手动优化门槛高。明尼苏达大学团队提出CudaForge,是低成本多智能体CUDA Kernel生成与优化工作流,实验效果好,成本低且具通用性。
微软AI新天团曝光!只有1位华人,「谷歌系」超1/3
微软AI CEO苏莱曼领导的17名核心高管阵容曝光,新增9名核心成员中有5位来自谷歌(包含DeepMind)系,8名老将中有2名来自苏莱曼共同创办的Inflection AI。新核心团队将聚焦AI产品落地、安全与隐私、增长与商业化。
从0到1:天猫AI测试用例生成的实践与突破
本文阐述天猫技术团队在AI赋能测试领域的实践,讲述智能测试用例生成落地路径。介绍业界现状与天猫业务特性,给出实施策略,展示应用效果,还指出问题并对未来发展做了展望。
DeepSeek V3.1更新「最终版」!下一次是V4/R2了???
DeepSeek-V3.1更新至DeepSeek-V3.1-Terminus版本,修复了“极你太美”等bug,缓解中英文混杂等情况,优化了Code Agent与Search Agent表现。评测显示输出更稳定,但编程竞赛分数下降引质疑,版本名引发对后续版本猜测。
训练数据量降低1万倍,谷歌提出超高质量数据主动学习方法
将大模型应用于特定领域需数据微调,但筛选高保真训练数据难度大、成本高。谷歌提出新主动学习筛选流程,能将训练数据规模降1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。
KDD 2025 Best Paper Runner-Up | EI-BERT:超紧凑语言模型压缩框架
香港城市大学王茂林等提出 EI - BERT 框架,解决移动设备部署 NLU 模型难题。通过硬令牌剪枝、交叉蒸馏、模块化量化,实现 99.5% 压缩率。在多任务中表现出色,已在支付宝大规模应用。