超脑2.0」共找到 4227 篇相关文章

新闻资讯8

深度|Karpathy为何突然加入Anthropic,只能当Dario的「-2」?

5月19日,OpenAI联合创始人Andrej Karpathy宣布加入Anthropic预训练团队。他将组建新团队,用Claude加速预训练研究。文章分析了他加入的原因,以及Anthropic招聘他的动机,还指出这一变动标记着技术拐点。

新智元
产品应用7

AI实践|基于 Spring AI 从0到1构建 AI Agent

本文是基于Spring AI构建AI Agent的实践分享。该项目集成RAG、Function Calling等核心能力。文章从六个核心模块剖析其架构与实现,涵盖配置、访问方式,还介绍各模块工作机制、代码及应用场景。

阿里云开发者
产品应用7

李飞飞World Labs双模齐发,能「造」复杂大场景,一手实测

李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。

机器之心
产品应用8

不拼GPU!中兴扔出AI节点,把token价格打下来

在万亿级大模型时代,传统‘芯片堆砌’方式面临通信开销剧增等痛点。中兴通讯推出节点技术,从系统级协同架构出发,通过六大维度创新,绕开单GPU芯片瓶颈,重构AI算力基础设施,推动行业向开放、融合发展。

新智元
算法论文8

成本仅0.3美元,耗时26分钟!CudaForge:颠覆性低成本CUDA优化框架

CUDA代码性能对模型训练与推理重要,但手动优化门槛高。明尼苏达大学团队提出CudaForge,是低成本多智能体CUDA Kernel生成与优化工作流,实验效果好,成本低且具通用性。

机器之心
新闻资讯7

微软AI新天团曝光!只有1位华人,「谷歌系」1/3

微软AI CEO苏莱曼领导的17名核心高管阵容曝光,新增9名核心成员中有5位来自谷歌(包含DeepMind)系,8名老将中有2名来自苏莱曼共同创办的Inflection AI。新核心团队将聚焦AI产品落地、安全与隐私、增长与商业化。

新智元
产品应用7

从0到1:天猫AI测试用例生成的实践与突破

本文阐述天猫技术团队在AI赋能测试领域的实践,讲述智能测试用例生成落地路径。介绍业界现状与天猫业务特性,给出实施策略,展示应用效果,还指出问题并对未来发展做了展望。

阿里云开发者
新闻资讯7

DeepSeek V3.1更新「最终版」!下一次是V4/R2了???

DeepSeek-V3.1更新至DeepSeek-V3.1-Terminus版本,修复了“极你太美”等bug,缓解中英文混杂等情况,优化了Code Agent与Search Agent表现。评测显示输出更稳定,但编程竞赛分数下降引质疑,版本名引发对后续版本猜测。

量子位
新闻资讯8

训练数据量降低1万倍,谷歌提出高质量数据主动学习方法

将大模型应用于特定领域需数据微调,但筛选高保真训练数据难度大、成本高。谷歌提出新主动学习筛选流程,能将训练数据规模降1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。

AIGC开放社区
算法论文8

KDD 2025 Best Paper Runner-Up | EI-BERT:紧凑语言模型压缩框架

香港城市大学王茂林等提出 EI - BERT 框架,解决移动设备部署 NLU 模型难题。通过硬令牌剪枝、交叉蒸馏、模块化量化,实现 99.5% 压缩率。在多任务中表现出色,已在支付宝大规模应用。

机器之心