「底层系统能力」共找到 4759 篇相关文章
紫东太初开源视觉神经增强方法,即插即用终结多模态幻觉 | ACL 2025
中科院自动化所等团队提出VHR方案,通过“视觉神经增强”机制放大模型视觉关键注意力头输出,降低幻觉现象。此前主流方法多作用于最终输出阶段,VHR深入干预内部机制,还介绍了SSL语义引导方法。
谷歌杀疯了!全新开源AI编程工具Gemini CL,刚开源1天就斩获26.5K标星!
谷歌推出全新开源AI编程工具Gemini CLI,开源不到24小时获26.5K标星。它将Gemini 2.5 Pro塞进命令行终端,有自然语言驱动等多种能力,免费额度高,可扩展,部署简单。
首个面向科学任务、真实交互、自动评估的多模态智能体评测环境,ScienceBoard来了
ScienceBoard是首个面向科学任务、真实交互、自动评估的多模态智能体评测环境。它集成多领域科研软件,构建科研任务集合,评估智能体在科学任务上的表现,发现现有模型在科研工作流中远未成熟。
提示词工程、RAG之后,LangChain:上下文工程开始火了!
AI时代,上下文工程正兴起。它是构建动态系统,为LLM提供合适信息和工具以完成任务。随着应用复杂度增加,提供完整结构化上下文比提示词更重要,正成AI工程师重要技能。
Agent全自动搭建代码运行环境,实时更新解决评测过拟合/数据污染问题|微软
长期以来主流代码修复评测基准SWE - bench问题多,制约AI模型能力展现。微软发布SWE - bench - Live,引入新Issue,实现环境自动化构建与更新,打破传统局限,还揭示传统基准过拟合问题。
微软分享三大王炸算法:突破大模型推理瓶颈,性能大涨
今天凌晨微软官网分享三大创新算法,即rStar - Math、LIPS、CPL,可助大模型突破推理瓶颈,增强数学推理和思考链能力,还介绍了各算法原理、优势及对应论文地址。
高考数学斩获139分!小米7B模型比肩Qwen3-235B、OpenAI o3
2025高考落下帷幕,人工智能领域多家大模型挑战数学卷。小米7B参数的MiMo - VL模型考139分,比肩Qwen3 - 235B、OpenAI o3,还在多方面表现出色,技术报告等已开源。
从高考到实战,豆包大模型交卷了
火山引擎原动力大会 Force 2025 发布豆包大模型 1.6 等多项新产品。豆包 1.6 性能提升,在多方面表现出色;Seedance 1.0 Pro 视频生成能力强。大会强调‘AI 云原生’,还推出多个套件和技术进展。
微软开源2周狂赚7.2K star!!轻量好用命令行编辑利器,程序员力荐!
微软开源命令行文本编辑器`Edit`,专为Windows Terminal设计,支持多系统。它轻量高效,功能丰富,兼容Windows生态,还有鼠标模式。开源半月获7.2K+ star,提供多种安装方式。
还得是华为!Pangu Ultra MoE架构:不用GPU,你也可以这样训练准万亿MoE大模型
华为盘古团队发布Pangu Ultra MoE模型架构与训练方法的中文技术报告。该模型全流程在昇腾NPU上训练,团队在架构和训练方法创新,实现准万亿MoE模型训练,还在多方面优化提升性能。