软件工程数据集」共找到 2714 篇相关文章

开源动态8

超越GPT-4o和Gemini 2.5!小米MiMo-Audio音频大模型真香

小米推出MiMo - Audio大模型,预训练数据超1亿小时。它在多个基准测试成开源7B模型SOTA,开放相关资源。分词器表现佳,有全新架构,在音频理解、对话、推理等方面表现出色,还成TTS功能。

AIGC开放社区
开源动态8

毫无征兆!DeepSeek R1爆更86页论文,这才是真正的Open

两天前,DeepSeek悄无声息把R1论文从22页更新到86页,将其升级为开源社区可复现的技术报告。新论文干货多,如精确数据配方、基础设施说明等,且多项实力媲美甚至赶超OpenAI等闭源模型。

新智元
新闻资讯7

昆仑万维方汉:通用Agent是伪命题,AI Office仍有存在空间丨MEET2026

昆仑万维董事长兼CEO方汉在MEET2026提出新视角,认为Agent是可验证过程的自动化系统,擅长复制流程。其判断大模型从‘背答案’到‘背过程’跃迁,Agent先落地AI Office,重塑组织,人类成过程架构者。

量子位
产品应用8

获NVIDIA致谢:悟空Agent的实践、复盘与迭代

本文以悟空Agent获NVIDIA致谢为切入点,介绍多智能体架构闭环及实战挑战,如上下文断流、调度失衡。还阐述架构设计、迭代优化、数据飞轮体系,指出AI infra存在安全隐患,强调安全融入业务的重要性。

腾讯技术工程
算法论文8

大模型是否对问题难度有预判?最新研究揭示 LLM 内部的“难度感知机制”

近期论文《Probing the Difficulty Perception Mechanism of Large Language Models》系统性解答大模型能否感知问题难度等问题。研究基于数据在主流 LLM 上训练轻量线性探针,定位负责难度感知的注意力头,还发现不同模型表现有差异。

深度学习自然语言处理
算法论文8

多模态后训练反常识:长思维链SFT和RL的协同困境

华为与香港科大研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。

机器之心
新闻资讯8

硬核「吵」了30分钟:这场大模型圆桌,把AI行业的分歧说透了

在WAIC 2025大模型论坛的“模型之问”圆桌中,多位行业大佬围绕大模型展开辩论,话题涉及训练范式、模型架构、数据、开闭源等核心问题,不同观点碰撞,深入探讨大模型技术演进与发展之路。

机器之心
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁大模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强大泛化能力。

量子位
算法论文8

谷歌助力神经科学飞跃,破解斑马鱼全脑活动密码

谷歌等机构科学家联合发布开创性研究成果ZAPBench,这是预测斑马鱼全脑活动的基准测试平台。它含超70000个神经元4D光片显微镜记录,设计多种刺激条件采数据,有特定基准测试任务和评估指标。

AIGC开放社区
产品应用8

Google 发布首个全模态 Embedding 2 模型,文本图片音视频 PDF 统一到一个向量空间

Google发布Gemini Embedding 2模型,它是业界首个原生支持文本、图片、视频、音频和PDF五种模态的Embedding模型,可将这些数据映射到同一向量空间,在多模态RAG、跨模态搜索等场景有应用,还介绍了跑分、用法、竞品、价格等情况。

AGI Hunt