推理能力评测」共找到 4913 篇相关文章

开源动态8

8B 端侧写作智能体 AgentCPM-Report 开源,DeepResearch 终于本地化

1月20日,8B端侧写作智能体AgentCPM - Report开源。它以端侧模型为核心,实现本地化部署与SOTA性能双重突破,亮点在于极致效能、本地安全保障,在多评测基准表现出色,部署便捷,两大创新支撑其优秀性能。

InfoQ
开源动态8

12ms!一个仅8M的语音停顿检测模型

语音助手准确判断用户是否说完是挑战,Smart Turn将决策过程缩至12毫秒。其v3.1版有改进,新增数据集提升英语识别准确率,推出未量化版本推理更快,8MB模型性能优,已在HuggingFace开源。

AI工程化
开源动态8

告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质

南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。

AIGC开放社区
开源动态8

全网开测GPT-oss!技术架构也扒明白了

全网开测GPT-oss,它登顶开源模型王座,性能比肩o3-mini、o4-mini,适合本地推理。网友探索出多种用法,还推出Pro版。其架构也被扒出,官方介绍了微调方法,吴恩达等大佬也参与测评。

量子位
新闻资讯7

GPT-5将揭示人类的"创造力"其实就是模式识别?

有传言GPT - 5将发布,X上一博主称其或揭示人类‘创造力’是模式识别,引发热议。有人认为创意是碎片重组,也有人坚持创造力不只是模式识别,还需推理等,AI完美识别模式反被困住。

AI工程化
算法论文8

ICML 2025 | CoTo:让LoRA训练「渐入佳境」,模型融合、剪枝样样精通

来自多机构研究者提出CoTo渐进式训练策略,解决LoRA训练难题。该策略在训练早期随机失活部分适配器,后期提高激活概率,提升模型融合、剪枝能力,还能增强单任务性能与训练效率,已被ICML 2025接收。

机器之心
推荐文章8

深度对话 Benchmark 合伙人:AI 打破了 SaaS 的 3322 规则改变创造本质

Benchmark 合伙人 Eric Vishria 与 Banana Capital 合伙人 Turner Novak 对话,分享 AI 时代创业看法、投资策略等。他认为 AI 打破 SaaS 增长法则,关注创始人叙事、学习能力,坚持投资非凡公司,还谈了对上市、估值等的观点。

投资实习所
新闻资讯9

刚刚,中国语音AI连拿多项全球第一!

本文报道阶跃星辰推出StepAudio 3全系列五款音频大模型,覆盖听、说、理解、交互、创作全语音链路,拿下三项第三方评测全球第一,分析了语音AI行业从单点竞赛转向全栈体系竞争的新趋势。

新智元
开源动态8

能识图、看视频,也能理解软件界面:蚂蚁百灵开源Ling-3.0-flash-VL

本文介绍蚂蚁百灵开源的多模态大模型Ling-3.0-flash-VL,该模型采用稀疏混合专家架构,支持图片、视频、软件界面理解,可将视觉信息用于推理与任务执行,开放权重采用MIT许可证供开发者部署测试。

AIGC开放社区
新闻资讯7

2026 Data+AI 中场纪实:企业决策者,敢把真实业务交给 Agent 吗?| 直播预告

Snowflake携手InfoQ发起直播,探讨企业将真实业务交予Agent的问题。贾天下将分享相关内容,其博客展示有本体团队可实现的能力,还通过生物医学基准测试比较不同方案,为构建企业级AI智能体提供参考。

InfoQ