含模量」共找到 1089 篇相关文章

开源动态8

教多态大型学会“反思”和“复盘”,上交&上海AI Lab重磅发布MM-HELIX&AHPO,破解多态复杂推理难题

上海交通大学和上海人工智能实验室研究团队带来MM - HELIX,这是完整生态体系,赋予AI长链反思性推理能力。其基准测试、数据集、优化算法,搭载相关技术的型表现优异,部分成果已开源。

量子位
新闻资讯7

Oracle 推出 MySQL AI

Oracle 推出仅在 MySQL 企业版提供的 MySQL AI,用于处理分析和 AI 工作负载。它有向存储等功能,新 AI 引擎四大核心组件。但 MySQL 社区担忧社区版未来及供应商锁定问题。

InfoQ
开源动态7

从科学论文自动生成视频

该项目解决学术演示两核心问题,用智能体PaperTalker生成视频,还设Paper2Video基准评估。介绍了PaperTalker使用步骤,环境、配置、推理,也说明了Paper2Video评估指标及运行方法。

GitHubStore
算法论文8

推理token减少46%!Meta新方法缩短思维链,告别重复推导

Meta等联合提出元认知复用机制,让型总结解题思路,提炼为“行为”存于“行为手册”。实验显示,该机制在数学基准测试中显著优化,保持准确率时最多减少46%推理token使用

量子位
产品应用8

2.12页/秒,MinerU2.5太快了,1.2B硬刚腾讯、阿里

GPT - 4o等刷新OCR榜单,但产业界仍面临文档图像处理难题。MinerU2.5提出1.2B轻级文档解析型,采用创新解耦范式,在多基准测试表现出色,单卡吞吐快,还给出可借鉴创新点。

CourseAI
开源动态8

马斯克转发字节Seed&哥大商学院新基准:大型搞金融,连查个股价都能出错

字节跳动Seed团队与哥大商学院推出开源金融搜索与推理基准测试FinSearchComp,635个问题。评测显示大型处理金融任务有差距,凸显金融AI能力评估重要性,还揭示了关键能力差距。

量子位
算法论文8

让RAG告别断章取义,HiChunk做到了~

现有RAG评测忽视文档切分,腾讯优图提出HiCBench评测基准和HiChunk框架。HiCBench人工标注多级切分点与证据稠密QA,HiChunk用微调LLM建多级语义树,配Auto - Merge算法,实验效果佳。

PaperAgent
新闻资讯8

刚刚,OpenAI发布GPT-5-Codex:可独立工作超7小时,还能审查、重构大型项目

凌晨1点,OpenAI发布针对编程优化的GPT-5-Codex,它能独立工作超7小时,可审查、重构大型项目。还宣布Codex升级,包括新CLI和IDE插件等,同时介绍安全保护措施、价格及可用性。

机器之心
算法论文8

告别无效计算!新TTS框架拯救19%被埋没答案,推理准确率飙升

现有TTS方法存在路径同质化和中间结果利用不足问题。华为诺亚方舟实验室等机构提出SRCA框架,检查点注入、答案聚类搜索和检查点候选增强组件,实验显示能提升推理准确性、效率,降低成本。

机器之心
开源动态7

Crossplane 2.0 发布:在云基础设施之上全面支持应用管理

Crossplane 开源项目发布 2.0 版本,将管理范围从云基础设施拓展到应用与基础设施协同编排。解决了基础设施与应用需分开管理的问题,新增应用支持,改进组合资源,采用命名空间优先设计,还引入新 Operation 类型。

InfoQ