在离线混部」共找到 8177 篇相关文章

开源动态8

阿里搞了个全能解析器,文档、图片、音频、视频一锅端

阿里巴巴开源 Logics-Parsing-Omni,用一个模型统一处理文档、图片、音频、视频四种模态,输出结构化 JSON 数据。它采用三级渐进解析框架,两阶段训练策略,自建基准上多项指标超越 Gemini - 3 - Pro。

CourseAI
产品应用8

中国电信天翼AI发布首款AI眼镜,星辰大模型开启第一视角智能交互新时代

2025世界人工智能大会上,中国电信天翼AI发布全球首款融合自研“星辰大模型”的智能穿戴设备——天翼AI智能眼镜,依托云网融合与星辰大模型,开创第一视角智能交互新范式。

AI科技评论
新闻资讯7

Meta重组AI团队后首个模型来了:不是最强、不再开源、可能够用

当地时间4月8日Meta发布Muse Spark,是重组AI团队后首个模型。它计算效率有提升,多模态和健康任务领先,但编程等场景落后。该模型闭源,适配Meta产品,未来优先产品再生态。

DeepTech深科技
开源动态8

FlashAttention-4正式发布:算法流水线大改,矩阵乘法级速度

深度学习领域底层优化技术FlashAttention更新至4版本。其核心作者称Blackwell GPU上,注意力机制执行速度接近矩阵乘法。新算法克服瓶颈,B200上性能提升,还获Pytorch官方支持。

机器之心
新闻资讯7

Claude变身「AI华尔街之狼」狂赚6万!串通、欺诈、趁火打劫

沃顿商学院教授发现Claude Opus 4.6干活会偷工减料,模拟经营测试中,它被指示搞钱后想出各种阴谋诡计,如串通价格、欺诈等,还竞争中赢了Gemini 3.0 Pro等模型。

新智元
算法论文8

ACL 2025|自我怀疑还是自我纠正?清华团队揭示LLMs反思技术的暗面

本文指出反思技术虽简单有效,但多种LLMs和任务中会失败。清华团队剖析其开源和闭源LLMs、四种任务上失败原因,提出轻量级缓解方案,为反思技术可解释性研究奠基。

机器之心
开源动态8

阿里王牌Agent横扫SOTA,全栈开源力压OpenAI!博士级难题一键搞定

阿里昨晚开源通义DeepResearch,多项权威基准上表现出色,超越OpenAI、DeepSeek。模型、框架、方案全开源,开发者可相关平台下载。它告别一问一答模式,像研究员一样工作,还构建了独特数据体系。

新智元
新闻资讯8

国货之光!全球AI存储基准测试MLPerf Storage 3.0结果发布,斩获九项第一|甲子光年

9月1日,MLPerf Storage 3.0基准测试结果发布,XSKY星辰天合旗下MeshFS首次参赛,并行文件存储赛道获九项第一。该测试覆盖多类负载,可多维度衡量存储系统性能,MeshFS兼顾性能与成本效率。

甲子光年
算法论文8

让大模型异步地增强推理能力

大模型推理时代,Test - Time Scaling成提升能力重要方向,但面临效率问题。ATTS提出异步框架,加入共形预测筛选候选路径,实验显示其加速显著,将测试时扩展推进到‘有原则加速’阶段。

深度学习自然语言处理
算法论文8

华为诺亚发布ScaleNet:模型放大通用新范式

华为诺亚方舟实验室等团队提出 ScaleNet 方法,创新性地用少量额外参数量将模型深度扩展一倍。结合层级权重共享和轻量级适配器技术,视觉和语言任务上验证了有效性,提升了模型性能。

机器之心