大数据自治」共找到 6685 篇相关文章

产品应用8

单张显卡跑出15倍推理速度,aiX-apply-4B小模型加速企业AI研发落地

3月25日,硅心科技发布专为代码变更应用场景设计的轻量级模型aiX - apply - 4B。该模型在准确率、推理速度等方面表现出色,超越部分千亿级模型,还推出“模型+小模型”协同架构释放企业算力价值。

量子位
产品应用7

Claude Code、Cursor 可能都躲不过一次“重写”,但 OpenCode 也许是例外

文章指出Claude Code、Cursor等AI编程工具因开发方式问题,代码库陷入难逆转状态,或迎“规模重写潮”。而OpenCode强调代码一致性,代码库更干净。其创始人分享开发经验、工作流及对行业现象的看法。

InfoQ
新闻资讯8

前OpenAI灵魂人物Jason Wei最新演讲!三思路揭示2025年AI终极走向

前OpenAI核心研究员Jason Wei在斯坦福演讲,提出AI发展三思路。他认为智能会商品化、成本下降,自适应算力出现;所有能被验证的任务最终会被AI解决;AI智能呈锯齿状,不会瞬间超越人类。

新智元
开源动态8

攻克模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0

9月19日,蚂蚁百灵模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。

机器之心
算法论文8

DPad: 扩散语言模型的中庸之道,杜克学陈怡然团队免训推理加速61倍

扩散语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。

机器之心
算法论文8

检索做,生成做轻:CMU团队系统评测RAG的语料与模型权衡

CMU团队在最新ECIR接收论文中,系统评估RAG语料规模与生成模型规模替代关系。实验表明,语料扩容可让小模型追上模型,提升主要来自证据覆盖。研究为RAG系统提供更具性价比提升路径。

机器之心
算法论文8

上交 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
新闻资讯7

Ilya尘封10年录音曝光!二入Hinton门下,竟坦言机器学习反直觉

新智元报道,博主曝光Ilya 2015年谈论深度学习的语音片段。数学出身的Ilya认为机器学习违反直觉,二与Hinton合作。他指出监督学习是最成功领域,还谈及神经网络目标函数、深度学习追求等观点。

新智元
产品应用7

理解归 AI,正确归引擎:从一句话到一条实时数据链路(0代码搭建实时任务)

文章分享直播数据团队搭建AI辅助、指标驱动的实时数据端到端开发系统的实践与思考。从案例介绍用户使用流程,再深入系统内部讲链路构建与演进,阐述设计方法论,最后提出未来规划。

阿里云开发者
算法论文8

一个问题几百美元,DeepMind智能体一次搞定了9个Erdős问题

DeepMind团队的模型在一次‘测试’中解决9个开放的Erdős问题,还自动验证,解法通过人工审查。其框架AlphaProof Nexus结合模型与Lean编译器,研究展示了AI辅助正式证明搜索技术潜力。

机器之心