「可重构计算」共找到 5414 篇相关文章

开源动态8

英伟达&MIT等推出Long-RL,长视频训练速度翻倍

英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。

机器之心
新闻资讯7

离开百川去创业!8 个人用 2 个多月肝出一款热门 Agent 产品,创始人:Agent 技术有些玄学

前百川工具链负责人徐文健离开百川后创业,和冯雷创立火星电波,推出AI播客产品ListenHub。团队搭建重品质,产品研发仅用两月多,虽获用户认可,但也面临质疑,公司计划出海,徐文健认为企业核心是组织和理念。

AI前线
推荐文章7

本地LLM万字救场指南来了!全网超全AI实测:4卡狂飙70B大模型

文章围绕本地大语言模型(LLM)展开,针对实用性和经济性问题,用Dell Precision 7960塔式工作站对主流模型测试。涉及不同尺寸模型、推理框架等,给出不同配置下性能指标及使用建议,还模拟真实场景测试。

新智元
8

RAG技巧与底层代码剖析

文章深入剖析 RAG 技巧与底层代码,从用 Python 基础库构建 RAG 系统,到多种优化方法如上下文增强检索、添加上下文块标题等,还涉及查询改写、重排序等技术,最后介绍了上下文压缩、反馈机制等提升系统效率和质量的方法。

阿里云开发者
算法论文7

苹果提出原生多模态Scaling Law!早融合+MoE,性能飙升秘密武器

如今打造强大多模态模型是AI重要目标,常用方法有局限。法国索邦大学、苹果研究人员开展原生多模态Scaling Laws研究,对比早融合与后融合,探讨多种因素对模型性能影响,发现早融合、多模态MoE优势,为后续研究指明方向。

新智元
产品应用7

深度体验DeepSeek Harness,我原谅它涨价了

本文深度体验了DeepSeek Harness,它已发布并开源代码。其一切如模型、工具等皆为可插拔积木,官方内置超百个插件。介绍了安装方法、使用特点,还对比了与Codex差异,认为它是Agent时代的安卓,有望推动自进化。

量子位
开源动态8

这个新生图模型有点夯:4K直出的,国产的,开源的!

商汤新开源的生图模型SenseNova U1.5-Lite-Preview亮点十足,它是国产、4K直出、轻量且可指哪儿改哪儿的原生统一多模态模型。能应对复杂创作和编辑任务,技术源于NEO-Unify架构,评测成绩佳,不过还是早期预览版。

量子位
新闻资讯8

人类最后考试已不够用,Agent最后考试来了!

AI飞速进步,人类最后考试(HLE)已不够用,伯克利牵头推出智能体最后的考试(ALE)。ALE真实、全面、可验证,当前最强AI在最难档通过率仅8.6%,主流系统平均2.6%,显示AI距替人干活尚远。

AIGC开放社区
新闻资讯7

当国产模型追上闭源旗舰,企业 AI 编程的真正障碍才浮出水面

过去企业AI Coding讨论多集中在模型能力等方面,DeepSeek V4出现缓解了模型问题,但更深层的代码库业务隐知识等问题浮现。合规限制使企业工具建设受阻,V4打破了模型供应瓶颈,可组织知识管理仍成难题。

InfoQ
新闻资讯7

「10倍工程师」神话破灭?代码免费,懂品味才值钱

AI正将世界撕裂成「双重现实」,一边是疯狂用AI重构工作流的人,另一边是把AI当玩具的人。AI抬高了行业下限,让「10倍工程师」成新底线,写代码贬值,懂品味的研究值钱,且AI或先改造蓝领行业。

新智元