速度和准确性」共找到 7282 篇相关文章

新闻资讯7

离开OpenAIGoogle后,两位大模型核心负责人决定卷下一代架构

曾是OpenAI的「强化学习最大主义者」Jerry Tworek,与谷歌Gemini预训练负责人Rohan Anil,共同创办Core Automation。他们探讨当前AI路线问题,认为下一代架构要能持续学习,还计划打造自动化AI实验室。

机器之心
算法论文8

长视频生成可以回头看了!牛津提出「记忆增稳」,速度提升12倍

牛津大学团队提出VMem,把「看过什么」写进几何小片,用基于3D几何的记忆索引替代短窗上下文,实现「一致性更强、资源更省、速度更快」,实测速度比常规管线快约12倍。

新智元
推荐文章7

【CUDA博客】关于TensorCoreInline PTX Assembly的一个超简短笔记

文章围绕TensorCoreInline PTX Assembly展开,介绍利用PTX指令发挥TensorCore潜力。讲述矩阵乘法累加操作,给出半精度及替代浮点指令形式,有代码示例并分析,还提到不同数据类型用法及SASS指令。

GiantPandaLLM
新闻资讯7

智・向远大|这场重庆峰会,腾讯云想你聊透 AI 的 “落地与增长”

4月28日腾讯云城市峰会・重庆站聚焦企业如何从AI技术创新走向商业成功。峰会在重庆这个绝佳试验场,带着AI实践直面企业智能化转型难题,议程围绕‘落地’与‘增长’,还有线上直播。

AI科技大本营
新闻资讯8

AI生图大洗牌!流匹配架构颠覆传统,一个模型同时接受文本图像输入

AI生图有新突破,新模型FLUX.1 Kontext用流匹配架构,与此前技术不同,能接受文本图像输入。其来自Black Forest Labs,有编辑生成能力,还具备4个特性,第三方测试也给出提示词使用技巧。

量子位
算法论文8

Meta&UIUC大发现:无需标注,Agent复杂的工具使用搜索能力,是可以“无中生有”的

MetaUIUC研究发现,无需标注,Agent复杂工具使用搜索能力可“无中生有”。论文Dr. Zero让大模型自我博弈成搜索专家,用HRPO提效,设计难度导向奖励,实验表现佳,但也存在局限。

深度学习自然语言处理
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。

机器之心
新闻资讯8

180 天狠赚 5.7 亿,8 人团队全员财富自由,最大功臣是 Claude Gemini

海外巨头 Wix 斥 8000 万美元收购成立仅 6 个月的 AI 公司 Base44。其创始人 Shlomo 用 AI 打造“开箱即用”开发平台,采用“全栈原生”理念突围。Shlomo 分享创业经历、工具使用及增长策略等。

InfoQ
算法论文8

晶圆级芯片存算一体结合:中科院提出15万tokens/s晶圆级芯片方案丨ASPLOS'26

当前大模型发展对计算硬件需求增长,数据搬运成隐性开销。中科院团队成果Ouroboros实现晶圆级芯片,解决数据搬运问题,虽面临挑战,但性能与能效表现显著,验证了“存算一体+晶圆级集成”路线可行性。

量子位
开源动态8

牛!小米开源「音频语言模型」,超1亿小时预训练时间,音频理解输出能力是真顶!

小米推出开源音频语言模型MiMo - Audio,有超1亿小时预训练时间。它能理解音频,70亿参数模型在多基准测试达SOTA,音频理解超Gemini - 2.5 - Flash,复杂推理优于GPT - 4o - Audio,还支持多模态任务。

开源AI项目落地