跨端重写」共找到 934 篇相关文章

算法论文8

破解AI对不同上下⽂位置的敏感度不⼀致,新框架使出“解铃还须系铃人”

语言模型存在位置偏见,影响复杂推理等任务。论文提出Pos2Distill框架,将模型优势位置能力迁移到劣势位置缓解偏差,设计了Pos2Distill - R1和Pos2Distill - R2,在检索和推理任务表现好且有任务泛化能力。

量子位
新闻资讯7

Node.js之父宣判“手代码时代结束”!DHH明确反对“结束论”:大模型还差口气,手更有竞争力

Node.js之父Ryan Dahl宣称人类代码时代结束,而Ruby on Rails作者DHH反对,认为大模型还差口气,手代码仍有竞争力。DHH分享AI使用体验,指出距AI带来明显优势的拐点还差一点,还探讨互联网和产品发布等问题。

InfoQ
产品应用7

Cursor为Blackwell从零构建MXFP8内核,MoE层提速3.5倍,端到端训练提速1.5倍

Cursor团队从NVIDIA的Hopper H100s升级到Blackwell B200s后遇性能瓶颈,他们回归基础,从零重MoE训练层,抛弃对现有CUDA库依赖,释放了Blackwell架构潜能,实现MoE层和端到端训练提速。

机器之心
产品应用8

Claude Code 5亿美元背后的AI工程革命

文章介绍了Claude Code的诞生故事、技术选型、开发流程等。它从听歌小工具变为年入5亿美元产品,90%代码自,开发流程快,还重新设计终端交互。Anthropic团队各环节AI化,也有特殊条件,有些经验可借鉴。

宝玉AI
开源动态7

Sora 模糊视频有救了!强大的免费开源AI视频处理工具!硬件要求低!

Video2X-QT6是免费开源AI视频处理工具,支持视频超清放大、补帧,兼容CPU和GPU,低配置电脑也能用。6.0.0版本用C/C++重,速度快、平台,还能处理图片。介绍了不同系统安装方法等。

GitHubStore
算法论文8

FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾

文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨芯片迁移及未来优化方向。

GiantPandaLLM
推荐文章7

AGI时代最稳的饭碗是什么?3Blue1Brown创始人:技术会淘汰,但信任不会

科普视频博主 Grant Sanderson 在播客中指出,AI 因缺乏肉身和生理模仿机制,不出触动人类灵魂的文章,即便证出黎曼猜想,若证明冗长,对人类也无意义。他还探讨了 AI 在数学领域的进展、局限,以及人类教师和科普作者在后 AI 时代的价值。

AI科技大本营
开源动态8

一个只有70行的文件,凭什么拿下GitHub 10万星?

GitHub上‘andrej - karpathy - skills’项目爆火,核心是不到70行的CLAUDE.md文件,给出AI编程助手行为准则。其火的原因有解决痛点、名人背书等,价值在于证明‘上下文工程’重要。

AI Reading Hub
新闻资讯7

谷歌偷偷上线免费Cursor,程序员饭碗又摔碎了!

Google AI Studio增加build按钮,相当于免费的cursor。能用一句话、图或文件生成完整AI应用并一键部署。可通过对话修改应用,分享应用消耗他人免费配额,利于推广Gemini生态。

探索AGI
新闻资讯8

Claude Code 之父最新访谈:编程已经结束、harness 将消失,Claude Code 将只有 100 行代码,loop 才是未来

Claude Code 之父 Boris Cherny 在红杉资本大会分享编程未来。他表示编程已基本解决,自己用手机操控 Agent 工作,loop 是未来,还预测 Claude Code 产品外壳未来或仅 100 行代码。

AGI Hunt