「大模型应用开发」共找到 9808 篇相关文章
英伟达亲手终结CUDA「护城河」?传奇芯片架构师引发争议
英伟达CUDA宣布20年来最重大更新,引入CUDA Tile技术,降低开发门槛。芯片界传奇人物Jim Keller质疑此次更新是否终结CUDA「护城河」,文章分析了相关问题,指出瓦片架构对英伟达内外移植性的不同影响。
AI基建的高潮,2025年才真正开始
文章指出AI将科技与资本结合推向新高度,美国资本市场引领技术革命,吸引全球资本。科技巨头2025年起大规模投资AI基建,其投资热能持续取决于前沿模型突破等因素,还探讨了AI对就业与分配的影响。
LLM会梦到AI智能体吗?不,是睡着了也要加班
新智元报道,Bilt部署数百万智能体,让AI在“睡眠”中整理记忆,评估互动,决定信息存储位置。AI记忆与人脑差距大,Bilt和Letta实验展现“主动智能”雏形,提高模型表现。行业也在突围AI记忆缺陷问题。
EMNLP 2025 浙大&蚂蚁 | 提出动态压缩CoT推理新方法:LightThinker
随着AI发展,大语言模型处理复杂推理任务能力提升,但推理时产生大量中间步骤和文本,拖慢计算速度、增加资源压力。浙大、蚂蚁等机构研究者提出LightThinker,可动态压缩推理步骤,降低内存占用和计算成本。
马斯克Grok这个二次元「小姐姐」,攻陷了整个互联网
今天凌晨马斯克通知更新Grok APP,推出基于Grok 4大模型的「智能伴侣」功能,付费用户可优先用新「数字伴侣」头像。此外Grok还在游戏领域出击,开发者用提示词就能生成可玩游戏,效率大增。
Claude取得理论物理突破,只用了一句话+几千美元
本文报道Anthropic开发的Claude大模型,在近无人监督条件下,仅用一句任务描述和几千美元成本,算出理论物理前沿难题九圈六粒子散射振幅,刷新保持三年的八圈纪录,获原纪录创造者认可。
100%纯血国产AI反超Suno!一个下午做出百万预算主题曲
流媒体平台Deezer数据显示,AI歌曲产能虽高但播放率低,尤其中文歌问题突出。音潮团队从底层重构音潮大模型V4.0,实现算力国产化,产品矩阵四线齐头并进,走出一条有别于Suno的发展路线。
评论送书 | Code Agent实战案例——用Pywen Agent、Claude Agent和Codex Agent从零开始构建一款网页游戏
本文展示用三大Code Agent依斯特鲁普效应构建网页游戏,对比其表现,还介绍让AI做测试方案、写文档,体现Code Agent在快速原型开发全生命周期的应用,还推荐相关书籍解答不同人群疑问。
打破视频推理「先看后想」惯性,实现真正的「边看边想」丨CVPR'26
现有大型视觉语言模型(VLM)在实时场景表现不佳,宁波东方理工大学沈晓宇团队提出TaYS,让VLM从“帧文交错”切换到“并行”,实现“边看边想”,在准确性和延迟上表现出色,推动VLM走向更真实应用。
Swift 跨平台框架 Skip 现已完全开源
Skip 是用 Swift/SwiftUI 代码库创建 iOS 和 Android 应用的方案,经三年开发后团队将其完全开源,此前为付费方案。开源既是因开发者希望免费获工具,也为保证工具持久性,它能实现原生体验。