推理与计算」共找到 8015 篇相关文章

开源动态8

不改模型、不降质量,谷歌让Gemma 4快了3倍:本地跑大模型彻底变天

谷歌给Gemma 4家族更新Multi - Token Prediction推测解码架构,推理速度最高提升3倍且输出质量不变。介绍了LLM推理慢的原因、MTP解决办法、对开发者的利好、技术细节、使用方式等。

AI寒武纪
新闻资讯7

程序员不再写代码,而是靠「感觉」!年度热词Vibe Coding背后的编程革命

‘vibe coding’被《柯林斯词典》评为2025年度词汇,它指用自然语言提示让AI协助编写代码。从键盘到语气,从逻辑到氛围,AI改写编程,也改变人类语言思维,理性感性开始融合。

新智元
开源动态8

深度解析 OpenClaw 在 Prompt / Context / Harness 三个维度中的设计哲学实践

文章从Prompt、Context和Harness三个维度解析OpenClaw设计思路。Prompt工程有动态组装文件驱动特点;Context工程含可扩展技能、上下文压缩修剪及双层记忆管理;Harness工程为模型套“马具”,保障其可控运行。

阿里云开发者
新闻资讯7

马斯克首席AI脑莱姆病抗争!曾师从丘成桐,杨格宣布辞职

马斯克xAI核心架构师、联创之一杨格宣布离职,转任非正式顾问。他长期莱姆病斗争,打算康复后复出。杨格是数学天才,师从丘成桐,是Tensor Programs理论之父,其技术为xAI节省大量算力成本。

新智元
产品应用8

美团之后,京东也开始自研大模型了

京东发布JoyAI - LLM Flash模型,激活参数小、推理快。它采用混合专家架构等技术,在基础架构、数据加工、强化学习等方面表现出色,还通过多Token预测等技术加速推理,为商业场景落地扫清障碍。

AIGC开放社区
算法论文8

AI精准编辑门槛大降:开源框架提升编辑一致性,即插即用

近日,中山大学、香港中文大学等团队发布研究成果ProEdit。它通过对注意力机制和初始噪声潜在分布处理,实现高精度图像视频编辑,无需训练、即插即用,解决编辑效果一致性平衡难题。

量子位
算法论文8

斯坦福7B智能体全面超越GPT-4o,推理流登顶HF

传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。

新智元
算法论文7

微软等提出「模型链」新范式,Transformer性能相当,扩展性灵活性更好

随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软等研究者提出 CoR 概念,构建模型链学习范式,应用于语言模型得 CoLM 系列,实验显示其性能相当且扩展性、灵活性更好。

机器之心
新闻资讯7

Claude惨遭停用, GPT-4.1接任! 绝密备忘录爆出, 怒撕「硅谷甄嬛」奥特曼

一份绝密备忘录爆出,Dario Amodei 怒喷 OpenAI 五角大楼的交易是「安全作秀」。美国国务院等抛弃 Claude,接入 GPT - 4.1,多家国防科技公司停用 Claude,Anthropic 大厂合作或被切割。

新智元
推荐文章7

如何为 GPU 提供充足存储:AI 训练中的存储性能扩展性

文章分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在 AI 训练中表现。在满足 GPU 利用率阈值下,能支撑更多 GPU 的存储系统扩展性稳定性更强,还需关注资源利用率。以太网存储方案灵活且成本效益高。

AI前线