指令集架构」共找到 2579 篇相关文章

新闻资讯7

DeepSeek一句话让国产芯片体暴涨!背后的UE8M0 FP8到底是个啥

DeepSeek V3.1发布后,官方留言提及新架构和下一代国产芯片,引发AI圈轰动,国产芯片企业股价上涨。文章介绍了UE8M0 FP8概念,分析其适配国产芯片原因,还猜测适配的芯片厂商,指出代表国产AI走向软硬协同。

量子位
算法论文8

MSRA清北推出强化预训练!取代传统自监督,14B模型媲美32B

微软亚洲研究院联合清北提出全新预训练范式RPT,将强化学习融入预训练,把预训练语料库重构为推理问题。实验显示RPT-14B表现出色,在多方面媲美甚至超越32B模型,未来RL或在LLM预训练掀起风暴。

量子位
算法论文8

超越GPT-4o!华人团队新框架让Qwen跨领域推理提升10%,刷新12项基准测试

加拿大滑铁卢大学与TikTok新加坡的华人团队提出全新训练框架General - Reasoner,让Qwen系列大模型跨领域推理准确率提升近10%,在多项基准测试中超越GPT - 4o。该框架有全领域推理数据和生成式答案验证器两大创新。

量子位
算法论文7

LLM+RL遭严重质疑,随机/错误等虚假奖励也能提升至标准效果?

论文在AI领域观察到类似随机给糖或奖励错误答案让孩子成绩提升的现象,‘虚假奖励四大奇招’效果接近用标准答案训练,Qwen2.5 - Math - 7B模型在测试上性能飙升,还揭示了Qwen特别的原因及随机奖励有效的推手。

深度学习自然语言处理
推荐文章8

Karpathy的软件3.0:Agent的原生世界

OpenAI联合创始人Andrej Karpathy在Sequoia Ascent大会上表示,AI Agent正改变软件与工作模式。编程基本单位从写代码变为给Agent下达指令,软件3.0以上下文窗口为程序,LLM为解释器。他还提出理解AI能力分布的框架,给出创业建议。

AIGC开放社区
算法论文8

大模型外挂“三维物体知识库”来了,大幅增强机器人长程自主操作能力

现有视觉语言大模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。

DeepTech深科技
推荐文章7

数据合成有没有未来?事实结论来了

有人认为用大模型合成数据可快速生产,无需人工标注。但作者观察发现人工标注不仅必要且要求更高。以Scale AI、Surge AI为例说明标注价值,还展示‘智能知识’团队对两数据审查结果,证明高质量数据需专家和管理流程。

AI工程化
算法论文7

引入小目标注意力模块改进YOLO12用于无人机视角下的岸边人员玩水检测

文章介绍用小目标注意力模块改进YOLO12,用于无人机视角下岸边人员玩水检测。先介绍YOLO12特点与结构,再说明小目标注意力模块CBAM优势、流程及代码,接着阐述改进方法、数据情况,最后给出训练和测试模型的代码与结果。

机器学习AI算法工程
产品应用8

阿里云Tair KVCache仿真分析:高精度的计算和缓存模拟设计与实现

阿里云Tair KVCache团队推出Tair - KVCache - HiSim,这是面向分布式多级KVCache管理的高保真LLM推理仿真分析工具。它能在通用CPU上高精度预测性能,支撑计算选型、存储规划和调度协同等决策,还介绍了其架构、组件、验证及性能评估等内容。

阿里云开发者
算法论文7

英伟达说,小语言模型(SLM)是智能体的未来

英伟达论文指出小语言模型(SLM)是代理人工智能未来。SLM参数小于100亿,可装在消费电子设备。英伟达认为其强大、适合代理系统且经济。微软、英伟达等多家厂商的小模型表现出色,文中还分析了SLM优势及代理架构

AI与安全