RISC-V 架构」共找到 2268 篇相关文章

新闻资讯7

3年手搓ChatGPT!剑桥天才少年在Minecraft游戏中爆火回归

MC大神sammyuri时隔3年发布新作,在MC中复刻ChatGPT,名为CraftGPT。虽参数量小,但用Transformer架构,能和用户交互。模型训练用Python和小数据集,视频存档公布助理解原理。

新智元
新闻资讯7

谁是2025年度最好的编程语言?

在2025年IEEE Spectrum编程语言排行榜上,Python十连冠且成三冠王,与第二名差距大,还借AI放大优势。JavaScript排名波动大,SQL宝座被冲击。同时,编程社区文化衰落,AI或终结编程语言多样性。

量子位
算法论文7

The Batch: 884 | Transformer获得新能量

弗吉尼亚大学等机构的研究人员提出 Energy-Based Transformer(EBT),它能检查自身输出。训练时通过能量值优化预测概率向量,测试显示其泛化优但生成特定文本差,扩展性好,为高性能带来新可能。

DeeplearningAI
开源动态7

详解Github 35K+项目:打通200+数据源,构建企业级AI的数据统一入口,支持MCP【上篇】

文章实测开源的AI数据统一访问引擎MindsDB,介绍其架构、安装启动方法,展示跨多数据源统一查询、AI模型赋能数据查询等功能,还将在下篇介绍知识库与智能体特性。

AI大模型应用实践
开源动态8

集合通信库VCCL释放GPU极致算力,创智、基流、智谱、联通、北航、清华、东南重磅开源

在超大规模智算集群需求下,创智、基流等多方联合开源集合通信库VCCL。它基于NCCL开发,有智能调度、容错、细粒度观测机制,实测能提升算力利用率、降低故障率,还解决了服务器异构等问题。

机器之心
开源动态7

LM Studio宣布支持在Mac上跑Qwen3-Next 80B模型

LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。

AI工程化
推荐文章8

Computer Use:莫拉维克悖论

2025年AI在数学证明等“高阶智能”任务表现佳,在“像人类一样使用电脑”任务却受挫,再现莫拉维克悖论。文章分析计算机使用智能体是实现AGI机会与挑战,指出发展难题、探讨RL作用并给出研究方向。

深度学习自然语言处理
新闻资讯7

传言:华为版 DeepSeek R2 本月发布

据 Huawei Central 报道,DeepSeek R2 可能本月 15 至 30 日发布,运行在华为 Ascend 910B 集群,硬件利用率 82%,算力 512 PetaFLOPS FP16,效率达 A100 的 91%,将与 ChatGPT 5 竞争,但消息未证实。

AGI Hunt
推荐文章8

2025年多款Deep Research智能体框架全面对比

文章从 OpenAI 关于 DeepResearch 的指南入手,对多个开源深度研究智能体框架进行架构解构与功能对比,还体验了商业化智能体应用,为使用者和开发者选工具框架提供参考。

腾讯技术工程
新闻资讯7

谷歌深夜放出 IMO 金牌模型,多项测试力压 Grok 4、OpenAI o3!网友评论两极分化

昨夜谷歌向 Google AI Ultra 订阅用户推 Deep Think 功能,Gemini 2.5 Deep Think 模型获 IMO 金牌。它是多智能体模型,通过并行思维输出答案,在多领域及测试中表现佳,但网友评价不一。

InfoQ