低精度计算」共找到 1785 篇相关文章

产品应用7

从聊天窗口到多 Agent 控制台:一次 AI 编程协作范式的转移

作者分享了从单 Agent 协作到多 Agent 协作的编程范式转变。当前主流 AI 开发多为单 Agent 协作,效率,作者设计了 Mexus 工具,解决多 Agent 协作、观测、Review 等问题,重塑人与 AI 协作关系。

阿里云开发者
新闻资讯7

ACL Fellows 2025名单公布:西湖大学张岳与UIUC季姮入选

国际计算语言学学会(ACL)公布2025年度会士名单,共11位学者入选,其中有2位华人学者,分别是西湖大学张岳和伊利诺伊大学厄巴纳 - 香槟分校季姮,文中还介绍了各位会士的入选理由和个人简介。

机器之心
新闻资讯8

联手诺基亚入局6G,老黄要制定全球标准!GTC最新演讲揭秘:「美国科技的未来」就靠这6张王牌

老黄在华盛顿 GTC 大会演讲,英伟达要和诺基亚合作干 6G,重新构筑世界通信系统。演讲涉及 6 大核心,包括利用物理人工智能和数字孪生技术重塑美国工业化等,还介绍了加速计算、AI 变革等多方面内容。

AI寒武纪
算法论文8

告别「解码器饥饿」!中国科学院NeurIPS推SpaceServe,高并发克星

中国科学院计算技术研究所入选NeurIPS 2025的论文提出SpaceServe架构,将LLM推理P/D分离扩展至多模态场景,通过EPD三阶解耦与「空分复用」,解决MLLM推理行头阻塞难题,在Qwen2 - VL系列模型实测中表现出色。

新智元
产品应用8

传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!

大模型上线部署时推理成本高、算力投入大但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 大语言模型推理框架性能极致,成本,集成关键创新,还被集成到 AI 云原生推理套件 ServingKit 中。

机器之心
开源动态8

妈妈再也不用担心延迟了!斯坦福手搓Llama超级内核,推理仅需0.00068秒

斯坦福Hazy实验室推出延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。

新智元
新闻资讯7

AI开始替人类调用AI!token用量已是人类5.2倍

据OpenRouter统计,截至8月10日,Agent类token用量半年涨14倍,人类仅2.8倍。差距源于用法差异,虽智能体部分token计价,但用量大仍烧钱。省钱关键在配套,且智能体任务验收缺人手。

新智元
新闻资讯7

马斯克的「移动客厅」又火了:20人座无方向盘,每公里才3毛钱

前段时间旧金山大停电,Waymo无人驾驶出租车趴窝,特斯拉汽车不受影响。网友翻出特斯拉Robovan视频,马斯克称其将改变街道面貌。该车20人座无方向盘,运营成本,预计2027年量产,此外马斯克身价破7000亿美元。

机器之心
新闻资讯7

「寒武纪们」被估了吗?

英伟达市值达5万亿,成AI世界“中枢神经”。在其因禁令退出中国市场后,寒武纪等本土AI芯片厂商迎来机遇。但构建软件生态是关键,其估值已脱离传统计算,成为对产业未来的“信念题”。

芯师爷
算法论文8

微调重要表征以增强思维链的推理能力

团队提出关键表征微调(CRFT)方法,通过信息流分析识别和优化关键表征。在八个数学和常识推理基准及两个模型系列验证其有效性,能提高推理准确率,学习参数量,还适应少样本场景。

深度学习自然语言处理