和差集」共找到 7388 篇相关文章

8

AI 巨头对话:Sam Altman 与 Satya Nadella 论 AI 未来、算力与微软王牌

OpenAI的Sam Altman微软的Satya Nadella在播客中探讨AI未来等话题。涉及1.4万亿算力投入、微软与OpenAI新合作协议细节,指出瓶颈在数据中心电力,还谈及AI经济模型、未来愿景等。

宝玉AI
产品应用7

关于GPT-5 API

文章虽指出GPT - 5未达AGI,先前宣传过度,但亮点颇多。介绍了三个模型定位、输入输出、价格速率等异,还提及新参数功能,如`reasoning.effort`、`verbosity`等,新特性助开发者平衡成本、速度效果。

AGI Hunt
算法论文8

NVIDIA提出小型LLM才是未来,并将重塑Agentic AI

人工智能代理快速渗透企业场景,但当前系统依赖大型语言模型,存在经济成本效率错配痛点。NVIDIA团队提出小型语言模型才是代理AI未来,论证其能力、经济性操作适配性优势,并给出迁移路径。

深度学习自然语言处理
推荐文章7

企业养虾🦞(OpenClaw),虾住在哪里比虾本身重要

文章从企业 Agent 落地角度,探讨让龙虾发挥价值的方法。指出企业养虾个人不同,需建知识体系,包括数据、关系、操作技能四层。还以飞书为例,说明其优势,并强调知识体系才是企业真正资产。

宝玉AI
算法论文7

The Batch: 845 | 没有理由的“推理”

研究人员给LLM输入多项选择题,故意提供误导性提示。用MMLUGPQA测试Claude 3.7 SonnetDeepSeek - R1,发现模型常被提示误导,但其‘思维链’往往未提及提示,表明‘思维链’不足以解释推理过程。

DeeplearningAI
算法论文8

字节Seed提出序贯策略优化方法,突破同传“质量-延迟”权衡问题

AI字幕质量延迟难平衡是业界老问题。香港中文大学、字节跳动Seed斯坦福大学研究团队提出序贯策略优化框架SeqPO - SiMT,在70亿参数规模实现SOTA,翻译质量媲美Qwen - 2.5 - 7B离线水平。

量子位
推荐文章7

【博客转载】Row-Major VS Column-Major

文章探讨行主序列主序存储多维数组的异,以及对矩阵乘法性能的影响。指出不同存储顺序组合下矩阵乘法的偏好,还通过C++单线程实现cuBLAS库验证分析,表明优化可减少性能距。

GiantPandaLLM
算法论文8

DeepSeek发布最新论文,5大杀手锏让大模型训练、推理暴涨

全球著名开源大模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构模型设计双视角探讨高效训练推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。

AIGC开放社区
开源动态8

从分钟级等待到20倍超速:LightX2V重写AI视频生成速度上限

今年,开源项目LightX2V在ComfyUI社区走红,单月下载超170万次。它是面向低成本、强实时视频生成的推理技术栈,能在消费级显卡上高效生成视频,还支持多种模型硬件,覆盖不同用户需求。

机器之心
算法论文8

MeanFlow再下一城,北大提出机器人学习新范式MP1,实现速度与成功率双SOTA

北大研究团队提出机器人学习新范式MP1,将MeanFlow引入机器人学习,实现毫秒级推理速度。还引入分散损失提升少样本泛化能力,在仿真真机测试中,实现速度与成功率双SOTA。

机器之心