「低维建模」共找到 1250 篇相关文章
DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜
DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。
当微信支付开放MCP之后,我却有一点后怕。
微信开放微信支付MCP,补上智能体链路支付短板,使用门槛低。作者分享体验,做了多个案例,如一周健康餐智能体。但全量开放或带来风险,如AI自主完成灰产闭环、AI骗AI钱等。
Cursor改变了写代码的方式,云电脑改变了跑Cursor的方式
AI编程已成核心生产力,但Cursor等工具对硬件要求高,运行卡顿。问题不在电脑配置低,而在于AI工具不应挤在常用电脑里。无影云电脑作为‘第二桌面’,能让AI在云端运行,与第一桌面互不干扰。
实测!DeepSeek V4-pro是第一个接近Claude开源模型,前Meta研究员震惊
DAIR.AI创始人、前Meta AI研究员Elvis用DeepSeek - V4 - Pro在Pi框架搭LLM知识库,该模型开箱即用,完成知识密集型多步研究任务表现出色,在开源模型里Agent编程和推理能力强,架构设计让推理快且成本低。
豆包 Seed 2.0 来了:字节模型跨越鸿沟
春节前字节发布豆包大模型 2.0,其在 Text 领域进入榜单前十,视觉能力全球第四且成本低。它定位多模态 Agent 模型,有多种能力升级,文中用多个案例展示其强大,还强调字节重原生能力非简单蒸馏。
AI 时代的洞察方法论:结构化思维与能力迁移
文章以高盛数字化架构设计为例,探讨AI时代技术分析的能力迁移。指出AI使信息采集整合成本降低,技术分析重心从找信息转向构建模型,建模仍是洞察主战场,AI可加速知识铺垫,但模型切换需人类完成。
黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货
英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。
杨植麟预告,Kimi K3要来了
月之暗面团队海外AMA透露Kimi K3相关信息。K3或采用KDA架构,有低成本优势;通过开源解决信任问题;将推出不同规格模型;产品打磨注重写作、视觉能力及NSFW内容探索。Kimi性价比模式或改写行业规则。
斯坦福&SambaNova联手发布ACE框架:上下文即战力
文章介绍了斯坦福与SambaNova联手发布的ACE框架。它解决传统提示工程缺陷,将提示工程升级为智能体自我演化体系。通过“生成 - 反思 - 策展”闭环,实现上下文低成本、低延迟、高扩展演化,小模型搭配它能击败大模型+传统提示。
字节推出X-Streamer,实时口型同步与长程记忆数字人框架
字节推出端到端多模态人类世界建模框架X - Streamer,能从单张人像构建可无限流式生成的数字人,实现音素级口型同步和长程记忆。其核心是“思考者–行动者”双Transformer架构,在两张A100 GPU上可实时运行。