量化深度预测」共找到 1315 篇相关文章

开源动态8

模型即智能体,Kimi K2 Thinking多项评估超越顶尖闭源模型,300轮工具调用不疲倦

月之暗面发布Kimi K2 Thinking,它是Kimi迄今最强开源思考模型,基于模型即智能体理念训练,可自主连续工具调用与多轮思考,多项评估超顶尖闭源模型,还实现原生INT4量化,提升生成速度。

AIGC开放社区
推荐文章8

英伟达不是被计划出来的

英伟达成全球首个市值破5万亿美元企业,打破企业体量天花板想象。其GPU起初为游戏而生,CUDA曾是失败项目,却因深度学习需求成AI关键。其崛起证明伟大难被计划,创新源于多元互动。

芯师爷
推荐文章7

当你感到AI编程无所不能时,也许正站在“愚昧之巅”——理性看待AI时代的软件开发与应用变革

文章分析AI时代软件开发、产品设计和内容营销的变化。赞同产品设计半开放式、加速MVP效率等;部分赞同VOC捕捉、SEO自动化等,但有待验证;不认同普通开发者被淘汰等过于乐观的预测。指出多数变化5年渐显。

宝玉AI
新闻资讯7

Node.js之父官宣:人类手写代码时代真的结束了!

Node.js之父Ryan Dahl称人类手写代码时代终结,Stability AI创始人Emad Mostaque预测AI编程成本将暴跌,现在每月200美元的体验两年后不到1美元。AI编程虽需大量算力,但成本正快速下降,未来编程或更民主化。

新智元
开源动态7

国产开源LLM大爆发,Qwen、Minimax、美团、腾讯~

近期国产开源LLM大爆发,Qwen3-VL家族新增模型,有技术亮点且可免费商用;MiniMax-M2为编码和代理任务打造;美团LongCat-Video、LongCat-Audio-Codec各有专长;腾讯混元世界 - 镜像用于3D几何预测

PaperAgent
推荐文章7

2026年了,我们还在用爱迪生试灯丝的方式评估World Model

文章围绕World model展开深度讨论,界定其概念,分析生成派、JEPA派、空间智能派三条技术路线,指出评估比LLM难,提及游戏化benchmark可能是破局点,还强调具身进展由数据驱动,Ego - View或为泛化关键。

五源资本 5Y Capital
新闻资讯7

DeepSeek母公司去年进账50亿,够烧2380个R1

R1问世一年,DeepSeek无新融资和商业化动作,但AGI成果不断。其母公司幻方量化去年赚50亿,为研发提供资金。对比靠融资和变现的OpenAI,DeepSeek坚守AGI初心,团队稳定,还让股民借其论文获利。

量子位
新闻资讯7

北大校友孙之清C位出镜,小扎看OpenAI直播夺人!1亿刀薪酬光速被签

CoT之父Jason Wei离职后,又一华人科学家孙之清入职Meta。他曾在OpenAI与奥特曼同框直播,此前深度参与o3等项目,还带头做「ChatGPT Agent」技术实现。加上Jason Wei等,三人都加入Meta。

新智元
开源动态8

写Verilog、调CUDA,总翻车?工业代码大模型开始学会「先想后写」了

工业代码大模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思考深度,且模型与代码已开源。

机器之心
开源动态7

LM Studio宣布支持在Mac上跑Qwen3-Next 80B模型

LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。

AI工程化