结构化推理」共找到 3025 篇相关文章

新闻资讯8

腾讯云与 Gartner 联合发布“Data+AI”白皮书,各行业领军企业分享最佳实践

6月27日,腾讯云联合Gartner发布《Data+AI,下一代数智平台建设指南》白皮书。指出GenAI时代数据变大,腾讯云打造原生一体Data+AI平台DIaaS,多位技术大咖分享其赋能企业数智转型实践。

InfoQ
产品应用7

消费级显卡跑大模型训练门槛再降:Qwen3-1.7B强学习只需5GB显存

消费级显卡跑大模型训练门槛再降,Unsloth AI的FP8精度强学习方案让Qwen3 - 1.7B的GRPO训练只需5GB显存且性能无损。该方案与TorchAO合作,有推理优势,还在内存优等方面表现出色。

AI工程化
产品应用8

小模型,大能量!200美金的GPT Pro竟然输给了它?

博主用11个场景深度测试昆仑万维的Skywork R1V4 - Lite,它能做到Gemini 2.5 Pro才能干的事,速度快、成本低。在定位、人物识别、生活实用、专业鉴定、学术研究等场景表现出色,核心突破在于主动图像操作与深度推理

AI产品黄叔
新闻资讯8

Agent 原生开发时代到来,Google Cloud Next 26 给开发者带来了什么

Google Cloud Next 26 大会热度高涨,反映行业对 Agent 原生时代的关注。Google Cloud 展示了云产业从 Cloud Native 到 Agent Native 的三层同步转换,还推出一系列 Agent 开发和管理套件,解决开发者关键问题。此外,大会亮点 A2UI 解决交互层 Agent

AI科技大本营
开源动态8

DeepSeek 模型技术之旅:从 V3 到 V3.2

本文深入剖析了 DeepSeek 模型从 V3 到 V3.2 的技术演进,对比了基座与推理模型,介绍了架构、训练方法变,如 V3.2 结合 MLA 与 DSA,更新奖励和 GRPO 算法,还提及 V3.2-Speciale 扩展思考特性。

深度学习自然语言处理
新闻资讯8

云计算一哥,给 Agentic AI 工程做“减法”

2025 年亚马逊云科技 re:Invent 大会聚焦 Agent,其首席执行官提出未来各领域将运行数十亿 Agent。该公司欲在 Agentic AI 上重构,推出系列工具,如 Amazon Strands Agents SDK、Amazon Bedrock AgentCore 等,还在模型训练和工程方面做减法。

InfoQ
新闻资讯7

田渊栋被裁后新offer排到法国!原来Llama 4.5训完后被卸磨杀驴了

Meta此次裁员引发诸多争议,工作超十年的田渊栋整组被裁。有说法称是因没做出基于Llama 3的推理模型,但田渊栋否认。Llama 4.5训练好后团队被裁,且后续还将裁风控部门。不过田渊栋获多家公司青睐。

量子位
新闻资讯7

AI 狂潮中,电子业破局:国产先进封装加速突围

AI应用渗透使算力需求结构重塑,传统芯片技术升级遇阻,先进封装技术成关键。文中介绍DeepSeek架构突破、DeepSeek - R1算法革新,分析其对算力需求的影响,指出高性能算力芯需求仍高,先进封装能释放芯片性能,国产有望突破。

芯师爷
算法论文7

让AI创作不千篇一律,提示词随机插词汇就行

最新研究发现,在AI开写前由人类提供开头或随机插入词汇,写作效果会更多样,AI写作同质或因“启动条件”问题。研究创建三类同质评价指标,还发现向系统提示注入随机词汇可提升模型输出多样性。

量子位
新闻资讯8

用 Astra+Codex 干掉 CUDA!奥特曼9个月AI造芯反杀英伟达 GB300

北京时间昨日凌晨,OpenAI 公布自研推理芯片 Jalapeño 实测结果,其在多指标挑落英伟达 GB300。OpenAI 用 GPT - 6 和加强版 Codex 造芯,9 个月完成硬件设计优,3 个月搞定软件栈,威胁英伟达 CUDA 根基。

AI前线