「AI推理模型」共找到 13794 篇相关文章
AI 时代,重新定义开发者丨最新白皮书解读
AI时代开发边界被重定义,更多非传统开发者用AI工具解决业务问题。知乎等发布白皮书,揭示新时代开发者画像、核心焦虑,还讲述其认知飞轮及案例,展现AI对开发的变革。
刚刚,DeepSeek首曝V3降成本秘诀!软硬协同突破Scaling天花板
DeepSeek最新论文从硬件架构和模型设计双重视角,探讨如何相互配合实现低成本大规模训练和推理,分析硬件特性对架构选择的影响,研究两者相互依赖关系,还为未来协同设计提出建议。
Poe:DeepSeek使用率下降50%,快手崛起、OpenAI暴涨
2025年春季,Poe发布AI模型使用趋势报告。DeepSeek使用率降超50%,OpenAI因文生图功能暴涨。文本、视频、推理、图像和音频5大领域中,各模型表现不一,如快手Kling家族、谷歌Imagen 3家族等有亮眼表现。
LLM又曝致命缺陷:根本不会看时钟!博士惊呆,准确率不及50%
最新研究揭示AI存在认知缺陷,读取时钟准确率仅38.7%,判断日历日期准确率26.3%。研究者构建测试集考察MLLM能力,虽部分模型有亮点,但整体表现不佳,凸显训练数据和推理方式改进需求。
Qwen3又又又发布了新模型~~~
Qwen3团队继发布`Qwen3-235B-A22B-Instruct-2507`和`wen3-235B-A22B-Thinking-2507`后,又发布`Qwen3-Coder-30B-A3B-Instruct`。该简化模型性能和效率出色,有多项关键增强功能,且是非思考模型,输出效率高。
与Gemini Diffusion共振!首个扩散式「发散思维链」来了
西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型。
从“工具”到“同事”——AI 时代的产品进化
在QCon 2026北京站,苏杰让AI数字分身演讲,探讨AI时代产品进化。从产品、组织和个人层面判断未来趋势,介绍产品新形态、创新方法,还提及组织和个人应对策略,分享用AI准备演讲的体验。
Anthropic新模型偷「吃瓜」!最强Fable 5爆冷
Anthropic提前曝光两个新模型claude-mashmallow-eap和claude-melon-eap,早期实测Marshmallow更佳。此前上线的最强Fable 5爆冷,企业调用少,营收低,其弟Opus 5反而胜出,开源模型也在抢占份额。
AI自动生成工作流,n8n官方出品
AI自动生成工作流成趋势,n8n官方已支持该功能。新建工作流时点击“Build with AI”,用自然语言告知需求,AI会搜索节点并连接成工作流。目前仅云端版可用,使用需切换到最新测试版。
FutureHouse 联合创始人:AI Scientist 不是“全自动化科研”
FutureHouse 由 Google 前 CEO 资助创立,今年 5 月推出四个 AI 科研 agent,6 月宣布 AI 系统 Robin 发现新药。联合创始人 Andrew White 表示,AI Scientist 并非‘全自动化科研’,生物比化学更具‘平台化’潜力,团队聚焦科研自动化。