模式感知推理」共找到 3108 篇相关文章

产品应用8

震惊海外开发者!BOSS直聘3B小模型比肩80B,怎么做到的?

BOSS直聘楠北阁团队发布3B轻量端侧小模型Nanbeige4.1-3B,性能震惊海外开发者。团队从多方面改进,如优化推理和偏好对齐,重构训练数据,采用多种强化学习算法,使其性能比肩大模型。

AIGC开放社区
产品应用7

对话心光:在技术与需求的十字路口,我们选择用AI温暖人心

本文是对心光创始人王禹效和徐璐的访谈。心光是笔记类AI陪伴产品,主界面简洁,功能丰富。团队回顾其发展历程,探讨技术与需求关系、模型选择、用户画像等,还谈及盈利模式、创业时机及未来计划。

AI科技评论
新闻资讯7

IMO题库“过时”了!OpenAI内部模型挑战最新First Proof,做了7天错了一半

谷歌发布Gemini 3 Deep Think爆火后,OpenAI用未发布内部模型,一周内尝试解答10道来自数学家科研现场的真实问题,5道基本正确。这些题取自真实研究,切断模型“背答案”可能,意味着自主推理能力进化。

量子位
新闻资讯8

Anthropic CEO Dario Amodei 访谈:我们正在接近指数的终点

Anthropic CEO Dario Amodei 三年前预测基本兑现,此次访谈更放豪言,称 1 - 3 年内有 50% 概率出现“天才之国”,10 年内 90% 确信。访谈覆盖诸多关键问题,如 Scaling 原理、AI 编程生产力、AI 公司盈利模式等。

宝玉AI
产品应用8

整整21个月,豆包大模型正式进入2.0时代!

时隔21个月,豆包大模型2.0正式推出。它在多模态理解、企业级Agent、推理和代码能力上有提升,在多个基准测评中达业界最优。实测显示其在编程、数学问题处理上性能出色,性价比也具优势。

量子位
产品应用7

Chaterm Agent Skills + 千问大模型,智能运维再进化

文章介绍Chaterm Agent Skills与千问大模型结合用于智能运维。它能将运维经验打包成技能,提供三种模式,缩短运维时间。文中还阐述了技能概念、工作原理、技术实现及实战案例,鼓励用户尝试创建技能。

阿里云开发者
算法论文8

视听分离SOTA提速6倍!清华发布首个6M高性能模型|ICLR'26

清华大学团队推出Dolphin模型,仅用6M参数,通过离散化视觉编码和热扩散注意力机制,实现单次推理精准分离语音,速度提升6倍以上,在多项基准测试中刷新纪录,为端侧设备部署开辟新路。

新智元
推荐文章8

AI 编程别光凭感觉:手把手实操 SDD,把 Vibe Coding 拉回工程轨道。

在AI编程中,“Vibe Coding”模式在大型项目上存在弊端,易带来架构不一致等问题。规范驱动开发(SDD)应运而生,它将重心移到“定义规范”。文章介绍了SDD理念、工具、流程,还给出实操步骤与落地建议。

AI大模型应用实践
产品应用8

参数破万亿!阿里Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布总参数超万亿的Qwen3 - Max - Thinking,预训练数据规模达36T Tokens。在多项权威测试中表现优异,能与顶级闭源模型竞争。引入两项核心创新,千问App等已上新,网友认可其能力与更新速度。

AI前线
新闻资讯8

再募 150 亿美元,拿走全美 18%的风投资金,3 万字长文聊聊 a16z 是怎么运转的?

a16z 又募资超 150 亿美元,独占 2025 年美国风投基金总募资额 18%以上。它投中众多独角兽,业绩出色。文章剖析其发展历程、投资哲学和运营模式,指出它正进入第三时代,要引领行业和国家发展。

Founder Park