「推理能力提升」共找到 6171 篇相关文章
Grok最新模型吃上Cursor「加餐」,马斯克:Coding实现巨大改进
马斯克在X上透露,xAI的Grok基础模型V9 - Medium(1.5T)完成训练,预计2 - 3周后发布,训练加入大量Cursor数据。同时,xAI的AI编程代理工具Grok Build进入早期Beta测试阶段。
中国AI创业者重登GTC舞台:杨植麟用技术语言讲了一个智能上限突破的浪漫故事|甲子光年
美国当地时间3月17日,月之暗面(Kimi)创始人杨植麟在英伟达GTC演讲,介绍Kimi技术路线图。他提出开源模型要出色,给出Token效率、长上下文、智能体集群三个概念,还探索了未来架构,且将创新开源。
OpenAI Codex 负责人:懂底层是没被淘汰的唯一底牌,顶尖工程师的终极归宿是“代码审查员”
OpenAI Codex 负责人 Michael Bolin 分享职业经历,从 Meta 底层架构工作到加入 OpenAI。他指出 AI 时代工程师角色转变,懂底层是不被淘汰的底牌,还给出提升能力的建议。
模型砍掉一大半,准确率反升15%!华科&阿里安全新研究实现ViT近乎无损的类特定压缩|ICLR'26
华中科技大学联合阿里安全部提出Vulcan方法,一改传统压缩策略,通过“先训练再剪枝”实现ViT近乎无损的类特定压缩,为大模型服务小场景提供新路径,论文已被ICLR 2026接收。
Karpathy:20年的编程生涯几周之内被颠覆,80%由AI来写,Claude和Codex跨过某种一致性门槛
OpenAI创始成员Andrej Karpathy分享用Claude编程心得,工作流从80%手动变为80%由AI完成,阐述AI编程优缺点、影响,还对行业未来提出疑问,认为2026年是充满能量的一年。
谷歌工程师抛出5个残酷问题:未来两年,软件工程还剩下什么?
谷歌工程师 Addy Osmani 提出 5 个或在 2026 年前重塑软件工程的关键问题,涵盖初级开发者、技能、角色、专才通才、教育等方面,每个问题有两种走向,并给出对应应对建议。
吴恩达:图灵测试不够用了,我会设计一个AGI专用版
AI大神吴恩达2026年要做新的图灵-AGI测试,弥补AGI定义无统一标准、现有基准测试易误导大众的空白。该测试聚焦AGI经济性和实际产出,能更好衡量AI通用能力。
劈柴哥玩得上头!Nano Banana Pro 真杀疯了,但谷歌没接住用户的付费热情?
谷歌推出新图像生成与编辑模型 Nano Banana Pro,它基于 Gemini 3 Pro,能力提升,获大量好评。不过付费流程繁琐遭吐槽。此外,谷歌 CEO 回应了 AI 泡沫、岗位影响等问题。
AI 智能体未来之争:是迷你应用(GPTs)?还是模块化代码(Skills)?开发者,你站哪边?
Anthropic 公布全新 Skills 功能,让开发者可通过模块化组件扩展 Claude 能力,功能覆盖网页、代码环境及 API 接口。它与 OpenAI 的 GPTs 等不同,更强调透明可审计,受开发者称赞。
vLLM PIECEWISE CUDA Graph 技术学习笔记
文章围绕vLLM PIECEWISE CUDA Graph技术展开,介绍了vLLM Compilation架构、分片编译技术、算子融合、集合通信融合、编译缓存、装饰器系统等内容,PIECEWISE技术让vLLM在prefill阶段性能提升。