「新推理模型」共找到 9817 篇相关文章
CVPR 2026 | 1000万段驾驶视频,教会模型如何估计相机位姿
Wayve的LA - Pose研究,不依赖百万级3D标注,从约1000万段未标注驾驶视频自监督学习‘潜在动作’,再用少量3D标注微调,转化为相机位姿估计能力,在多基准上提升精度且泛化能力强。
构建分层的 Agentic RAG 系统:具备自主纠错的多模态推理
企业 AI 团队面临 RAG 系统在处理结构化与非结构化数据时的难题。本文探讨用分层多智能体编排解决“模态鸿沟”,介绍 Protocol - H 架构,阐述组件、机制、实现与集成,经基准测试验证其优势,还提及未来研究方向。
QCon 2026 北京站收官:以 AI 之力,重塑软件工程新生态
4月16 - 18日,QCon全球软件开发大会·北京站(2026)举办,超2000人参与。极客邦赵钰莹点明企业AI落地要点;黄东旭等专家分享见解,探讨软件变革、安全等;还有25个专题及展区展示,后续接力6月上海AICon。
Life of a Token:像调试代码一样看懂大模型如何生成 Token
文章类比 Chrome 的 Life of a Pixel,追踪 LLM 里 token 从输入到输出的全程。以 GPT - 2 Small 为例,详细讲解其管线各阶段,如 Tokenization、Embedding 等,还介绍了残差流、KV Cache 等概念及 GPU 性能瓶颈和优化方法。
OpenAI发布GPT-5.4:首个原生接管电脑通用模型
OpenAI发布GPT-5.4及满血版GPT-5.4 Pro,主打专业生产力。它具备原生电脑操作能力,视觉感知、职场任务表现提升,幻觉问题被压制,代码能力强,工具调用机制优化,已在ChatGPT等全量上线,API定价上调。
每周产业洞察 | 腾讯“元宝派”开启AI社交视听新时代?
北京AIGC视听产业创新中心位于朝阳区东坝乡,是朝阳区推动影视制作基地建设的重要举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚近百家生态伙伴。首创郎园拓展服务边界,项目延伸多地。
感觉这次扣子 2.0 触碰了模型和工程的天花板
2026 年,真正好用的 AI Agent 应能拆解目标、推进过程和交付验收。扣子 2.0 正式发布,从“给指令的工具”变为“能干活的工作伙伴”,有技能和长期计划两大核心升级,还具备扣子编程功能,拓宽了 AI 能力边界。
不用拍的广告片?深度拆解美团闪购AIGC营销新案例
美团闪购与AI达人共创两支AIGC营销视频,以“技术为品牌说话”。“西游篇”突出“快”,“神话篇”展示“多”,用AI生成“超现实”场景包裹品牌价值,为行业提供营销示范。
中文互联网“build in public”的新实验,为什么会是AMA?
文章探讨小红书上AMA形式爆火的原因。它与Reddit不同,得益于小红书平权分发、垂直推荐、轻量化设计等特点。AI圈因开源精神成首批用户,AMA为双边提供价值,还让小红书向专业领域拓展。
OpenAI引爆新赛道:AI不再卖技术,而是卖「活人感」!
一段小女孩与AI玩具深情告别的视频走红,揭示对话式AI融入人类情感世界。声网Convo AI&RTE 2025大会指出对话式AI将成下一代AI Infra重要部分,情感陪伴、智能硬件、在线教育将率先规模化落地。