「3D效果」共找到 2835 篇相关文章
AI看图一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华
随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看图方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。
百度端侧大模型安全建设实践:在算力与保障之间找到平衡
在 QCon 全球软件开发大会上,百度李志伟分享端侧大模型安全建设实践。介绍其发展趋势、优势与应用场景,指出面临隐私、内容等安全挑战,阐述云端与端侧安全方案,通过案例展示优化效果,展望未来安全建设方向。
真·开外挂!MIT新研究:架构0改动,让大模型解锁千万级上下文
MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理能力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。
Cursor 重新定义 Agent:脑子再大,不如会翻书。
Cursor 分享博客指出,Dynamic Context Discovery 效果远好于 long context 方式,开启动态上下文可使总 Token 消耗降 46.9%,还能减成本、降延迟、提准确率,但也存在成本转嫁、工程复杂度高和安全风险等问题。
Qwen负责人转发2025宝藏论文,年底重读「视觉领域GPT时刻」
2025年末,Qwen大模型技术负责人林俊旸转发谷歌DeepMind入选ICCV 2025的论文,指出视觉领域“GPT时刻”要来了。研究用实验数据证明,视频模型正跳出任务专属局限,实现一个模型完成多视觉任务,推理过程还能被CoF“演”出来。
告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质
南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。
赢家诅咒?英伟达暴跌背后的泡沫之辩
11月3日至28日,英伟达股价跌幅近15%,黄仁勋有危机意识。同时谷歌股价涨超13%,Gemini3.0重建投资者信心。行业面临‘Scaling时代终结’论断,围绕英伟达GPU折旧周期有争议,TPU路线现曙光,国产算力加速替代。
产品经理起飞!Google AntiGravity升级Nano Banana Pro,AI编程真的牛逼了
作者用Google新发布的AntiGravity生成海报,其升级增加Nano Banana Pro能力后效果惊人。作者展示了用它生成高保真原型图、用户故事地图、用户旅程地图等案例,还提及更多应用场景及使用建议和限制。
清华、北大,上海交大等发布人机协同训练框架,让机器人零样本学会新技能
清华、北大等发布人机协同训练框架MotionTrans,能让机器人零样本学会新技能。它将人类数据翻译成机器人语言,构建数据集,经格式转换、速度调整等处理后训练模型,实验验证其有效性,且数据、代码和模型已开源。
钉钉不说话,默默把 AI 表格干到了 1000 万热行
钉钉 AI 表格单表容量突破 1000 万热行,成业内首个实现该能力的智能表格。它基于阿里 AI 技术重构底层架构,实现性能与智能融合,在业务场景应用效果好,推动 AI 办公进入‘原生时代’。