「可动三维模型」共找到 10067 篇相关文章
马斯克AI女友直播「一秒变身」,Karpathy看完立刻投钱
世界首个支持直播推流的「实时」扩散AI视频模型MirageLSD诞生,大神Karpathy亲自站台。它能理解真实视频后同步生成AI视频,实现零延迟、无限时长、每秒24帧不卡顿,给视频娱乐和直播互动带来丰富想象。
基于 Qwen3.8-Max 构建 AI 合同精审系统:文档解析、多轮条款分析 Pipeline 工程实战
本文分享基于Qwen3.8-Max大模型+Python Flask搭建AI合同精审系统的完整工程实战,包含环境配置、项目架构、核心模块开发,记录开发踩坑经验,附AI与人工审查的实测对比数据,适合中小企业合同初审使用。
把事实核查嵌入诊疗流程:MedGuard给「诊疗安全」当守门人
蚂蚁AI安全实验室与厦门大学团队联合提出MedGuard,将医学事实核查嵌入诊疗流程。它是医疗安全基础设施,在诊疗意见等形成前验证事实,在评测和临床评价中表现突出,能准确判断风险边界,可嵌入医疗流程。
流式意图检测+永久记忆,NUS&NTU发布Pask:把贾维斯AI拉进现实
南洋理工大学谢之非团队提出Pask,采用「底层小模型流式意图检测」+「上层Agents执行」架构,实现实时、有深度、基于个人全局记忆自进化的主动智能体。它包含需求检测、长期记忆和主动系统模块,经测试效果良好。
OpenAI 开发者的 Skill 经验:如何使用评估系统来优化 Skill
文章聚焦 OpenAI 开发者优化 Skill 的方法,指出迭代 AI 技能效果难测,可借助评估系统。介绍了用 Codex 评估的流程,包括明确标准、创建技能、手动触发找漏洞等,还提及不同阶段的评估重点和工具。
把大厂 10 年的职场经验,做成了一个「Coze Skill」—— 扣子 2.0 深度实测
作者实测扣子 2.0,介绍其「技能商店」功能,可将专家方法论封装成技能供调用。通过简历诊断、画架构图、生成 GEO 稿件三个场景展示提效作用,还提及「长期计划」功能,称扣子定位职场 AI,降低使用门槛。
腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?
最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。
智能体的记忆管理机制及其潜在风险 | 直播预约
大语言模型(LLM)智能体兴起,记忆机制是核心。本次报告将探讨记忆管理对其性能的影响及潜在风险,展示缓解关键挑战的策略,介绍新攻击范式,揭示安全漏洞,强调需重新审视与建模。
倒反天罡!Gemini Flash表现超越Pro,“帕累托前沿已经反转了”
Gemini 3 Flash在SWE - Bench Verified测试中分数超Pro,速度和性价比也更优。谷歌解释是因Flash有未用于Pro的优化技术。开发者认为应停止‘旗舰版迷信’,强化学习让小模型也能实现‘降维打击’。
朱啸虎投的第一个AI硬件公司,又完成一轮融资
AI眼镜创业公司Gyges Labs完成Pre A+轮融资,此前由朱啸虎的金沙江创投领投。其CEO邓旭东提出“Glass First”理念,以自研技术DigiWindow实现极致外观,还以“功能减法”换“体验加法”,未来将布局可穿戴设备。