可穿戴物品」共找到 4032 篇相关文章

开源动态8

Qwen-Scope:看穿大模型的“小心思”

Qwen-Scope是基于Qwen3和Qwen3.5系列模型训练的解释性模块,通过在隐藏层插入SAE提取解释特征。它能分析模型行为、优化模型,应用于推理、数据、训练、评估等场景,前往Huggingface或魔搭体验。

千问大模型
产品应用8

拯救P图废柴,阿里上新多模态模型Qwen-VLo!人人免费

昨夜阿里推出全新多模态模型Qwen-VLo,在原有能力上全面升级,有细节捕捉、图像编辑、多语言支持等亮点,不受固定格式限制。官方demo展示多种玩法,目前免费玩,实测其编辑能力不错。

量子位
开源动态8

7,700+ star 微软 SkillOpt 以训练的Skill

微软研究院开源了SkillOpt(7700+ star),把Skill文档当成‘训练的权重’来优化。它有独特的6阶段流水线、核心验证门控、Protected Regions机制,还有SkillOpt - Sleep预览功能,让Skill文档系统化训练。

CourseAI
推荐文章7

对话 Roto:让视频实时交互、足够个性化,我们要做 AI 时代的 Netflix

Roto定位是全球首个互动开放世界视频平台。创始人David Xu曾就职独角兽企业,涉足多模态生成。团队经多次方向调整,决定大胆探索极致创新。目前产品技术不成熟,但已探索新内容形式,还将在广告实现商业闭环。

Founder Park
新闻资讯7

一键分享=全网公开?Claude 被曝聊天记录在谷歌直接搜到

2026 年 7 月 26 日,Reddit 用户称用谷歌站点检索语法能调出 Claude 用户共享对话记录。因 Claude 未补全防护配置,致用户加密资产、身份等信息泄露。此前 OpenAI、Grok 也有同类问题,社区呼吁平台完善防护体系。

AI科技评论
开源动态7

比NotebookLM更好的「开源播客」,根据多模态内容生成30分钟以上播客音频。

Podcastfy是开源Python工具,能把文本、图片等多模态内容,借生成式AI转化为播客。它支持自定义,适配多种语言和文本转语音模型,能生成2 - 5分钟或30分钟以上的播客,使用体验比NotebookLM好。

开源AI项目落地
开源动态8

数据减少超千倍,500 美金就训练一流视频模型,港城、华为Pusa来了

香港城市大学与华为香港研究所合作推出 Pusa 项目,它基于 FVDM 理论,极低成本微调大规模预训练视频模型,成本降超 200 倍、数据减少超 2500 倍,代码已开源。

机器之心
算法论文8

116页论文教你「蒸馏」Claude、GPT-5.6:AI社区今天炸了

一篇前沿大模型安全漏洞论文引发热议,指出各大模型 API 设计缺陷,提取隐藏思维链。同一模型家族安全能力不对称,攻击者利用此漏洞,还介绍了攻击路径、实验及修复建议。

机器之心
算法论文8

UserBench 与 UserRL 带来的交互智能范式转向

当下大模型在与用户交互时存在不足,来自UIUC与Salesforce的UserBench和UserRL两篇新作,将‘用户价值’量化,把‘测的交互’转化为‘训练的策略’,从评测和训练层面推动模型向‘懂用户’转变。

深度学习自然语言处理
开源动态8

Transformer开始构建三维世界:开源模型几张图片秒级生成探索3D场景

影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量图片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。

机器之心