多视图输入」共找到 4263 篇相关文章

算法论文8

低Token高精度!字节复旦推出自适应推理框架CAR

字节与复旦大学研究人员提出自适应推理框架CAR,能根据模型困惑度动态选短答或长推,在基准测试中平衡了准确性与效率,打破长文本推理必然性能更好的认知。

量子位
开源动态8

开源即屠榜!UniME模态框架登顶MMEB全球训练榜,刷新项SOTA纪录

格灵深瞳等团队联合发布通用模态嵌入新框架UniME,刷新MMEB训练榜纪录。它是两阶段框架,经文本判别知识蒸馏和困难负样本增强指令微调,在任务达SOTA,项目已开源。

量子位
开源动态7

开源 DeepSeek Harness 开箱即用客户端,还有几个易用插件

DeepSeek 发布了 DeepSeek Harness,坚持‘一切皆插件’理念。不过它使用门槛偏高,作者做了 Pilot Harness,优化 UI 与交互,添加侧边栏和文件树、服务商配置插件,还支持系统。

歸藏的AI工具箱
产品应用7

全球首个跨本体、跨视角、模态物理世界模型,CurrentWorld-0 来了!

Current Robotics 发布跨本体、模态物理世界模型 CurrentWorld-0,它从真实数据学规律,整合跨本体、视角和力触预测,可评测机器人,解决动作可控性等问题,让评测成训练数据入口。

机器之心
产品应用7

把X接进Codex:AI终于有了自己的信息雷达

作者将X接入Codex,通过官方MCP直接调用X API获取数据。这让AI OS有稳定实时信号输入,成为主动工作系统。介绍接入步骤、费用及使用建议,如先跑小任务。

newtype AI
新闻资讯7

入职Meta的吴翼,清华叉院官网已撤其教职信息

吴翼加盟Meta引发关注,目前清华叉院官网已撤其教职信息。他有丰富学术与产业经历,曾在机构实习、任职,成果颇丰。叉院允许教职人员产学“双栖”,但Meta情况特殊。

量子位
开源动态8

腾讯混元开源游戏AI生成新工具!RTX 4090就能制作3A级动态内容

腾讯开源游戏视频生成框架Hunyuan - GameCraft,基于混元视频生成搭建,操作简单,输入单张场景图、文字描述和动作指令就能生成高清动态游戏视频,解决传统工具瓶颈,性能优于主流模型。

量子位
产品应用7

谷歌 Apigee 添加了内置的 LLM 治理 Model Armor

谷歌云推出 Model Armor 公开预览版,这是集成到 Apigee API 管理平台的 LLM 治理框架。它能执行特定策略,检测种风险,支持 LLM 提供商,还与 GKE 和 Security Command Center 集成。

InfoQ
新闻资讯7

OpenAI反挖四位特斯拉、xAI、Meta高级工程师,目标星际之门

本周二消息,OpenAI从特斯拉、xAI、Meta等公司挖来四位工程师加入扩展团队,该团队负责“星际之门”项目,构建AI基础设施。此前Meta挖走位OpenAI员工,OpenAI承诺正面交锋。

机器之心
开源动态8

Claude团队打开大模型「脑回路」,开源LLM思维可视化工具来了

Claude团队推出“电路追踪”工具,可生成归因图呈现LLM处理信息路径,支持在主流开源权重模型上快速生成。研究人员能借此解码LLM“决策逻辑”,官方还给出语言电路等示例。

量子位