「端到端模型」共找到 9109 篇相关文章
打破视频推理「先看后想」惯性,实现真正的「边看边想」丨CVPR'26
现有大型视觉语言模型(VLM)在实时场景表现不佳,宁波东方理工大学沈晓宇团队提出TaYS,让VLM从“帧文交错”切换到“并行”,实现“边看边想”,在准确性和延迟上表现出色,推动VLM走向更真实应用。
Claude Cowork 解读和 Open-Cowork开源实现
Claude Cowork是Anthropic推出的AI工作代理工具,可操作文件、执行长期任务,现处研究预览阶段。因使用门槛高,GitHub出现开源项目Open - Cowork,零代码门槛、多模型支持,有文件管理等功能。
开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval
8月13日,DeepSeek开源Agent Harness dsh引发行业对“Harness”的关注。近日,MirroS联合多机构发布HarnessEval,将其概念引入评测系统。它使评测从Metric到Harness,形成可执行评测系统,已落地于交互式世界模型。
没有头,没有脚,还能三折叠,周衔团队发布首款「非人形」机器人
机器人创业公司Genesis AI发布首款通用机器人Eno,它是轮式且配机械臂,无腿无头部,外壳颜色可定制。其由自研模型GENE驱动,预计2026年Q4发货,落地从工业到生活场景。
8K Star!给所有 AI 编程工具加个智能调度中心,节省 20-40% Token!
AI编程圈火了个工具9Router,它是智能调度中心,能连接主流编程工具,自动路由到40多家AI提供商和100多个模型,自带RTK Token节省器,还有实用的三级降级机制,安装配置简单。
开源「活人感写作.skill」,只为帮你写出没有AI味的文字。
作者开源活人感写作.skill,旨在帮大家写出无AI味文字。它适配多种模型和产品,鼓励用真实经历创作,除了去除辞章端AI口癖,还会激发思想、验证事实,让大家保留自我。
硅谷的「十万大裁员」:Meta按代码量裁员
2025年,AI浪潮席卷硅谷,引发新一轮裁员潮。从互联网巨头到初创企业,纷纷边裁边招,将资源转向前沿大模型。基层岗位被自动化压缩,顶尖AI人才需求飙升,裁员是职位版图重塑的前奏。
斑马智行,开启汽车主动智能时代|甲子光年
2025年WAIC上,斑马智行联合通义及高通,首发行业首个基于高通8397平台的端侧多模态大模型解决方案。该方案让智能座舱从“被动响应”到“主动感知”,还打通产业链,实现多方面适配。
Google 推出超小杯 AI:Gemma 3 270M!可进手机和浏览器
Google发布Gemma 3家族最小版本Gemma 3 270M,2.7亿参数,能耗低,在同规模模型中表现突出。设计理念是“够用就行”,适合特定任务,已在多平台发布,开源策略效果好。
鼠标点3下就能锁定打击?五角大楼曝光美军AI大脑
美国国防部首席数字与人工智能官Cameron Stanley演示Maven系统,将美军杀伤链从小时压缩到分钟。Maven整合多系统,Palantir的AIP嵌入大模型改变战争决策逻辑。Anthropic因坚守安全红线与五角大楼冲突。