文档视觉编码器」共找到 1290 篇相关文章

新闻资讯7

OpenAI搬空Claude Code!用户家当一键进Codex,唯独带不走Claude

AI编程大战中,OpenAI盯上对手用户的配置、技能等“家当”。8月11日其统一外部智能体导入说明,可将Claude Code等工具配置等搬入Codex,但只能进不能出,且部分内容无法迁移。

新智元
产品应用7

The Batch: 964 | Claude 亮相另一款 Opus

Anthropic发布Claude Opus 5,这是款视觉 - 语言模型,运行成本低,多任务表现优于Claude Fable 5。它在多项测试中领先,解决了Fable 5的一些问题,但也有易产生幻觉等不足。

DeeplearningAI
新闻资讯7

四大AI手搓蒙娜丽莎!8次临摹,最像那版全被自己改没了

AI工具平台TryAI搭建「绘画竞技场」,让GPT - 5.6 Sol等四个视觉模型临摹蒙娜丽莎等,记录实验过程。结果显示,模型最终作品不如中途最佳版,且成本差异大,工具使用方式不同。

新智元
算法论文8

AI 会笑吗?BIGAI & 上交大团队:多模态大模型是否真的能 get 到视频笑点|ACL 2026

上海交通大学等团队构建v-HUB评测基准,分析多模态大模型视频幽默理解能力。评测7个前沿模型发现,模型依赖文字、主动发现笑点能力弱,声音作用有限,还需考虑隐形线索。

AI科技评论
算法论文8

ICLR 2026 | ProSafePrune:一剪见效,告别大模型过度防御

合肥工业大学与科大讯飞联合团队提出全新低秩参数修剪框架 ProSafePrune,被 ICLR 2026 录用。它能精准定位模型认知偏差并修剪,降低过度拒绝率,不损安全防御能力,还提升通用任务性能,为 LLM 安全部署提供新思路。

机器之心
开源动态7

用Claude Code剪视频,自动去口癖、加字幕、调色,完全免费开源

browser - use团队开源Claude Code技能video - use,可自动去口癖、加字幕、调色等。它通过转录文本和按需视觉合成图让LLM理解视频,有完整流水线和设计原则,还给出使用方法。

AI寒武纪
新闻资讯7

Zendesk:生成式 AI 让代码不再稀缺,研发瓶颈转向“吸收能力”

Zendesk 提出生成式 AI 改变软件交付核心制约因素,从编写代码转为‘吸收能力’。文章阐述该概念,提出四项应对措施,还指出 AI 对不同系统的影响,深化了编码非瓶颈的观点。

InfoQ
8

Claude Design暴击设计行业!Figma、Adobe市值闪崩

Anthropic Labs推出AI原生视觉设计协作平台Claude Design,由Claude Opus 4.7驱动,向Adobe等设计软件巨头发起挑战。它有三大杀手级功能,能大幅提高设计效率,引发资本市场震动。

量子位
新闻资讯7

Claude Opus 4.7深夜上线,评分碾压

周四晚间,Anthropic 宣布 Claude Opus 4.7 全面上市。它在高级软件工程、视觉效果上表现出色,多项基准测试优于 Opus 4.6。还具备新特性,如自动模式等,安全性能与 Opus 4.6 相似。此外,Anthropic 还有相关更新。

机器之心
产品应用7

阿里“快乐马”团队再出手!正面叫板谷歌 Genie 3,世界模型 HappyOyster 来了

4月16日,阿里发布世界模型产品HappyOyster,由ATH创新事业部团队研发。它与谷歌Genie 3同属世界模拟器流派,采用长跨度世界演化建模,有漫游和导演两大核心能力,在多方面呈现差异化优势。

AI前线