任务感知能力」共找到 4751 篇相关文章

产品应用8

超越Runway!Adobe发布新神器:P视频比P图还简单

Adobe联合多高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习能力和知识迁移,其效果超Runway,还展现涌现能力

新智元
算法论文8

上海AI Lab新研究:SFT能泛化,只要满足这三个条件

上海人工智能实验室等团队研究指出,“SFT泛化能力差”定论有局限。SFT泛化能力受优化过程、数据质量与结构、模型基础能力共同制约,研究还揭示其训练中的现象及副作用。

量子位
产品应用7

文档解析OCR全新升级,追平Gemini2.5pro,超越MinerU、碾压Qwen2.5VL-72B

CourseAI介绍PP - StructureV3实战、能力、性能与架构。它在通用版面解析等方面能力强,更新PP - OCRv5提升准确率,超主流OCR方案,轻且速度快,但遇特殊情况需重新训练。

CourseAI
算法论文7

多模态推理新基准!最强Gemini 2.5 Pro仅得60分,复旦港中文上海AILab等出品

现有多模态大模型benchmark对逻辑推理理解不足,复旦大学等单位提出MME - Reasoning评估其推理能力。对30 + 模型评测,最优得分仅60%左右,反映出模型多方面推理短板。

量子位
新闻资讯8

Claude 4发布!世界最强编程模型来了

Anthropic发布Claude 4家族,含Claude Opus 4和Claude Sonnet 4,代码能力强,重新定义AI编程助手能力边界。有新功能,企业认可,Claude Code上线,记忆能力提升,立即可用且价格不变。

AGI Hunt
产品应用8

这个 Agent Team,终于不是"角色扮演"了

作者测试了 MiniMax 新出的 Agent Team,通过深度研究公司、整理会议逐字稿、做直播数据分析三个测试,展现其优势。指出 Agent Team 核心是对抗式质量门禁,是复杂任务兜底系统,而非简单 prompt 编排。

AI产品黄叔
新闻资讯7

刚刚,Anthropic王炸Claude泄露!全面碾压Opus 4.6引爆全网

因「人为配置」错误,Anthropic最强模型Claude Mythos细节泄露。它编程、推理能力超Claude Opus 4.6,还具备网络攻防能力,但也带来安全风险,Anthropic因担心被黑客利用暂未发布。

新智元
新闻资讯8

ChatGPT默认模型大升级,GPT-5.5 Instant正式上线:新增记忆来源功能

OpenAI宣布ChatGPT默认模型升级为GPT-5.5 Instant,面向所有用户开放。升级核心是准确性,在高风险领域幻觉内容减少,能力全面提升,回复更简洁。还提升了个性化能力,引入记忆来源功能。

AI寒武纪
新闻资讯8

OpenAI深夜祭出GPT-5.4,暴击Claude!原生操控电脑,打工人悬了

OpenAI发布GPT - 5.4,全面反击Gemini 3.1 Pro和Claude Opus 4.6。它是首个有「原生电脑使用」能力的通用模型,各维度无短板,成绩炸裂,定价也创新高。

新智元
算法论文8

砍掉70%内存!陈丹琦团队破解LLM长文本瓶颈

大型语言模型处理长文本时,KV缓存占用内存巨大。陈丹琦团队提出KV足迹作评估标尺,推出分块驱逐与PruLong训练技术,在128K长文本任务中最高降低70%内存,性能损失仅10%。

深度学习自然语言处理