模长感知」共找到 953 篇相关文章

开源动态8

o3 Gemini 都翻车?首个可验证链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界

GUI 智能体发展遇瓶颈,现有数据集难评估其时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有型瓶颈。

AI科技评论
产品应用8

中文版Nano Banana来了?Qwen-Image-2.0炸场:1K文本硬吃,中文生图彻底不拧巴了

AI生图曾有文本易糊、指令复杂就出错、中文渲染差等问题。阿里新发布的Qwen-Image-2.0能处理1K token文本,理解复杂指令,中文渲染佳,还能多图编辑,国际评测表现也靠前,阿里云百炼已开通API邀测。

量子位
产品应用7

Jina Embeddings v4 的量化感知训练

文章聚焦Jina Embeddings v4的量化感知训练。介绍量化技术可压缩向量体积、提升检索效率,对比四种主流量化方法,重点实验PTQ和Output QAT,还测试非对称量化,给出实验结果与结论。

Jina AI
开源动态8

HAMi × NVIDIA:GPU 拓扑感知调度实现详解

HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决多卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。

AI前线
新闻资讯7

上下文窗口、Agent崛起,RAG已死?

技术迭代下“RAG已死”论调出现,向量数据库Chroma创始人主张用上下文工程框架取代对“RAG”的狭义依赖。文章梳理业界不同观点,有人认为RAG在进化,有人称其成工程学科,也有人觉得会被Agent和上下文取代。

机器之心
算法论文7

The Batch: 939 |在推理阶段学习上下文

大型语言型处理上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。

DeeplearningAI
新闻资讯7

Fable 5.1发布,到底强了多少?

昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦任务,还降低缓存读取价。它在游戏、视频等多个领域表现出色,与同类型对比进步明显,虽价格贵,但能力、速度有提升。

鲸选AI
推荐文章8

上下文不再难:KV Cache 全生命周期优化实战

上下文大语言型发展带来计算和内存挑战,现有基准测试多忽视 KV 缓存完整生命周期。微软姜慧强在 AICon2025 分享 SCBench 工具,梳理推理优化方法,介绍 MInference 等,还提出 Tri - shape 方法等成果。

AI前线
新闻资讯7

ICME专题征稿 | 具身多态智能:从感知到世界建

ICME是多媒体领域国际顶级会议,2026年将在泰国曼谷举行。此次专题征稿聚焦具身多态智能,涵盖多感知、世界型等主题,介绍了投稿详情及联系方式。

深度学习自然语言处理
新闻资讯7

德克萨斯州总检察指控Meta、Character.AI,误导儿童心理健康

Techcrunch消息,德克萨斯州总检察Ken Paxton对Meta AI Studio和Character.AI展开调查,因其从事欺骗性贸易行为,误导性宣传为心理健康工具,可能误导儿童。此前已有对Meta调查,两公司均称有免责声明。

AIGC开放社区