A2A新范式」共找到 2795 篇相关文章

开源动态7

今天,好像见证了属于SD时代的消亡。

liblib宣布升级到2.0,作为国内最大SD生态开源社区,其转型宣告SD时代落幕。曾几何时,SD让普通人感受AI绘图魔力,如今技术迭代,AI绘图门槛降低,新模型受大众青睐。

数字生命卡兹克
开源动态8

更大,还能更快,更准!蚂蚁开源万亿参数语言模型Ling-1T,刷新多项SOTA

10月9日,蚂蚁开源万亿参数语言模型Ling-1T。它延续自研高效MoE架构,在编程、数学推理等多维度测试表现亮眼,还能兼顾精确与效率。此外,它在多场景实用性强,其创新设计提升了能效比与性能。

机器之心
算法论文7

The Batch: 884 | Transformer获得新能量

弗吉尼亚大学等机构的研究人员提出 Energy-Based Transformer(EBT),它能检查自身输出。训练时通过能量值优化预测概率向量,测试显示其泛化优但生成特定文本差,扩展性好,为高性能带来新可能。

DeeplearningAI
开源动态8

面向高效异构训推的统一通信库DeepLink DLSlime开源

上海人工智能实验室开源异构芯片通信库 DLSlime,作为 DeepLink 核心组件,它连接多应用和传输链路。具备异构互联、多链路支持等亮点,性能优于主流方案,已在实验室多个项目验证,还助力国产 AI 工具链发展。

OpenMMLab
新闻资讯7

2025年了,AI还看不懂时钟!90%人都能答对,顶尖AI全军覆没

AI基准ClockBench测试AI读模拟时钟能力,人类平均准确率89.1%,11个主流大模型最好仅13.3%。研究展示了LLM局限性,分析了可能原因,还对比了不同模型表现及在各类问题上的差异。

新智元
开源动态8

苹果端侧AI两连发!模型体积减半、首字延迟降85倍,iPhone离线秒用

苹果在Hugging Face放出FastVLM与MobileCLIP2两条多模态主线。前者主打「快」,首字延迟压到竞品1/85;后者突出「轻」,体积减半。模型和Demo已开放,开发者可集成开发。

新智元
产品应用7

Nano Banana 邪修之王最强科研成果!教你自定义生图比例!

Nano Banana 出图有分辨率低和比例不可控问题。作者发现用垫图方式可控制其生图比例,已生成图片也适用,还给出操作方法、提示词,介绍不同平台效果及案例图下载方式。

歸藏的AI工具箱
算法论文8

大模型赋能的具身智能:自主决策和具身学习技术最新综述

具身智能是通往通用人工智能的关键路径,但传统方法有泛化瓶颈。电子科大最新综述梳理大模型赋能具身智能的自主决策与具身学习,还将‘World Model’纳入统一框架,为研究者提供路线图。

PaperAgent
新闻资讯7

OpenAI首席科学家访谈被紧急制止!有些名字现在不让说了……

OpenAI首席科学家访谈时被要求禁止透露重要员工名字,因Meta常挖人。GPT - 5将发布,奥特曼谨慎应对。此外,还介绍了OpenAI研究方向、瓶颈,以及其他公司在挖人大战中的举措。

量子位
算法论文7

BLIP3-o统一图像生成与理解,多模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成,提升生成质量与效率。它融合自回归和扩散模型,采用CLIP + Flow Matching架构等。经训练,在图像理解和生成任务表现佳,指令微调效果显著。

CourseAI