Docker镜像」共找到 586 篇相关文章

开源动态8

字节Seed开源长线记忆多模态Agent,人一样能听会看

字节Seed发布全新多模态智能体框架M3 - Agent,能听会看、有长期记忆且免费开源。团队还开发新长视频问答基准M3 - Bench并开源。实验显示,M3 - Agent在多基准测试中显著优于基线模型。

量子位
新闻资讯8

刚刚,AI大牛Karpathy又提新概念:细菌一样写代码?

AI大牛Andrej Karpathy继Vibe Coding后提出「细菌式编码」,受细菌代码启发,有小而精简、模块化、自包含特点,其核心是让代码利于共享。它适合快速原型开发,也有局限,建议兼顾两者。

机器之心
新闻资讯7

AI查重「杀死」一切!学生93分钟一到底自证清白

AI时代,教育界信任面临挑战。休斯顿大学学生Leigh Burrell熬夜写的作业被AI检测判为ChatGPT代笔,靠15页证据才洗清冤屈。AI检测工具误判频出,误判率最高达9%,教育界信任正在崩塌。

新智元
新闻资讯8

刚刚,国产AI双冠王!黑马世界模型打破全球纪录,一到底封神

生数科技的MotuBrain零宣发登顶双榜,打通「看懂世界+执行行动」,适配多个头部机器人本体。它基于Motus进化,具备多本体、多任务、长程执行能力,展示出强大的「一脑多能」和「一脑多型」特点。

新智元
产品应用8

DeepSeek-OCR 2再进化,对图理解已经人一样逻辑推理了

DeepSeek-OCR 2升级,保持前代高效压缩率和解码效率,引入DeepEncoder V2,模仿人类视觉因果流机制,将图理解转为逻辑推理,在文档解析领域实现逻辑重构,性能显著提升。

AIGC开放社区
算法论文8

拒绝「盲修」:JarvisEvo 如何让 Agent 人类一样拥有「视觉反思」能力?

现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图编辑。

机器之心
8

太抓马了!马斯克OpenAI开庭,硅谷巨富互揭老底极了村口吵架

马斯克与OpenAI的世纪庭审爆点不断。马斯克承认xAI用OpenAI模型训练Grok,且庭审中六次失态;OpenAI也有黑料,如Brockman日记暴露其私下盘算。目前风向对马斯克不利,后续还有奥特曼等证人登场。

量子位
算法论文8

与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM人一样读长文本

NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。

机器之心
新闻资讯7

把大象塞进冰箱一样困难”,端侧大模型是噱头还是未来?

InfoQ《极客有约》X AICon 直播聚焦端侧大模型,探讨其落地挑战与破局思路。专家指出端侧部署有隐私、可用性等优势,但面临内存、精度等难题。华为、支付宝等分享方案,还探讨应用场景、商业模式及未来趋势。

InfoQ
产品应用7

打车点单?实测滴滴AI助手,打车也能“私人订制”了

实测滴滴新上线智能体小滴,它改变打车逻辑,可主动挑车,还能满足个性需求。同时,相关MCP服务上线,开发者可接入。AI重塑打车体验,让出行更美好,多方受益。

量子位