「Agent技术」共找到 5173 篇相关文章
社区供稿丨以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。
刚刚,1122人干出“国产GPU”第一股,摩尔线程成功IPO:开盘股价疯涨,市值破2800亿!专家:国产AI芯片商业化进入关键期
今天摩尔线程在科创板挂牌上市,募资 80 亿用于核心产品研发。其团队技术强,研发投入高但仍亏损,预计 2027 年盈利。产品迭代快,不过与国际龙头有差距,专家认为国产 GPU 商业化关键在软件生态。
奥特曼恩师力挺19岁少年!比AlphaFold快4倍,只杀害虫不伤人
2024年,18岁的Tyler Rose和19岁的Navvye Anand创办Bindwell,将AI药物研发技术用于农业,构建基础模型,研发出比AlphaFold快4倍的模型。奥特曼恩师Paul Graham建议卖知识产权授权,公司获600万美金融资。
从检测到通用感知:构建空间智能的基础
本文整理自张磊在AICon 2025北京的分享,分析语言与视觉原生模型架构区别,介绍基于Transformer的物体检测算法及开集检测技术进展,如Grounding DINO和DINO - X,还探讨其在多领域的应用和潜力。
NVIDIA 开源 Live VLM WebUI:摄像头实时测试视觉语言模型
NVIDIA 开源 Live VLM WebUI,可让用户在本地用摄像头实时测试视觉语言模型。它基于 WebRTC 技术,能将摄像头视频流实时传输给模型,分析结果叠加在画面上,支持多后端、多平台及多种模型。
音画同步视频生成重磅开源!Character AI和耶鲁大学推出Ovi,让音、画在一个大脑里思考
Character AI和耶鲁大学团队推出开源模型OVI,它采用双骨干交叉模态融合架构,让音视频同步生成。其架构对称,用旋转位置嵌入技术对齐时间,训练策略分步进行,生成效果佳,为开源音视频生成提供新路径。
杨植麟带 Kimi 团队深夜回应:关于 K2 Thinking 爆火后的一切
上周,月之暗面发布并开源 Kimi K2 Thinking,主打“模型即 Agent”,一上线便引发关注。今日凌晨,杨植麟等人在 Reddit 开展 AMA 活动,回应 K2 Thinking 一系列问题,还回顾了其在多项测试中的亮眼成绩。
北大字节开源首个时空推理视频模型!思考过程全透明,性能超越GPT-4o
北大和字节联合团队推出开源模型Open-o3 Video,将显式时空证据嵌入视频推理全过程,采用non-agent架构,性能超越GPT - 4o等闭源模型。该模型构建了STGR语料体系,采用双阶段训练,实验表现优秀。
钉钉不说话,默默把 AI 表格干到了 1000 万热行
钉钉 AI 表格单表容量突破 1000 万热行,成业内首个实现该能力的智能表格。它基于阿里 AI 技术重构底层架构,实现性能与智能融合,在业务场景应用效果好,推动 AI 办公进入‘原生时代’。
极佳视界获新一轮亿元级 A1 轮融资,CEO:“物理世界 ChatGPT 时刻”将在 2 至 3 年内到来
近日,极佳视界完成新一轮亿元级 A1 轮融资,由华为哈勃、华控基金联合投资。该公司聚焦物理 AI,其创始人兼 CEO 黄冠博士称‘物理世界 ChatGPT 时刻’2 至 3 年内到来,世界模型技术价值已现。