「多智能体工作流」共找到 6716 篇相关文章
一年从3B卷到0.xB:MonkeyOCRv2用0.7B拿下17语种文档解析开源第一
文档OCR正迈入小模型时代,MonkeyOCRv2以0.7B、0.6B参数在MDPBench上超越3B模型。它重新分配系统职责,采用互补预训练目标,还开源训练数据,且迁移到多任务表现良好。
阿里Qwen 3.7 Max:35小时自主编程,Claude跟不上了?
阿里云峰会发布的Qwen 3.7 Max,在优化平头哥芯片推理内核任务中,35小时让推理速度快10倍。它在多基准表现出色,编程、推理、办公自动化全面开花,但闭源且实验室场景与现实有差距。
阿里Qwen3.5小模型发布:0.8B参数就能处理视频,边缘AI时代真的来了
阿里通义千问发布Qwen3.5系列四款小模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。
警钟敲响!Hinton 最新万字演讲:怒怼乔姆斯基、定义“不朽计算”、揭示人类唯一生路
Hinton在演讲中提出“凡人计算”概念,指出生物智能会随肉体消亡,而AI软件与硬件解耦可“不朽”,还怒怼乔姆斯基,认为大语言模型理解语言方式与人类相似,且数字计算在知识共享上远超生物计算。
不用额外缓存!英伟达开源大模型记忆压缩方案,128K上下文提速2.7倍
英伟达联合多机构推出TTT - E2E方法,在长文本处理上提速显著且性能不打折。它基于标准Transformer,将长文本建模转为「持续学习」任务,核心是上下文压缩,避免额外缓存,代码和论文已开源。
十年来Python生态最好工具,引爆全社区的uv到底是什么?
uv是用Rust写的Python包和项目管理工具,被天文学家Emily L. Hunt博士赞为近十年Python生态最好的事。它功能强大,能替代多个工具,速度快,兼容性强,安装简单,还能轻松管理项目。
GPT-5波折超乎想象!奥特曼连夜回应一切:4o重新上阵,团队紧急补救
GPT-5发布后引争议,网友看法不一。奥特曼回应将全面更新,如翻倍ChatGPT Plus用户使用限额等。OpenAI团队在AMA问答中也解答诸多问题,包括让4o回归、研究多模型并用等。
5个月估值翻10倍,AI数据赛道跑出一家新独角兽
成立约18个月的AI训练数据公司AfterQuery正筹新一轮融资,估值达32亿美元,5个月涨超10倍。它最初想开发AI智能体,后转收集训练材料。此赛道已有多家高估值公司,且数据隐私和安全风险待解。
准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源可商用
近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里可被验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许可。
AI营销头雁冲刺IPO,2个北大-宝洁校友创办
营销Agent公司深演智能再度冲刺港股IPO,这是年内第二次递表。它是决策AI技术公司,主营AI营销和销售,前身是品友互动。按2024年收入计,其在中国营销和销售决策AI应用市场排第一,已完成E轮融资,估值达19亿元。