「多语言数据集」共找到 6553 篇相关文章
智能体新范式Chain-of-Agents,多项任务新SOTA
论文提出Chain-of-Agents (CoA) 范式,结合多智能体系统与工具集成推理优势。通过多智能体蒸馏和智能体强化学习训练智能体基础模型(AFM),实验显示其在Web和Code任务上达新SOTA,效率、泛化性佳。
文档OCR新范式0.84 页/秒,吊打MinerU Qwen2.5VL
MonkeyOCR采用SRR三元组范式,简化多工具管道,避免整页文档处理低效率。与MinerU、Gemini 2.5 Pro等对比,性能表现优,处理速度达0.84页/秒,但对扫描件效果欠佳,架构含多模型,可通过特定地址测试。
75页哈工大多模态推理大模型最新综述:感知、推理、思考与规划
哈工大提出75页多模态推理大模型综述,围绕四阶段发展路线图展开,即感知驱动的模块化推理、以语言为中心的短推理、以语言为中心的长推理、迈向原生多模态推理模型,还给出挑战性基准测试和实验案例见解。
OpenAI携手五巨头开源革命性超算协议:一举解决超大集群LLM训练不稳定和网络性能难题
OpenAI联合英伟达等五巨头推出超算开放网络协议MRC并正式向行业开放。MRC目标是性能可预期,有多平面网络、自适应包喷射、SRv6源路由三大核心机制,已在OpenAI多台超级计算机上部署。
我的合伙人是AI|甲子光年
文章讲述AI时代“一人公司”新现象,多位创业者借助AI构建企业运作逻辑。如叶纯俊的公司用AI完成多环节工作,许婷团队让AI参与编程。同时提到投资态度转变,“一人公司”发展有挑战也有机遇。
推荐:AI搜索增加链接展示,从谷歌people also ask到AI搜索;AI绘画从吉卜力到Nano Banana增长方法论
文章推荐两篇内容。一是Google将在AI模式增加链接展示,访谈提及AI搜索是传统搜索迭代,核心SEO原则仍有效;二是复盘Remini借热点增长的DICE模型,含数据监测、敏捷创新、创意营销和数据验证。
Kimi K2里找到了DeepSeek V3架构
Kimi新模型K2热度高,在多benchmark上达SOTA,网友好评多。Kimi工程师透露K2开源原因,还谈及Kimi发展策略。实测显示K2在前端制作、工具调用、创意写作上表现出色。此外,OpenAI开源模型推迟,引发猜测。
在这场大会上,我们看到了AI进入物理世界后的样子|甲子光年
第七届北京智源大会亮点多,有四位图灵奖得主。议题紧跟前沿,设20个论坛和180余场报告。现场展示多个机器人应用。智源发布“悟界”系列大模型,还聚焦开源,升级FlagOS系统。两位图灵奖得主对AI安全看法不一。
AI哪怕答案正确,逻辑链却惨不忍睹,奥数级不等式证明成功率不到50%| 斯坦福&伯克利&MIT
斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数级不等式证明任务的能力。研究发现,模型答案正确多靠猜,推理漏洞多,参数大、思考久也不能提升推理严谨度,但自我反思和定理线索策略有改善效果。
细节直逼亚毫米级!港科广分层建模突破3D人体生成|CVPR 2025
港科广团队提出MultiGO创新方案,借助分层建模思路突破3D人体生成难题。该方案通过三级几何学习框架提升重建质量,在多个测试集上性能领先,且在多领域有应用优势,研究成果入选CVPR 2025,项目代码将开源。