「多语言推理」共找到 6088 篇相关文章
IBM推出轻量多模态文档神器!OCR与QA超GPT-4o,识别率高达98%!
日常文档处理麻烦,现有工具或体积大、算力消耗高,或识别精度不够。IBM 开源轻量多模态文档处理模型 Granite - Docling,仅258M参数,性能超 GPT - 4o,适用于多场景。
吴恩达来信:人工智能转型走进大学
吴恩达访问英国埃克塞特大学获荣誉博士学位,他发现该校领导层积极拥抱人工智能,思考如何赋能学生。这所大学在多领域有优势,能创造跨学科协同效应,其人工智能转型已起步。
重磅!微软宣布开源Copilot!用 5000 万用户直接碾压 Cursor和Windsurf?
在 Build 2025 开发者大会上,微软宣布 GitHub Copilot Extension for VSCode 项目开源,还发布全新 AI 编码代理。开源是多因素推动的深思熟虑之举,预示 AI 开发工具从‘黑盒’向‘共建’转变。
微小目标漏检只是因为小?从数据到代码:一文读懂 AI-TOD-R 与 DCFL 如何解决旋转微小目标检测
此文指出旋转微小目标检测存在数据空白、学习偏差、特征易丢失等难题,提出AI-TOD-R数据集、全检测范式基准和DCFL框架。DCFL可缓解偏差,在8个数据集达SOTA,还给出实战代码案例。
OpenClaw 实战:一个人、一台 Mac、六个 AI Agent — 从"能聊天"到"能干活"的工程实战
本文分享 OpenClaw 实战经验,介绍 1 编排者 + 5 专业 Agent 团队运作,阐述上下文管理、记忆成长、多 Agent 协作等核心工程问题及解法,还给出系统搭建步骤和技术栈参考。
刚刚,喝到了千问APP给我点的奶茶
2026 年初,智能体发展迅猛。Anthropic 发布 Cowork,谷歌联合推出 UCP 标准。1 月 15 日千问 App 上线「任务助理」,打通阿里生态,有 400 多项新功能,实测显示其在多场景表现出色。
装了 AI 大脑的 Grep
本文介绍了 mgrep 工具,它有自然语言搜索、支持多语言多模态等特点。还说明了使用方法,如安装、登录、索引项目和搜索等,能与编码 Agent 配合,可补充 grep 进行代码搜索。
听了Andrej Karpathy最新2小时访谈,我对Agent彻底祛魅了
Andrej Karpathy在播客中表示,Agent发展还需十年,离像实习生工作还差很远,要解决诸多能力问题;他认为强化学习糟糕但其他方法更糟,还提出AI应削减背书式记忆、未来强大AI或仅十亿参数等观点。
科研智能体「漫游指南」—助你构建领域专属科研智能体
该综述提供科研智能体构建指南,提出三级分级系统,阐述构建流程与能力增强方法,涵盖知识组织、注入、工具集成,还提及基准评估和未来研究方向,促进AI与自然科学融合。
OpenAI和Anthropic罕见互评模型:Claude幻觉明显要低
OpenAI和Anthropic罕见合作,互相授予API权限评估模型安全与对齐情况并发布报告。双方派出多模型参与,从指令层次、越狱、幻觉、欺骗策略等方面评测,呈现各模型优缺点。