多场景预测」共找到 5589 篇相关文章

开源动态7

以小博大,仅1.7B媲美gemini2.5-pro,达到SOTA文档解析性能

dots.ocr是语言开源文档解析器,把布局检测和内容识别统一在视觉语言模型中,虽LLM仅1.7B参数,却达SOTA性能。介绍了其预训练三阶段及SFT阶段关键策略。

PaperAgent
开源动态8

python打造Google(A2A)+MCP,Langchain生态互补

文章介绍Google的Agent2Agent(A2A)协议,它能实现AI代理通信协作,打破平台孤岛。还提及MCP协议,二者互补。重点介绍python - A2A库,它实现A2A规范,与框架、模型集成,给出实战示例。

CourseAI
开源动态7

国产 AI 昇腾推理不再高门槛?开源技术栈推理性能对比解析

文章聚焦昇腾 NPU 大模型推理,对比 MindIE 和 vLLM Ascend 推理性能。因 MindIE 使用门槛高,昇腾联合 vLLM 社区推出插件。实验用 GPUStack 平台,结果显示二者在不同场景各有优势,呼吁构建国产 AI 基础设施体系。

PaperAgent
开源动态7

闭源RSI的严父来了:18个Agent自主科研,Kimi K3靠Harness逼近Opus 5

开源AI基础设施公司Prime Intellect研究表明,借助智能体Harness,让开源模型负责监控和实现,可让‘AI开发AI’更便宜、效果更好。实验中,Kimi K3搭配Harness逼近Opus 5。

量子位
新闻资讯7

安谋科技“开源AIOS联盟”亮相WAIC2026:20+家产学研伙伴已锁定,协力布局AI产品“芯"基建

7月18日,安谋科技在2026世界人工智能大会宣布发起“开源AIOS联盟”,超20家生态伙伴入驻,涵盖产学研全链路。联盟围绕技术研发等发力,推动AIOS在新兴智能终端落地。

芯师爷
算法论文8

给大模型「持续注入新知识」,北航CASE框架:编辑千次不失忆,额外参数不到1MB丨WWW'26

北航团队提出CASE框架解决大语言模型持续吸收新知识难题。该框架给编辑“算分”、调“关键神经元”,破解核心痛点。实验显示,1000次编辑后准确率提升近10%,额外参数不到1MB。

量子位
新闻资讯7

每周产业洞察 | 2026,AI视听内容的“下半场”比的是“控制力”?

北京AIGC视听产业创新中心位于朝阳区东坝乡,由方参与,采取‘共创、共建、共享’模式,提供六大服务平台。截至2025年8月汇聚近百家生态伙伴,首创郎园负责运营,携手企业构建产业链生态。

郎园Station
新闻资讯7

破防了!全球顶尖AI惨败,人类最后防线竟是「重启试试」?

GSMA联合权威组织发起全球电信AI故障排查挑战赛,吸引超1000支队伍。赛事依托权威评估框架,设丰厚奖励,分个赛道,还将开展智能体任务,预示电信运营模式重构。

新智元
新闻资讯8

GPT-5.2连肝7天,300万行代码造出Chrome级浏览器

Cursor的CEO让GPT - 5.2连续运行一周,产出300万行代码,从零构建Chrome级浏览器。还介绍不同模型长任务表现、智能体协作架构,指出这将颠覆软件开发经济学。

新智元
开源动态8

5.6K Star!原本付费现在开源!本地版“ElevenLabs”,视频翻译+声音克隆全免费!

今天给大家安利GitHub上开源神器Voice - Pro,它原本是商业付费软件,因团队无暇管理而开源。整合个先进语音模型,将视频处理流程打包成本地软件,免费且功能强大。

开源星探