多任务处理」共找到 5811 篇相关文章

开源动态7

开源3天斩获 2K Star,这个开源 Skills 技能把 AI 的“记忆缺陷”补上了!

最近含金量极高的 Skills 指南 planning-with-files 开源上线 3 天,GitHub Star 达 2k。它复刻 Manus AI 核心模式,将 Markdown 作为 AI Agent 工作内存,采用三文件模式解决 AI 记忆问题。

开源星探
开源动态8

炸裂开源项目,程序员 + 学生福音:一键把 Markdown / LaTeX 公式「完美粘贴」到 Word/WPS

PasteMD是开源托盘小工具,从剪贴板读取内容,调用Pandoc转成DOCX或表格,自动插入到Word/WPS/Excel光标位置,解决AI对话、网页复制内容粘贴到Office格式错乱问题。

小华同学ai
算法论文7

ImageNet分数越高,生成反而越糊?iREPA给出解释

Adobe Research论文指出,视觉模型在ImageNet分类准确率高,生成效果未必好,全局语义强易压扁空间结构。iREPA修改REPA训练流程,削弱全局干扰,提升了生成质量。

新智元
开源动态8

欧洲版DeepSeek发布Mistral 3系列模型,模态端云生态,无差别商用交付给全球开发者

欧洲最强AI公司Mistral AI发布全系开源模型Mistral 3,从675B到3B参数打通智能链路,采用先进架构,与业界合作优化,以Apache 2.0协议交付全球开发者,推动开源智能发展。

AIGC开放社区
新闻资讯8

黄仁勋GTC开场:「AI-XR Scientist」来了!

英伟达CEO黄仁勋在GTC大会展示LabOS,这是全球首个融合AI与XR的协研科学家平台。它将模态感知等技术融合,构建端到端闭环,还通过三大生物医学案例展示功能,开启人机协同科研新纪元。

机器之心
算法论文8

Thinking with Video:一种全新的思考范式

在人工智能领域,‘用文本思考’和‘用图像思考’存在局限。复旦大学等团队提出‘用视频思考’范式,通过视频生成模型统一文本与视觉推理,构建VideoThinkBench基准测试Sora - 2,全面解读这一开创性工作。

深度学习自然语言处理
开源动态7

最强开源0.9B级OCR模型!PaddleOCR-VL本地一键部署!

作者分享本地部署PaddleOCR-VL的经历,包括踩坑过程、解决办法及启动指令。该模型识别速度快,支持OpenAI API格式,可轻松接入Fastgpt、Dify、n8n等平台。

开源星探
新闻资讯7

ICML 2026史上最严新规:LLM不得列为作者,滥用AI直接退稿

ICML 2026论文征稿开启,截止2026年1月28日。组委会强调三点:LLM不署名;禁提示注入,否则拒稿;扩大AI审稿。还明确允许用LLM辅助,但作者担责,另有参会、版本发布等政策变更。

新智元
推荐文章8

Manus:3大核心策略,破解AI Agent上下文膨胀难题

当AI Agent调用工具结果大量涌入上下文窗口,LLM性能会下滑。Manus联合创始人拆解其上下文工程逻辑,给出‘减少、卸载、隔离’三大策略及模型选择等方法,还提炼出6条实践启示。

CourseAI
产品应用8

当万相2.5刚开卷有声视频,7月已经发布音频一体化的百度蒸汽机又开卷长视频了

百度升级MuseSteamer蒸汽机视频生成模型,可生成任意长度视频,生成中能更新prompt交互创作。其技术规划前瞻体系化,成本低,在行业有应用和商业化空间。

AI进修生