多任务能力」共找到 7297 篇相关文章

开源动态7

DeepSeek 把 Harness 开源了:模型、工具、Agent Loop 全是插件

8月13日,DeepSeek面向全球开发者开放DeepSeek Harness开发者预览版v0.1并开源代码。其特色是一切皆插件,提供四种运行模式,内置Agent系统,有创新但编排范式未突破,还采用仅追加的会话日志。

InfoQ
新闻资讯7

2026 Data+AI 中场纪实:企业决策者,敢把真实业务交给 Agent 吗?| 直播预告

Snowflake携手InfoQ发起直播,探讨企业将真实业务交予Agent的问题。贾天下将分享相关内容,其博客展示有本体团队可实现的能力,还通过生物医学基准测试比较不同方案,为构建企业级AI智能体提供参考。

InfoQ
算法论文8

复旦北大联合美团LongCat提出TDAR:用“粗思考,细求证”破解Block Diffusion的速度精度悖论

复旦大学、北京大学联合美团LongCat提出Block Diffusion推理模型Test-Time Scaling新框架TDAR,引入‘粗思考,细求证’范式与有界自适应置信度解码,打破速度与精度零和博弈,在基准测试表现出色。

机器之心
开源动态8

视频字幕处理开源神器

卡卡字幕助手(VideoCaptioner)操作简单,无需高配置,支持 API 和本地离线语音识别,利用大语言模型处理字幕。它支持平台视频下载处理,有专业语音识别引擎,能智能纠错、高质量翻译、调整字幕样式。

GitHubStore
产品应用8

GPT-5.2 发布:做表格、写 PPT、敲代码 | 打工人的生产力利器

GPT - 5.2发布,在GDPval评测等众基准测试中刷新行业水平。GPT - 5.2 Thinking适合真实场景与专业工作,在知识型任务、编码、长上下文处理、视觉理解、工具调用等方面表现出色,部分功能需付费使用。

AI进修生
新闻资讯7

斯坦福人均≈0.1张GPU!学术界算力遭「屠杀」,LeCun急了

学术界GPU荒严重,美国顶尖大学人均GPU少,与大厂差距大。如斯坦福人均0.14张,而微软等大厂数据中心算力惊人。这导致人才流向工业界,学术验证能力弱,但部分高校有改善措施。

新智元
开源动态8

全新稀疏注意力优化!腾讯最新超轻量视频生成模型HunyuanVideo 1.5核心技术解密

腾讯混元大模型团队发布并开源轻量级视频生成模型HunyuanVideo 1.5,参数8.3B,支持5 - 10秒高清视频生成。它通过层次技术创新,在生成效果、性能与尺寸上实现平衡,还具备种核心能力

量子位
产品应用8

Claude Opus 4.5 × Agent Skills:从第一性原理深入剖析

文章深入剖析Claude Opus 4.5与Agent Skills,介绍了Claude Opus 4.5发布,结合Agent Skills能让模型有专业级能力。还阐述Agent Skills高级设计模式、内部架构及执行生命周期,揭示其工作机制与优势。

PaperAgent
推荐文章8

「All in AI」的 Shopify,分享了他们的全员 AI 落地实践,全是干货

Shopify 三个月前决定「All in AI」,副总裁 Thawar 分享公司引入 AI 的策略、提升效果与三个「反直觉」见解。如全员无差别用 AI、让 AI 展示思考过程、重视新手等,还给出个工作流案例。

Founder Park
算法论文8

突破高分辨率图像推理瓶颈,复旦联合南洋理工提出基于视觉Grounding的轮强化学习框架MGPO

先进模态大模型处理高分辨率图像有瓶颈,复旦和南洋理工研究者提出基于视觉Grounding的轮强化学习方法MGPO,能让模型精准推理,还可使模型从答案反馈中涌现视觉定位能力,避免依赖昂贵标注。

机器之心