全场景人工智能」共找到 3929 篇相关文章

开源动态8

从分钟级等待到20倍超速:LightX2V重写AI视频生成速度上限

今年,开源项目LightX2V在ComfyUI社区走红,单月下载超170万次。它是面向低成本、强实时视频生成的推理技术栈,能在消费级显卡上高效生成视频,还支持多种模型和硬件,覆盖不同用户需求。

机器之心
算法论文8

仅有一位作者的论文,却补上了城市智能的「最后一公里」

郑宇教授用论文提出跨域多模态知识融合框架,在空气质量推断等多场景优势明显,其研究按数据选择等四阶段进行,解决数据难题,推动AI用于城市问题,为跨部门协作提供可能。

AI科技评论
新闻资讯8

当Gemini 3刷屏时,这款AI已开始救命了:原子级攻克「不可成药」靶点

网关注Gemini 3时,Chai-2已开启生物学界「AlphaFold时刻」。它能原子级精准设计出可进临床的抗体药,攻克「不可成药」靶点,让很多难治疾病看到新药希望,AI造药开始起飞。

新智元
新闻资讯8

Anthropic首份内部报告出炉!自家工程师亲述:生产力飙升50%,但感觉在亲手砸掉自己饭碗

2025年8月,AI巨头Anthropic对内部员工调查,揭示AI真实影响。员工使用Claude比例和生产力提升,还催生新工作。但大家对委托工作比例低,且在技能、社交和职业发展上有不同感受。

AI寒武纪
新闻资讯7

腾讯胡文博:引领 3D 视频世界模型新趋势丨GAIR 2025

2025年12月12 - 13日,第八届GAIR人工智能与机器人大会将在深圳举办。腾讯ARC实验室高级研究员胡文博将在13日《世界模型》论坛分享《迈向三维感知的视频世界模型》。他深耕视频生成模型,成果显著。

AI科技评论
产品应用8

金山与华科发布多模态模型MonkeyOCR v1.5:文档解析能力超越PaddleOCR-VL,复杂表格解析首次突破90%

2025年6月以来多模态文档解析成前沿课题。MonkeyOCR v1.5是新框架,在OmniDocBench v1.5等基准上面突破,复杂表格等场景提升9.7%,采用两阶段解析管道和复杂表格处理方案。

量子位
产品应用7

深度体验TRAE SOLO 正式版,总结一点技巧(附完整可重现提示词和源码)

TRAE SOLO正式版面向国际版所有用户量上线,模型能力提升且限免。它是响应式编码特工,适合复杂任务。有打通‘行动➔验证’闭环、SubAgent管理上下文等亮点,正式版还有多处升级,作者分享实战技巧。

宝玉AI
算法论文8

微软 Agentic 组织:下一代 AI 系统

微软研究院提出新推理范式AsyncThink,让LLM从单打独斗进化成带团队的项目经理。它把并发控制转为纯文本协议,经两阶段训练,实验中方位碾压传统方法,还具跨领域泛化能力。

PaperAgent
推荐文章7

颠覆传统认知!顶尖架构师眼中,决定职业生涯上限的不是技术能力|独家对话一线架构大佬 Christian Ciceri

在软件开发与AI浪潮融合背景下,架构师面临新挑战。InfoQ采访Apiumhub联合创始人Christian Ciceri,探讨‘可度量、可演化的架构’理念及AI影响,Ciceri强调AI辅助而非替代人,架构需团队共创。

InfoQ
开源动态8

NeurIPS 25开新坑:145万个图文对,覆盖八种主流水下理解任务

华中科技大学团队推出首个水下多模态大模型NAUTILUS,支持8种水下场景理解任务,还开源145万图文对的NautData数据集。模型通过VFE模块解决水下图像问题,性能超越现有模型,恶劣环境表现更佳。

新智元