「多领域推理」共找到 6435 篇相关文章
突发!ChatGPT官宣加入广告,既然无法用爱发电,那就让 AI 带货吧。
OpenAI官宣在免费版和8美金新订阅的ChatGPT中测试投放广告,仅针对美国登录用户。此前ChatGPT APP负责人称不会加广告,如今被打脸。OpenAI因运营成本高、亏损多,选择广告变现。
从分钟级等待到20倍超速:LightX2V重写AI视频生成速度上限
今年,开源项目LightX2V在ComfyUI社区走红,单月下载超170万次。它是面向低成本、强实时视频生成的推理技术栈,能在消费级显卡上高效生成视频,还支持多种模型和硬件,覆盖不同用户需求。
小米开源首个跨域具身基座模型MiMo-Embodied,29个榜单SOTA
小米具身智能团队开源跨域基座模型MiMo - Embodied,它融合自动驾驶与具身智能,在29个榜单创SOTA。该模型基于MiMo - VL架构,采用四阶段训练策略,有效解决领域割裂问题,为通用VLA模型奠定基础。
WhisperLiveKit:本地同步实时语音转文字
实时语音转文字难题待解,现有方案各有缺陷。WhisperLiveKit项目用前沿同步语音技术解决问题,支持多语言同步翻译、实时说话人识别等,还介绍了安装、部署方式,不过效果受语言和模型等因素影响。
AI花17小时写了篇30页学术论文!自主选题,包含实验,还符合APA格式规范
Virtuous Machines AI系统花17小时、114美元,找288个真人做实验,写了篇30页认知心理学领域学术论文,从选题到成稿全自动化。其架构独特,不过也存在理论误解等小缺点。
刚刚,扎克伯格宣布成立Meta超级智能新实验室
Meta宣布进入超级智能赛道,扎克伯格成立Meta超级智能实验室,任命前Scale AI CEO为首席AI官。MSL整合多团队,Meta还投资Scale AI,为抢人才不惜重金,新团队成员来自顶尖实验室,Meta有独特优势。
Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO
Meta和NYU研究强化学习在大模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。
最新12种GraphRAG技术全面评测
6月两篇论文对12种GraphRAG技术评测。GraphRAG通过构建图结构组织知识,在复杂推理等任务中优于传统RAG。不同GraphRAG技术在图构建、知识检索上表现各异,如RAPTOR图构建慢但令牌消耗少。
2026论文解读,ASAHI:自适应切片助力小目标检测,速度提升25%、精度创新高
高分辨率航空图像小目标检测难,传统检测器表现差。2026年4月都灵理工大学团队提出ASAHI,用自适应切片框架,在VisDrone2019上mAP50达56.8%,推理速度比SAHI提升20 - 25%,还介绍了实战代码等。
字节的 Doubao Seed 2.0 来袭,不过我想先和你聊聊扣子编程
作者介绍了AI Coding进展超预期,普通人协作就能做出实用作品。重点讲了扣子编程,它是云端Coding Agent,适合小白,接入多个大模型。还介绍了Doubao Seed 2.0升级,最后探讨了编程趋势。