多场景预测」共找到 5576 篇相关文章

开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉大模型DINOv3,采用自我监督学习,无需标注数据。它在60个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,能适应种部署环境。

AIGC开放社区
新闻资讯7

2026年OpenAI最看好的3个方向

OpenAI首席财务官与投资人聊2026年AI趋势,涉及智能体登场、算力换收入、大模型能力突破等。还谈到对医疗、具身智能行业变革影响,破除AI泡沫说法,预测机器人行业前景等。

量子位
产品应用8

字节扣子空间上新一键转播客功能,现在我们真成同事了|甲子光年

5月27日,字节跳动旗下AI协同办公平台扣子空间新增播客功能。其播客音频生成功能让AI从‘说什么’跨越到‘怎么说’,适用于场景。扣子空间还具备跨模态协作等能力,引入MCP协议,免费开放核心功能。

甲子光年
开源动态8

腾讯祭出开源核弹!LeVo音乐生成模型,媲美Suno,支持零样本风格迁移,歌词完美匹配

音乐生成领域有重大突破,腾讯AI Lab开源高保真音乐生成模型LeVo。它由LeLM和音乐编解码器组成,能解决现有方法在音质、音乐性等方面的局限,实验显示其优于现有方法,功能强大且适用场景

开源星探
开源动态8

我去,Github 51k star,没看错,他是开源的,“用 Docker 运行 macOS”?你绝对没看错!

这是一个运行于 Docker 中的 macOS 虚拟环境项目。开发者或安全研究者在非 macOS 平台运行 macOS 常遇性能差等痛点,而 Docker - OSX 利用容器化轻量部署,接近原生性能,功能亮点,应用场景丰富。

小华同学ai
产品应用7

【实测&解读】全球首个手机通用Agent——AutoGLM 2.0发布!我喝到了AI为我点的第一杯咖啡~

智谱更新的AutoGLM 2.0是全球首个手机通用Agent,适配苹果和安卓手机,无需交出手机使用权。它配备云手机和云电脑,由GLM - 4.5和GLM - 4.5V驱动,能完成点咖啡等场景任务,因风险控制付款需人确认。

花叔
产品应用8

kimi 的RL end2end ON LLM

文章分享Kimi Researcher背后技术思考,采用端到端强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍应用场景

Agent的潜意识
开源动态8

50个Agent分工干活,Kimi K2.5的Agent“军团”把我看呆了。。。

Kimi K2.5今日下午发布并开源,具备模态能力。它能根据视频、链接等复刻网站,有Visual Edit功能且自动部署上线。还有Agent Swarm场景Agent协作解决复杂问题,应用体验佳。

探索AGI
开源动态8

10% KV Cache实现无损数学推理!这个开源方法解决推理大模型「记忆过载」难题

推理大模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经步骤压缩KV缓存,性能测试表现出色,适用场景

量子位
开源动态8

55.9K star!微软硬核开源文档转换神器,LLM最佳拍档!

介绍微软开源的轻量级Python文档转换工具MarkItDown,它支持20+格式智能转换为结构化Markdown,专为LLM文本分析场景优化,解决开发者处理格式文档痛点,还阐述其功能、技术架构等内容。

小华同学ai