「语言能力」共找到 4071 篇相关文章
谷歌DeepMind深夜放核弹:世界模型Genie 3登场,重新定义“生成式AI”
谷歌DeepMind推出第三代通用世界模型Genie 3,能生成多样化交互式环境,可实时导航。它较前代有诸多突破,有模拟物理特性等核心能力,能赋能具身智能体研究,但也存在行动空间有限等局限。
Openai-o3 做不到的事,7B 模型做到了! 推荐系统“慢思考”,广告收入暴涨 4.1%
随着GPT - 4等大语言模型兴起,LLM用于推荐系统遇瓶颈,当前方法停在‘System - 1思维’阶段。A4ec框架把LLM从‘快思考’升级到‘慢思考’,用7B模型实现推荐系统升级,使广告收入暴涨4.1%。
此芯科技亮相世界人工智能大会,以 AI 之力勾勒美好未来
2025年7月26日,世界人工智能大会在上海启幕,此芯科技携多款搭载此芯P1的展品亮相,展示端侧AI前沿成果。此芯P1芯片性能强劲,已产品化。展会展示三大应用场景,呈现其多场景应用能力。
全新 AI 消息模型:Apache RocketMQ 如何让 AI 应用拥抱事件驱动架构?
AIGC浪潮下,大语言模型重塑应用开发范式,开发者构建AI应用面临诸多挑战,需可靠高效的异步通信机制。Apache RocketMQ在AI时代演进,有轻量化通信与智能化资源调度两大创新,还介绍了多场景实践。
谷歌 DeepMind 发布机器人学基础模型 Gemini Robotics On-Device
谷歌 DeepMind 推出 Gemini Robotics On-Device,这是视觉 - 语言 - 行动基础模型,可在机器人硬件本地运行,低延迟且能针对特定任务微调。它是 Gemini Robotics 家族最新迭代,还发布相关基准测试。模型待广泛可用,SDK 可在 GitHub 找到。
The Batch: 843 | Meta 的智能眼镜愈发清晰
Meta公布Aria第二代智能眼镜平台,其亮点在于增强现实等研究领域能力。该眼镜体积小、续航久,内置多传感器,能实时解读多方面信息。研究人员今年晚些时候可获设备,其数据或为多领域开辟新路径。
新范式来了!新能量模型打破Transformer++扩展上限,训练扩展率快35%
研究训练新能量模型 EBT,为输入和预测分配能量值,模拟思考过程。它有跨模态、跨任务通用性,训练扩展率比 Transformer++ 高 35%,推理性能提升 29%,还在多任务中表现出色,是扩展模型能力新范式。
首创Mid-training范式破解RL奥秘,Llama终于追平Qwen!
上海创智学院和上海交通大学研究团队深入探讨不同基础语言模型在强化学习训练中的差异,提出中期训练策略,将 Llama 改造成适配 RL 的推理基础模型,缩小与 Qwen 性能差距,还发布了 MegaMath-Web-Pro-Max 数据集。
OceanBase全面拥抱AI新进展:OB Cloud支持十亿级多类型向量数据,数十家企业实现AI应用落地
大模型热潮下,企业面临AI落地难题。OceanBase的OB Cloud支持十亿级多类型向量数据,已有数十家企业实现AI应用落地。它具备多云原生、AI能力优势,提供一体化架构和多模向量一体化,还降低了AI应用门槛。
AI Agent平台Sedai获2000万美元融资,主打云优化
AI Agent平台Sedai获2000万美元B轮融资,由AVP领投。它聚焦云优化,用智能体取代人工运维,节省成本。产品应用广泛,核心能力突出,2024年收入增长7倍,计划扩平台、引新功能、扩市场团队。