「实时数据开发」共找到 4140 篇相关文章
北大联合Llama-Factory推出DataFlex:工业级数据动态训练系统
北大张文涛教授、鄂维南院士团队联合多机构推出大模型数据中心动态训练框架DataFlex。它是统一训练基础设施,纳入三类核心能力,解决底层系统问题,在效率和效果上有提升,受社区认可。
谷歌推出 Conductor:一款面向 Gemini CLI 的上下文驱动开发扩展
谷歌发布新的 Gemini CLI 预览扩展 Conductor,为 AI 辅助软件开发引入结构化、上下文驱动方法,解决跨会话丢失项目上下文问题。它将开发上下文存于持久 Markdown 文件,支持团队配置,还强调规划优先工作流。
10w人看过的龙虾量化系统,评论区骂最多的问题,我花2天补上了。
上一篇龙虾量化系统文章获10w+,评论指出数据是短板。作者经研究找到QVeris,它是统一数据接口平台,使用简单。作者以金融领域为例介绍其用法,还测试其在其他领域的能力,认为它是AI时代的数据基础设施。
扣子开源全家桶,Apache 2.0加持,AI Agent又一次卷到起飞
7月26日,新一代AI Agent开发平台扣子(Coze)宣布开源零代码开发平台(Coze Studio)和调试工具扣子罗盘(Coze Loop)。二者结合已开源的Eino框架,为开发者提供全栈可用、可复用的开发工具,还采用宽松的Apache 2.0协议。
今年最难的机器人Demo,“机器人含量”为0
自变量发布全新灵巧操作系统TwinDex,后训练阶段真机遥操数据为0,机器人就能完成多项精细操作。该系统设计有灵巧性、一致性和可扩展性,降低了对真机遥操数据的依赖,使高质量数据与真机遥操的强绑定松动。
「熟悉的陌生人」才是「好老师」?复旦提出简单指标,找出推理蒸馏中真正有教学价值的数据
复旦大学和上海人工智能实验室研究者提出 Rank - Surprisal Ratio (RSR) 度量方法,综合考虑样本信息量与对齐程度,在蒸馏实验中与学生模型后训练性能相关性高,可用于筛选推理轨迹和选择教师模型。
混合数学编程逻辑数据,一次性提升AI多领域强化学习能力 | 上海AI Lab
上海AI Lab的OpenDataLab团队通过大规模实验剖析RLVR在多领域推理机制。构建多领域评估框架与定制奖励策略,基于Qwen2.5 - 7B系列模型联合训练,有多项关键发现,为构建AI推理模型提供参考。
把具身机器人开发变简单,地瓜机器人S600与一站式平台双擎亮相
11月21日地瓜机器人在深圳举办开发者大会,带来S600具身智能机器人大算力开发平台和一站式开发平台。从硬件到云端全面赋能,加速具身智能机器人全链路发展,还宣布了战略客户与合作伙伴。
小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源
小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。
让AI Agent自动接Issue、写代码、上线:我用200行代码搭了一个全自动开发流水线
文章介绍AI Agent驱动的全自动开发流水线,对比传统流程,指出开发者角色转变。列举开源工具,给出200行代码的最小实现,分析半自动与全自动差异及信任鸿沟,点明开发自动化趋势,还给出落地建议。