「数据生成」共找到 4381 篇相关文章

开源动态7

浏览器自动化:从GUI到OpenCLI

文章讲述放弃不稳定的前端UI自动化操作,采用解析并复现底层API请求的方式,来解决浏览器自动化的效率与稳定性难题。介绍了OpenCLI思路、使用方法、原理,还提及自动生成CLI及应用案例,指出未来软件竞争维度将转向可调用性。

阿里云开发者
算法论文8

4步生图封神,GenEval从61%狂拉到92%,全面超越GPT-4o的TDM-R1模型来了

香港科技大学唐靖团队等提出全新通用强化学习框架 TDM - R1,仅 4 步采样就让组合式生成指标 GenEval 从 61% 升至 92%,超越 GPT - 4o。它解决少步扩散模型痛点,实现多方面性能提升,为少步生图发展带来新方向。

机器之心
产品应用8

MoE不够看了,腾讯推出MoT:2B具身模型22项评测16项最佳

腾讯混元团队联合Robotics X实验室推出HY - Embodied - 0.5系列基础模型,含MoT - 2B和MoE - 32B两款主力模型。在22项评测中,MoT - 2B获16项最佳,其架构、数据和训练有创新,能应用于机器人控制。

量子位
推荐文章8

当数据库的主要用户不再是人类:我们在 AI Agent 场景下的架构实践与思考

文章分享了服务 AI 公司时在 Agent 场景下数据库架构的实践与思考。介绍 Agent 工作负载特征,通过三个案例说明数据库面临的挑战及解法,还提到新需求催生开源项目 mem9,并给出实践教训,指出 AI 时代数据基建重要性。

InfoQ
产品应用7

小红书,再造一个更有「声」命力的社区

2026年春节,小红书开放多种AI语音新玩法,如语音发布、评论、问一问等,增强社交趣味性。但AI语音落地面临音频理解、生成活人感和响应速度等问题。小红书有天然优势,技术团队自研模型达SOTA水平。

机器之心
产品应用8

参数破万亿!阿里Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布总参数超万亿的Qwen3 - Max - Thinking,预训练数据规模达36T Tokens。在多项权威测试中表现优异,能与顶级闭源模型竞争。引入两项核心创新,千问App等已上新,网友认可其能力与更新速度。

AI前线
产品应用7

飞书合作的第一款AI硬件来了,居然是个AI录音豆。

飞书与安克创新合作推出首款AI硬件——AI录音豆。该产品小巧便携,可夹在衣服或吸附金属上,有飞书生态,录音质量好,自带底噪抑制,录音后能自动同步云端,快速生成会议纪要,还支持实时翻译。

数字生命卡兹克
推荐文章7

关于 AI Agent,你最想知道的 3 个问题——为什么我说“垂直 Agent”是个伪命题

文章解答了关于 AI Agent 的三个读者问题,包括概念定义、大厂推出的原因及商业化前景、通用与垂直类 Agent 的商业前景。指出 Agent 是 AI 落地有价值方向,目前有挑战,真正机会在围绕其构建的数据、工具和行业理解。

宝玉AI
开源动态7

1.5B参数!支持本地实时语音转录

Liquid AI发布首个端到端音频基础模型LFM2 - Audio - 1.5B,参数1.5B,能在本地设备处理高质量端到端音频任务。它是统一多模态模型,支持两种生成策略,多种应用场景,虽仅支持英文但性能出色。

AI工程化
推荐文章8

Thinking Machines又发高质量博客:力推LoRA,不输全量微调

Thinking Machines 博客力推 LoRA 并与全量微调对比。研究发现小数据量任务中 LoRA 与全量微调效果接近,大数据量稍吃力,强化学习中低秩 LoRA 也能接近全量微调。还揭示了 LoRA 关键要素、超参数规律等。

机器之心