视觉 - 语言数据」共找到 3807 篇相关文章

开源动态7

微软开源AI量化神器Qlib

微软开源AI量化平台Qlib,支持多样机器学习范式,解决量化投资挑战。包含数据处理等完整流程,有安装、数据准备等说明,还提供自动化和定制化工作流,以及应对挑战的方案和性能对比。

GitHubStore
开源动态8

字节跳动开源文档解析大模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!

字节跳动开源文档解析大模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。

小华同学ai
开源动态8

刷新世界记录!40B模型+20万亿token,散户组团挑战算力霸权

Nous Research推出Psyche网络,用区块链汇聚全球计算资源,启动40B参数大语言模型Consilience预训练,达20万亿token创纪录。还解决带宽瓶颈等问题,让AI训练去中心化,推动创新与民主化。

新智元
新闻资讯8

12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看

谷歌将图像生成常用的“扩散技术”引入语言模型,推出Gemini Diffusion,12秒能生成1万tokens,速度比Gemini 2.0 Flash - Lite更快。它通过逐步优化噪声学习生成输出,目前是实验性演示,可申请体验。

量子位
新闻资讯8

WSL、Copilot皆重磅开源,深夜炸场的微软给我们带来了哪些惊喜?

今年微软 Build 2025 大会于 5 月 20 日凌晨开场,AI 是重要战略方向,‘开源’成关键词。大会有诸多亮点,如开源 Copilot 核心功能和 WSL,升级开发者工具,推出新智能体和平台等,还与多方探讨 AI 发展。

AI科技大本营
开源动态8

通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API

阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。

量子位
新闻资讯8

这场巅峰对话,把China AI的基因、堵点和未来聊透了|甲子光年

2025年4月28日,甲子光年大会巅峰对话探讨‘China AI如何重塑全球AI价值坐标系’。大模型、算力、具身智能、芯片领域嘉宾各抒己见,谈China AI基因、应对策略、行业堵点及未来判断。

甲子光年
产品应用7

创新性自动化 AI 工具-终结者机器人

Terminator是最快的AI优先计算机操作SDK,用类似Playwright的API与Windows原生GUI应用交互,比基于视觉的方案更快更可靠,能操作后台应用。它重点支持Windows,部分支持macOS,暂不支持Linux。

GitHubStore
推荐文章8

对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打的有来有回

本文实测免费AI Coding Agent AgnesCode搭配Agnes 3.0 Flash,对比付费Codex组合在DeepSeek-V3底层算子多芯片优化任务中的表现,验证免费Agent胜任底层AI工程的能力,分享实测数据与行业洞察。

AI科技评论
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三大挑战。

AI科技评论