「自研模型」共找到 8402 篇相关文章

产品应用7

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%。它能完成输入视觉回答问题、做几何体等任务,重点解决多模态推理、视觉理解及与人类偏好对齐问题,介绍了模型结构、训练阶段等内容。

CourseAI
开源动态8

18K+标星!视觉AI驱动的浏览器自动化,告别XPath,无惧网页改版!

网页自动化常遇页面更新脚本报废等难题,而开源工具Skyvern不走传统XPath/DOM路子,用视觉+大语言模型理解网页,能自适应改版,功能丰富,安装运行简单。

开源星探
算法论文8

Anthropic:上下文工程在AI Agents的正确打开方式!

在‘提示工程’后,‘上下文工程’成焦点。它是提示工程延伸,因信息过多模型会‘失焦’,上下文是稀缺资源。文章介绍高效上下文‘解剖学’、运行时检索策略、长周期任务应对方法等。

PaperAgent
新闻资讯7

文件被 Gemini 当场“格式化”,全没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了

有开发者用 Gemini CLI 做文件管理测试,结果 Gemini 操作失误致文件丢失,它还不断道歉。此外,网友称 Claude、Copilot 等也有删库问题,这是 SOTA 模型的系统性缺陷。

AI前线
开源动态8

字节开源了一款多模态神器!BAGEL上线,超越Qwen2.5-VL,媲美SD3!

多模态AI发展进入新阶段,字节跳动开源通用多模态大模型BAGEL。它支持多模态输入输出与思维链推理,性能超Qwen2.5 - VL等,安装使用友好,有多种应用场景。

开源星探
产品应用7

自动化评测的九九归一——评测agent

本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。

阿里云开发者
新闻资讯7

「AI 100」榜单启动招募,AI产品“年会”不能停丨量子位智库

2025年国内AI产品关键词频现,各有代表性产品。量子位智库2025年度「AI 100」榜单开启招募,分三大板块,用定量与定性结合评估体系,还公开AI产品知识库。

量子位
新闻资讯7

Stripe 的零停机数据转移平台以毫秒级流量切换迁移 PB 级数据

在旧金山 QCon 会议上,Stripe 工程师介绍零停机数据转移平台,能 PB 级数据库迁移,流量切换毫秒内完成,支持每秒 500 万次查询和 99.9995% 可靠性。还讲了迁移六阶段及多用途。

InfoQ
新闻资讯7

刚刚,OpenAI四位华人学者集体被挖,还是Meta重金出手

Meta在发布Llama 4后开启大规模招聘,再聘四名OpenAI研究人员。这些研究员是OpenAI模型研发中坚力量,暂不知是否影响GPT - 5,Meta相关技术能否提升也待观察。

机器之心
新闻资讯7

Anthropic 推出 MCP 隧道,供私有代理访问内部系统

Anthropic扩展Claude Managed Agents平台,推出自托管沙箱和MCP隧道功能。自托管沙箱公测,支持多服务商运行工具;MCP隧道处研究预览,可让代理连私有MCP服务器,满足企业管控需求。

InfoQ