「AI模型测试」共找到 13965 篇相关文章

产品应用8

录屏扒代码、截图改网页!Kimi K2.5把「视觉x代码」玩明白了

Moonshot AI推出最强Agentic模型Kimi K2.5,发布后热度起飞。它实现多功能一体化整合,具备设计审美,支持可视化编辑,推出编程工具Kimi Code。在多项测试中表现优异,还能在办公领域发挥作用,其智能体集群提升了效率。

量子位
产品应用7

AutoGLM 2.0 深度解析:云端智能体的技术跃进与现实挑战

2025 年 GUI Agent 赛道升温,多数产品依赖本地执行。智谱 AI 在 8 月 AutoGLM 2.0 闭门交流会上展示新路径,其由国产模型驱动,具多能力,在 Agent 云端执行架构、训练方式等方面有突破,也面临一些挑战。

特工宇宙
开源动态8

Qwen3家族训练秘籍公开:思考/非思考融进一个模型,大模型蒸馏带动小模型

Qwen3技术报告揭晓8款模型关键技术,采用双模式架构,训练和微调分段进行,还“大带小”蒸馏数据。其融合思考与非思考模式,训练分多阶段,Qwen Chat还全量上线深度研究功能。

量子位
新闻资讯7

刚刚,MOSS孙天祥创业,直播AI4AI大规模科研

创业公司Analemma将全球公开直播部署端到端AI研究系统FARS,目标是全自动完成100篇论文,直播预计持续一个月。FARS是无人类干预、纯AI驱动的系统,能完成科研全流程。其创始人是孙天祥,团队年轻且获数千万美元融资。

机器之心
推荐文章7

ADHD,反而成了 AI 时代的版本答案?!

文章探讨ADHD在AI时代的意义。ADHD大脑多巴胺调节回路有差异,过去被视为问题的特质如今成优势,如发散创造力、短时聚焦和混乱适应力。AI为ADHD带来新体验,让其更适合开荒。还分享在AI时代做ADHD的经验。

特工宇宙
7

AI Coding正在重塑大前端!一码多端如何破局?

InfoQ直播栏目邀前阿里工程师吴子奇等探讨AI Coding与跨端研发。提到跨端框架设计、技术创新、人才要求等观点,还介绍快手和字节探索,10月QCon上海站设相关专题。

InfoQ
新闻资讯7

AI版抖音来了

OpenAI发布Sora 2及专门APP,被称为AI版抖音。Sora 2在逼真度和物理准确性上有极大提升,APP玩法独特,让大量真实人物与虚拟场景结合。虽仅在美加开放且需邀请码,但闲鱼已有售卖。

newtype AI
算法论文7

ACL 2025 | 大语言模型正在偷改你的代码?

本文聚焦大语言模型在代码推荐中的「供应商偏见」,通过分析7个主流大模型在30个场景的59万次响应,发现模型会偏好特定供应商,甚至擅自修改代码,还探讨了风险、局限并给出展望。

机器之心
8

AI改变世界!微软发布700个真实AI Agent、Copilot应用案例

微软发布700个真实的Agent智能体、Microsoft Copilot应用案例,涵盖金融、医疗、科技等多领域。如埃森哲构建智能体降低销售未清天数,ANS用其提高成交率等。

AIGC开放社区
算法论文8

基于DINOv2和SAM2改进的U-Net模型

DSU-Net是基于DINOv2和SAM2改进的U-Net模型,通过多尺度跨模型特征协作和轻量级适配器模块,解决现有图像分割模型在特定下游任务表现不足问题,提升分割精度,降低训练成本。

机器学习AI算法工程