对比实测」共找到 898 篇相关文章

产品应用8

拯救P图废柴,阿里上新多模态模型Qwen-VLo!人人免费可玩

昨夜阿里推出全新多模态模型Qwen-VLo,在原有能力上全面升级,有细节捕捉、图像编辑、多语言支持等亮点,不受固定格式限制。官方demo展示多种玩法,目前免费可玩,实测其编辑能力不错。

量子位
新闻资讯7

谷歌月Tokens消耗量领跑全球了:1300000000000000(别数了是千万亿)

谷歌月处理Tokens用量达1.3千万亿,较一年前的9.7万亿大幅增长。横向对比,谷歌在该指标上远超微软等大厂。Tokens消耗量可衡量模型多方面能力,谷歌为行业树立新标杆。

量子位
开源动态7

我只推荐这5个!24个开源Agent/Workflow框架大比拼!

文章围绕《A Survey on Agent Workflow》展开,介绍了Agent Workflow概念、与Multi - Agent差异、核心组成及Agent角色。对24个主流框架进行对比,还给出不同场景下的框架选择建议,指出当前框架缺乏统一标准。

探索AGI
新闻资讯7

Pinterest 工程通过运行时感知分片将 Android CI 构建时间缩短了 36%

Pinterest 发布技术案例研究,介绍工程团队通过运行时感知的测试分片策略和内部测试平台,将 Android CI 构建时间缩短超 36%,还对比了其他公司提升 CI 性能的做法。

InfoQ
产品应用8

刚刚,喝到了千问APP给我点的奶茶

2026 年初,智能体发展迅猛。Anthropic 发布 Cowork,谷歌联合推出 UCP 标准。1 月 15 日千问 App 上线「任务助理」,打通阿里生态,有 400 多项新功能,实测显示其在多场景表现出色。

机器之心
算法论文8

Science重磅!新药发现提速千万倍,清华用AI把药物筛选变成向量检索

清华大学团队在《科学》发表DrugCLIP研究,将对比学习引入药物发现,把分子对接转为向量检索,使虚拟筛选速度提升千万倍,还构建全球首个全人类蛋白质组药物筛选数据库。

AIGC开放社区
产品应用7

Codex自改进Prompt:让AI自己把重复工作变成自动化

开发者Vaibhav更新的Codex自改进Prompt引发AI开发者群体讨论,被OpenAI联合创始人转发。完整版核心逻辑可拆解为8步,加了严格跳过规则。实测有反馈,也有优化建议和现存问题。

AI工程化
算法论文8

Evaluation is All You Need:评估设计的微小差异如何扭曲结果

论文以DeepSeek - R1 - Distill系列模型为例,指出大模型评估中看似客观的基准测试结果对评估细节极度敏感,细微评估条件变化会致分数波动大,削弱模型对比可信度,呼吁建立新评估标准。

深度学习自然语言处理
开源动态7

Coding Agent 的一个啊哈时刻

作者翻用Codex在SGLD做Qwen - Image/HunyuanVideo的modelopt fp8支持的记录,发现Coding Agent思考过程与人类思路高度一致,如对比中间图和结果图判断量化精度,Infra领域核心技能或被其解决。

GiantPandaLLM
产品应用8

刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude

阿里巴巴突袭发布新一代基座大模型Qwen3.8 - Max,它总参数量达2.4万亿,在多场景表现出色,在权威榜单冲进全球第一梯队,性能直逼Claude,且价格实惠,实测反馈良好。

量子位