Alpha Arena」共找到 71 篇相关文章

开源动态8

阿里通义新年礼物:开源最强Qwen-Image-2512版本告别AI塑料感与文字乱码

通义万相新年前发布Qwen - Image - 2512版本。它是开源界最强文生图模型,在AI Arena盲测中表现出色。能消除AI塑料感,攻克文字渲染难题,在还原真实世界和重构视觉元素逻辑排版上有显著提升。

AIGC开放社区
新闻资讯7

谷歌约战,DeepSeek、Kimi都要上,首届大模型对抗赛明天开战

太平洋时间8月5 - 7日,8款前沿AI模型将在Kaggle Game Arena展开为期3天的国际象棋比赛,参赛方都是AI界顶流。谷歌称现有基准测试难跟上模型发展,这场比赛是探索新评估方法。赛制为单败淘汰制。

机器之心
新闻资讯7

Qwen最新3.7 Max预览版空降!两代超大杯并行迭代,林俊旸走了但还在加速

Arena公布Qwen3.7-Max-Preview和Qwen3.7-Plus-Preview成绩,文本和视觉领域均为国产第一。Qwen3及以后迭代提速,大版本间隔缩至2-3个月,反映阿里Qwen团队进入快速实验、高频交付阶段。

量子位
新闻资讯7

The Batch: 880 | 用 AI 学 2 小时 vs. 跟老师学 6 小时

Alpha School用AI驱动教学,将传统6小时课程替换为2小时个性化学习,让学习速度翻倍,学生考试成绩优异。但部分教育委员会拒绝其分校申请,批评者称缺乏严格证据。此外,美国多地也在进行AI教育尝试。

DeeplearningAI
新闻资讯7

GLM-5架构曝光,智谱两日涨60%:采用DeepSeek同款稀疏注意力

GitHub代码确认GLM - 5架构细节,它采用DeepSeek - V3/V3.2架构,含稀疏注意力和多Token预测,参数量745B。OpenRouter上神秘「Pony Alpha」被指是其测试版,受消息影响智谱AI港股两日涨60%。

量子位
产品应用8

Qwen-Image-2.0: 字字清晰,张张细腻

阿里云推出Qwen-Image-2.0图像生成基础模型,具专业文字渲染、细腻真实质感等特色。在AI Arena盲测中表现优越,能精准生成复杂内容,文字渲染有准、多、美、真、齐特点,图像编辑能力也得到增强。

千问Qwen
推荐文章7

万字实录:AI究竟是普通人的“印钞机”,还是更狠的「收割机」?| GAIR Live 021

雷峰网&AI科技评论邀三位老师探讨“AI大模型金融应用的机遇与挑战”。以Trading Arena大赛为例,分析大模型在金融投资应用,指出打造强逻辑推理“大脑”是金融应用关键,也提及Agent局限与“黑天鹅”预判路径等。

AI科技评论
产品应用7

GPT-5 在 Lovable/Vibecode 中氛围编码,附 GLM-4.5 对比 (反向搜索引擎、吵架的俄罗斯方块)

文章展示GPT - 5在网页端、Lovable、Vibecode的测试案例,与GLM - 4.5对比。如GPT - 5在WebDev Arena创纪录,不同版本使用限制不同。还列举多个应用案例,指出GPT - 5有不足,GLM4.5全栈开发表现不错。

AI进修生
新闻资讯7

4 个月 3000 万美金 ARR,做 AI 评测榜单的 LMArena 为何值 17 亿美金

AI评测产品LMArena半年前种子轮获1亿美金,现完成超1.5亿美金A轮融资,估值达17亿美金。其核心产品Chatbot Arena可对比AI模型回答并构建榜单,公布的数据或解答了其估值高的疑问。

投资实习所
新闻资讯7

Altman 秀新模型“翻车”,谷歌补刀躺赢!OpenAI 前员工爆肝 3 天,编程再赢老东家模型!

近期,OpenAI 携多款未公开新模型亮相。在 IMO 竞赛中,其宣称新模型获金牌,谷歌 DeepMind 的 Gemini Deep Think 也达金牌水平,但网友对二者评价不一。此外,‘o3 Alpha’疑上线,前 OpenAI 员工还在编程赛中击败 OpenAI 模型。

InfoQ