「模型评测」共找到 7981 篇相关文章
当 AI 写了几乎所有代码,软件工程会怎样?
文章探讨 AI 写大部分代码时软件工程的走向。最新模型让开发者有‘顿悟时刻’,如 Google 工程师用 Claude Code 一小时完成去年的工作。AI 编程能力在 11、12 月迎来拐点,专业知识贬值,软件工程师核心能力更重要,也带来诸多挑战。
高管0份!影石年会5套房全归90后;34岁清华学霸28个月造百亿独角兽;DeepSeek“冷漠”争议,春节要燃回来?| Q资讯
本文为AI行业资讯汇总,包含DeepSeek回应“变冷漠”、影石年会送房、34岁清华学霸造百亿独角兽等热点,还涉及字节跳动、谷歌、英伟达等公司动态,以及模型下架、新规发布等消息。
GLM-5封神,智谱市值五天翻倍,中国AI火力全开了
2026年春节档,字节跳动的Seedance 2.0与智谱GLM - 5成AI赛道“双子星”。GLM - 5在Coding领域开源与实战表现出色,标志中国AI迈向成熟。它能力比肩闭源模型,且配套工具链完善,还适配国产芯片。
谷歌新版Gemini马甲被扒! LMArena实测:唯一能看懂表的AI, GPT-5乱答
谷歌Gemini 3.0疑似上线LMArena,其Pro和Flash马甲被扒。实测中,Gemini 3 Pro能精确看表,GPT - 5等表现不佳;SVG测试有提升但也有不足;还能作曲。不过评测方式老套,希望有新花样。
专治AI生图「人脸崩坏」,8倍速碾压GPT!新版FLUX.1多方位刷新SOTA
FLUX.1 Kontext是融合即时文本图像编辑与文本到图像生成的新一代模型,支持文本与图像提示,角色一致性强,速度快达GPT - Image - 1的8倍。它能解决AI生图“人脸崩坏”等问题,评估显示性能优异。
对话赵天奇:从AI短剧到互动影游,聚力维度的“升维”之战
本文是对聚力维度创始人赵天奇的访谈。他认为 3D AI 技术潜力大,团队聚焦 AI 漫剧/短剧,用自研赛娲大模型降成本。还将拓展 3D 互动影游,认为它是游戏终极形态,从业者要回归影视本质,创业者需拥抱变化。
图灵奖得主杨立昆:中国人并不需要我们,他们自己就能想出非常好的点子
本文是对图灵奖得主杨立昆的访谈,他批判当前大语言模型局限性,指出难以靠扩大规模达人类水平AI。还强调理解世界需非生成式架构,如JEPA。同时以DeepSeek为例,称开源发展更快,中国人能想出好点子。
高精度全身操控!从文本输入生成全身操控物体的动作
物体操控的整体动作生成是具广泛应用但极具挑战的任务,核心挑战在于手部与身体协调及关节式物体操控精度。香港大学提出协同扩散噪声优化框架CoDA,优化三个专用扩散模型,还采用BPS统一表示提高交互精度。
告别「只会相似度检索」:腾讯最新T-Mem让AI学会「联想回忆」
当前大语言模型长期记忆方案均基于相似度检索,存在结构性盲区,无法在无字面/语义相似时召回关联记忆。腾讯团队提出T-Mem,实现AI联想回忆,已被EMNLP 2026接收,代码开源并上线QQ AI伙伴。
Momenta港股上市:一个智驾供应商为何要讲物理AI?|甲子光年
今日Momenta在港交所上市,此前赴美上市搁浅。虽盈利状况优于同行,但研发投入大,累计亏损高。上市前夕其从‘自动驾驶公司’变为‘物理AI公司’,欲用物理AI模型打通多市场,这也是行业趋势。