小模型逆袭」共找到 8223 篇相关文章

产品应用8

告别 AI 土味审美!Kimi K2.5 实测:扔个视频复刻 iOS 级丝滑动效

Kimi 上线 K2.5 模型,前端审美佳,接近 Gemini 3,增强多模态识别,支持视频。测试显示它能按要求生成漂亮网页,还可通过反馈迭代。它对设计师和普通人帮助大,且 Agent 模式任务完成率高。

歸藏的AI工具箱
推荐文章8

Agent 如何用搜索?这家最懂 AI 搜索的团队,把踩过的坑都分享出来了

AI时代搜索与传统搜索大不同,人类搜索是静态检索,AI搜索是动态、流式、可追问的。宿科技作为AI Agent基础设施提供商,分享了为Agent提供搜索服务的经验,包括不同场景下AI应用接入搜索的难点与解决方案。

Founder Park
新闻资讯8

英伟达咽喉上的苏州女人

一份英伟达供应链名单让英诺赛科进入大众视野。其创始人骆薇薇九年前回国创业,带领公司从“三无作坊”逆袭。英诺赛科采用IDM模式和8英寸工艺,成全球首家量产8英寸硅基氮化镓晶圆企业,还将与英伟达合作。

量子位
新闻资讯8

见证历史!DeepSeek跃居全球第二AI实验室,R1登顶开源王座,R2全网催更

昨晚,DeepSeek官宣R1完成版本升级,开启「深度思考」功能可体验。其R1-0528性能媲美o3和Gemini 2.5 Pro,还微调了8B模型。DeepSeek成全球第二大AI实验室和开源王者,网友催更R2。

新智元
开源动态8

Andrej Karpathy 盛赞!斯坦福团队新作,让Llama-1B 实现毫秒级推理

斯坦福Hazy Research团队将开源模型Llama - 3.2 - 1B前向推理整合为“Megakernel”,把推理延迟大幅降低,显存带宽利用率显著提升。团队指出当前主流LLM推理系统在batch、极低延迟场景下低效,提出Megakernel以重构执行方式。

AI科技评论
算法论文8

Nature Computational Science | 香港城市大学韦业等:复杂系统深度主动优化

本文通过集成深度神经网络和树探索能力,提出神经网络代理模型引导树探索的主动优化方法。该方法在超2000维数值优化问题中找到全局最优,在多领域表现优于现有方法,为样本、高维优化难题提供通用技术。

力学与人工智能
新闻资讯7

告别功能内卷,产业AI需要一记“ACE球” | 甲子光年

文章指出产业AI在金融等行业落地面临挑战,投入产出错配。蚂蚁数科在外滩大会推出‘按效果付费’模式,提出‘ACE’方法论,以行业大模型和实战经验助力落地,成果初显,有望推动AI to B行业变革。

甲子光年
开源动态8

SD又回来了!一秒出图,手机就能玩:SD3.5-Flash让专业AI绘画进入“闪电”时代

Stability AI联合萨里大学SketchX实验室推出SD3.5-Flash模型,能在普通电脑甚至手机上快速生成专业级高分辨率图片。它将推理步骤压缩、显存要求降低、出图时间大幅缩短,画质也没明显缩水,还在性能上反超SD3.5M。

AIGC开放社区
算法论文8

与Gemini Diffusion共振!首个扩散式「发散思维链」来了

西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型

机器之心
新闻资讯7

网民票选AI王者,LMArena一夜变17亿美元独角兽!

LMArena原是校园开源项目,从2023年起步,如今估值达17亿美元。其Arena模式让网友盲投选AI,Elo评分系统算排名。虽有众包投票易操纵等争议,但已成行业标杆,还将为大厂提供付费评估服务。

新智元