Models.dev」共找到 145 篇相关文章

算法论文8

Attention真的可靠吗?上海大学联合南开大学揭示多模态模型中一个被忽视的重要偏置问题

上海大学曾丹团队联合南开揭示Vision - Language Models中普遍的attention偏置问题,提出无需重训的去偏方法,在多模型、策略及基准上验证有效性,为多模态模型部署提供新思路。

机器之心
新闻资讯7

拒绝透露姓名,却拿了两个世界第一:具身圈大佬们都在打听它是谁

世界模型赛道竞争激烈,焦点转向统一“预测世界”与“驱动行动”。神秘的MotuBrain模型悄登两国际benchmark榜首,在WorldArena和RoboTwin2.0表现出色,或走World Action Model路线,有望成统一架构代表。

机器之心
开源动态7

推出 AnyLanguageModel:在 Apple 平台统一本地与远程大语言模型的 API

大语言模型是构建现代软件的重要工具,但 Apple 平台开发者集成模型困难。Hugging Face 发布 AnyLanguageModel,是 Swift 包,可替代 Apple Foundation Models 框架,支持多模型服务商,降低使用 LLM 难度。

Hugging Face
新闻资讯7

看到苹果和谷歌重磅联合声明的时候,我正在用 Gemini 写代码

苹果与谷歌达成合作,下一代Apple Foundation Models将基于Google的Gemini模型和云技术构建,为Apple Intelligence功能提供底层支撑。此前Apple Intelligence节奏慢、能力跳票,苹果或借Gemini补短板。

MacTalk
开源动态7

Agent与工具交互平台级探索,只用接入一个MCP服务就能调用6000+工具

在模型性能趋同背景下,知识库、工具成AI应用差异壁垒。MCP规范Agent与工具交互,但在实际生产中有挑战。ACI.dev项目维护者Aipotheosis Labs探索简化Agent与外部工具集成等过程,对企业级应用有示范意义。

AI工程化
算法论文8

这家公司,“杀死”了他们的 AI 应用

脸谱心智(FaceMind)虽未关停「叠叠社」AI 应用,但开始押注底层世界模型研究。其论文提出 Looped World Models,带来 100× 参数效率提升,强调 AI 可靠更深内部推演获得能力,指出只做应用不够。

特工宇宙
新闻资讯7

B站爆了!Hermes首度直播回应「抄袭」,MiniMax提前杀入Harness赛点

Hermes Agent业务负责人回应抄袭质疑,技术对谈探讨AI竞争新维度。MiniMax动作密集,构建“Model + Harness”双向飞轮,其模型获海外开源圈认可,产品驱动模型优化,还与云厂商合作解决沙箱问题。

新智元
产品应用7

The Batch:834 | 更一致的人物与风格

德国 Black Forest Labs 的 FLUX.1 Kontext 系列文本生成图像模型,可可控编辑图像。有 max、pro 和 dev 版本,功能含角色一致性和图像编辑,在测试中表现优,公司计划公开专有评估基准。

DeeplearningAI
推荐文章7

重新定义Skill开发:保姆级教程&一站式开发助手发布

文章围绕Skill开发展开,介绍其定义、安装使用、创建、管理等内容,指出Skill替代重复任务,无法替代体验和判断。还分析Skill生态早期痛点,如跨平台一致性等,并推荐一站式Skill开发助手skill - dev - aio。

阿里云开发者
7

并行扩散架构突破极限,实现5分钟AI视频生成,「叫板」OpenAI与谷歌?

近日,CraftStory 推出 Model 2.0 视频生成系统,凭借并行扩散架构破解视频时长难题,可生成长达五分钟视频。其由 OpenCV 创建者 Victor Erukhimov 创立,此次突破或为企业带来商业价值,还计划开发新模型。

机器之心