「AI产品评测」共找到 10515 篇相关文章

开源动态8

完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美元,复现DeepSeek的强化学习!

Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美元,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。

AI科技大本营
推荐文章7

LangChain官方实测:多智能体架构怎么选?

构建AI Agent时,单智能体应对复杂场景易“变笨”且难维护。LangChain官方评测主流多智能体架构,在复杂零售场景实验,对比单智能体、Swarm、Supervisor架构的性能、成本,还给出优化Supervisor架构的方法。

探索AGI
产品应用7

Claude Skills|将 Agent 变为领域专家

今年10月,Anthropic推出Claude Skills能力,可在Claude多产品使用。它是向Agent注入内部知识的标准化方案,与MCP可协同工作,还介绍了实现Agent Skills的方法及主动式智能导购AI助手构建。

阿里云开发者
新闻资讯7

Mira Murati新公司获20亿美元融资,估值100亿美元

金融时报消息,前OpenAI首席技术官Mira Murati创立的AI公司“Thinking Machines Lab”获20亿美元种子轮融资,估值100亿美元。公司致力于开发人工通用智能,目前对产品和技术细节高度保密。

AIGC开放社区
算法论文7

ACL2025 | 代码助手火了,但安全吗?所有模型评估结果都很扎心

近期,GitHub Copilot、ChatGPT等AI代码生成工具爆火,效率显著提升,但代码安全性存疑。北大团队用CoV-Eval评测20款主流大模型,结果不佳,论文还给出优化方向,呼吁代码上线前严格测试。

深度学习自然语言处理
新闻资讯7

这个免费的任务助手登顶 SuperCLUE-XClaw 榜单

近日,SuperCLUE - XClaw发布最新测评榜单,百度文心助手在十个参评的国产龙虾产品中夺冠,获97.62分。SuperCLUE是关注中文大模型评测的第三方体系,其榜单受业内关注。文心助手还是免费的。

AI进修生
新闻资讯7

独家|地平线前高管牛建伟成立叮当动力,专注空间智能,获地平线领投数千万元投资

《AI科技评论》独家消息,前地平线智能座舱产品线总经理牛建伟创立叮当动力,专注空间大模型的通用具身智能,获地平线领投数千万元种子轮融资。牛建伟经验丰富,团队提出独特解决方案,产品聚焦多元场景。

AI科技评论
产品应用8

月耗3000美金的Skills重度用户,实测MiniMax M2.7:国产Agent模型的天花板?

AI产品黄叔作为月耗3000美金的Skills重度用户,实测MiniMax M2.7,从多Agent协作、Coding能力、办公自动化等多方面测试,发现其表现出色,虽有不足,但在多维度已是国产模型天花板。

AI产品黄叔
开源动态8

Qwen3-VL-Embedding系列上新:探索统一多模态表征与排序

2025年6月曾开源Qwen3-Embedding和Qwen3-ReRanker,现推出Qwen3-VL-Embedding和Qwen3-VL-Reranker。它们基于Qwen3-VL构建,能处理多模态输入,在多任务达业界领先,还介绍了特性、评测及使用方法。

通义千问Qwen
推荐文章8

被轻视的巨大市场,大厂做不好的Local Agent为何难?| 甲子光年

文章指出大模型边际收益递减,AI竞赛规则生变,产业从‘参数竞赛’转向‘效率革命’。本地Agent有潜力,但主流产品体验差。GreenBitAI深耕低比特模型,推出Libra,有望撬开万亿美元增量市场。

甲子光年