大模型可观测」共找到 9167 篇相关文章

新闻资讯7

AI圈深夜乱斗!OpenAI、谷歌、Anthropic发布新模型,集体翻车?

昨晚,OpenAI时隔六年再次开源`gpt-oss-120b`和`gpt-oss-20b`,Anthropic发布`Claude Opus 4.1`,Google发布Genie 3及写故事书功能。不过OpenAI新模型幻觉率高,Anthropic更新提升有限。

探索AGI
产品应用7

Qwen3接连放出No Thinking, Thinking两模型,Gemini2.5 pro顶不住啦

Qwen推出非推理模型`Qwen3 - 235B - A22B - Instruct - 2507`后,又放出推理模型`Qwen3 - 235B - A22B - Thinking - 2507`。非推理模型在多方面功能增强,推理模型能力强,超DeepseekR1,可试用。

CourseAI
开源动态8

从今天起,开源前五,全!是!中!国!!模!型!

短短一年,LMArena开源模型榜单前五全被中国模型占领,智谱Z.ai登顶,阿里、DeepSeek等紧随其后。LMArena是权威评测平台,盲测机制保证排名真实。中国模型性价比高,正用开源和低价占领市场。

AGI Hunt
新闻资讯8

独家解读|2025年AI五趋势与底层数据革命

2025 年 AI 发展重心转移,高质量数据成新基石。本文解读五技术趋势,如多语种 TTS 与全双工交互、多模态模型等,还介绍了各趋势的数据需求及数据堂提供的相应数据服务方案。

机器之心
产品应用8

Agent、图像、视频全是版本升级:春晚还没开,豆包AI就火了

2026年AI市场竞争激烈,海外公司密集发布新模型致华尔街震动。国内腾讯、阿里、字节参战,字节官宣豆包参与春晚互动。2月14日火山引擎宣布豆包系列模型全面升级,含模型2.0、图像模型Seedream 5.0 Lite、视频模型Seedance 2.0。

机器之心
新闻资讯8

不只是DeepSeek V4,还有个万亿级模型,训推全程国产芯片

2026年4月24日,DeepSeek发布新一代模型DeepSeek - V4系列预览版并开源。同日,美团用全国产算力集群训练出万亿参数模型LongCat - 2.0系列预览版,训推全流程摆脱英伟达,在国产算力支撑万亿级模型研发上取得突破。

机器之心
新闻资讯8

中国AGI深度时刻!杨强、唐杰、林俊旸、姚顺雨咖们2026开年重磅交锋

2025年中国开源模型表现出色,AI模型探索新范式。AGI - Next前沿峰会嘉宾探讨AGI发展,指出模型To C与To B市场逻辑分化,还谈及自主进化、智能体变革及中国AI发展路径等问题。

AIGC开放社区
开源动态8

HF日趋榜一!真端到端模型AutoDeco终结手动调参解码

语言模型手动调参解码繁琐,腾讯AI Lab王琰团队联合港中(深圳)唐晓莹教授团队推出AutoDeco架构,通过创新训练策略让模型动态预测解码参数,在多模型实验中表现出色且已开源。

机器之心
产品应用8

震惊海外开发者!BOSS直聘3B小模型比肩80B,怎么做到的?

BOSS直聘楠北阁团队发布3B轻量端侧小模型Nanbeige4.1-3B,性能震惊海外开发者。团队从多方面改进,如优化推理和偏好对齐,重构训练数据,采用多种强化学习算法,使其性能比肩模型

AIGC开放社区
新闻资讯7

AI遭遇灵魂拷问!这道题所有模型集体翻车,网友:我也不会啊

图像推理现新难题,在Reddit引发热议,目前无AI能真正解决。国内外支持图像输入的模型答案不同,原因是对立方体规格理解不同。结合提示多次尝试,部分模型能找准方向,人类面对该问题也会困惑。

量子位