跨语言能力」共找到 4193 篇相关文章

新闻资讯8

OpenAI发布GPT-5.4:首个原生接管电脑通用模型

OpenAI发布GPT-5.4及满血版GPT-5.4 Pro,主打专业生产力。它具备原生电脑操作能力,视觉感知、职场任务表现提升,幻觉问题被压制,代码能力强,工具调用机制优化,已在ChatGPT等全量上线,API定价上调。

AI寒武纪
算法论文8

0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈

语言模型在推理任务依赖思维链技术,传统PEFT方法需修改大量参数,新兴ReFT虽只需调整少量参数,但存在不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟新路径。

深度学习自然语言处理
新闻资讯7

Meta 重金抢人,明星云集就能复制 DeepSeek 的成功吗?

Meta 扎克伯格亲自出手重金招人,组建豪华 AI 战队,核心领导与技术阵容都很强大。但天才招聘只是第一步,组织天才协同才关键。DeepSeek 团队规模小、扁平化,成功逆袭。Meta 难复制其成功,组织重构能力或更重要。

AI科技评论
开源动态8

500美元刷新SOTA!训练成本砍到1/200,华人团队重构视频生成范式

香港城市大学等团队发布图像 - 视频生成模型Pusa V1.0,在基础大模型上引入VTA机制,用3860对视频 - 文字数据、约500美元微调,在I2V超越Wan - I2V - 14B实现SOTA,还解锁零样本任务能力

量子位
新闻资讯7

OpenAI最强对手出现!马斯克发布Grok-4,性能碾压Claude 4两倍!

半小时前马斯克发布Grok - 4,虽Grok3.5跳票、直播迟到被吐槽,但它训练量和算力投入大。在多项基准测试中碾压Claude Opus 4,还具备原生工具调用等能力,xAI目标是让其更快更智能。

探索AGI
推荐文章8

API7.ai创始人温铭:烧了几百亿Token,我用AI重写了生产级网关,总结出6条经验

API7.ai创始人温铭分享用AI重写生产级网关经验。他认为AI编码能力超资深工程师,瓶颈在人。还介绍在公司‘禁手写代码’的情况,以及AI代码审查、使用阶段等内容,最后说明重写AI网关AISIX的原因。

InfoQ
产品应用8

智谱开启狂飙模式!7倍提速,全球最快,旗舰模型即问即答

5月22日,智谱上线GLM - 5.1高速版API,输出速度达400 tokens/s,刷新全球大模型API速度纪录,比原版提速约7倍。该速度由GLM团队和TileRT团队联合打造,核心优化分三层推进,且是稳定可用的生产级能力

AIGC开放社区
开源动态7

Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!

8月17日,阿里发布的Qwen3.8 - 27B成Hugging Face热门第一。它以27B参数在部分测试中与前沿闭源模型比肩,可本地运行。不过推理慢、真实任务表现待提升,它让前沿Agent能力下放到个人电脑。

AI科技评论
产品应用7

每周2亿年轻人用ChatGPT,却连高手的零头都没用出来

全球超2亿18 - 24岁年轻人用ChatGPT,高阶用户调用能力仅为超级用户1% - 10%。OpenAI推出三款教育插件,分别针对K - 12老师、大学老师和大学生,还搭建教育闭环,不过教学权仍在教师、学校和政府手中。

新智元
推荐文章8

让外部知识“长入”模型:动态化与参数化 RAG 技术探索

检索增强生成(RAG)成大语言模型利用外部知识主流范式,但传统方法将其当黑箱,忽略动态需求和机制鸿沟。艾清遥博士介绍动态化和参数化检索增强技术,可提升准确性与适应性,减少计算开销。

AI前线