「多语言能力」共找到 6938 篇相关文章
Anthropic 那个“强到不敢发”的模型,终于来了!
今天凌晨,Anthropic 发布新模型 Claude Mythos Preview,它曾被指‘强到不敢发’。该模型能力跃升,尤其网络攻防能力突出,但因具‘双重用途’仅向少数伙伴开放,用于防御性网络安全项目。
71.2%的惊人解决率,伦敦大学开源顶级AI代码修复智能体系统
伦敦大学等发布Prometheus AI系统,它将代码库变成知识图谱,解决9种编程语言的GitHub问题。由五个智能体协作,解决率高、成本低且已开源,或为AI编程新方向。
Embedding黑箱成为历史!这个新框架让模型“先解释,再学Embedding”
来自多高校研究人员推出可解释的生成式Embedding框架GRACE,解决传统文本表征模型黑箱式表征瓶颈。它重新定义对比学习信号,含三个关键模块,训练双模式统一,实验跨任务提升且不损生成能力。
开发者狂喜:Thinking Machines发布首款产品Tinker,后训练麻烦全给包了
OpenAI前CTO创办的Thinking Machines推出首款产品Tinker,这是用于微调语言模型的API,能简化LLM后训练过程,支持前沿模型,使用LoRA技术降低成本,还发布开源库,多高校团队已试用。
【开源】build-your-own-x:30+领域造轮子教程,程序员内功提升指南
开源项目 build-your-own-x 收录 30+ 领域「从零造轮子」教程,解决学编程只知用不知原理的问题。涵盖 3D 渲染、AI 模型等多领域,多语言可选。介绍学习好处、使用方法,还推荐优质教程。
面壁MiniCPM-V4.5新王炸!8B手机10FPS长视频秒懂,文档手写全能识别!
面壁上新最强端侧多模态模型MiniCPM-V 4.5,基于Qwen3 - 8B与SigLIP2 - 400M构建,总参数量8B。它视觉语言理解强、手机能跑,有高帧率视频理解等特点,还有多方面技术亮点。
DeepSeek-R1 更新,思考更深,推理更强
DeepSeek R1 模型完成小版本升级至 DeepSeek - R1 - 0528,用户可在官网、APP 等体验,API 同步更新。该版本强化深度思考能力,在多基准测评表现优异,还改善幻觉、提升创意写作等能力。
LabVLA:当AI走进科学实验室,浙大x上海 AI Lab联合探索科学具身智能
浙江大学与上海人工智能实验室联合推出 LabVLA,探索更具泛化能力的科学具身智能范式。团队构建仿真数据引擎 RoboGenesis 与语料 LabEmbodied - Data,LabVLA 在多测试中表现良好,还将探索多场景应用。
靠 AI起飞的千亿市值公司,如今要被AI“卷死”了?股价因GPT-5瞬间逆转、CEO亲承:我负有责任
语言学习平台 Duolingo 推行‘AI 优先’战略,虽遭反对但营收增长、股价上涨。不过 OpenAI 推出 GPT - 5 后,其股价急转直下,CEO 称对公众困惑负责,还被律所调查。
大模型能否为不同硬件平台生成高性能内核?南大、浙大提出跨平台内核生成评测框架MultiKernelBench
深度学习计算依赖底层内核,当前多由开发者手工编写。南大、浙大推出开源评测框架MultiKernelBench,打破现有评测基准局限,构建模块化评测体系,多模型实测,还指出LLM短板并明确未来方向。