大厂AI」共找到 11977 篇相关文章

开源动态8

最鲁棒的MLLM!港科开源「退化感知推理新范式」 | AAAI'26

多模态语言模型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港科等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。

新智元
开源动态8

DeepEval:LLM 应用评测不再玄学,让模型评测像写单元测试一样简单

模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。

AI工程化
算法论文8

单卡即可微调模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技学和香港中文学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
新闻资讯7

用得越多、失业越快?GitHub 改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!

当地时间3月26日,GitHub宣布自4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练改进AI模型,但用户可手动退出。它称此举因模型需更多数据,还拿微软等挡枪,却遭开发者吐槽。

InfoQ
算法论文8

LLM工业级自进化:北邮与腾讯AI Lab提出MoE-CL架构,解决模型持续学习核心痛点

北邮百家AI团队与腾讯AILab提出MoE - CL架构用于LLM自进化持续指令微调。其结合‘解耦LoRA专家’与‘GAN对抗降噪’,在腾讯业务及基准测试中效果佳,降低人工成本,准确率优于主流方法。

机器之心
开源动态8

碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用能力超强

国内模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用能力强。测试显示其性能碾压DeepSeek V3等模型,训练流程还有独特技术创新。

AIGC开放社区
产品应用8

豆包输入法Mac版正式上线,所有人都该试试AI语音输入了。

豆包输入法Mac版正式上线,作者推荐家用其语音输入与AI对话。如今语音输入法渐成熟,能提升输入速度与质量。豆包输入法免费,体验好,有流式输出、自动纠错、中英混说、轻声抗噪等功能。

数字生命卡兹克
开源动态8

AI安全上,开源仍胜闭源,Meta、UCB防御LLM提示词注入攻击

Meta和UCB开源安全语言模型Meta - SecAlign - 70B,其对提示词注入攻击鲁棒性超闭源方案,还具更好的agentic ability。介绍了提示词注入攻击背景、防御方法,该模型打破闭源垄断,开源代码助力安全AI建设。

机器之心
新闻资讯8

模型七连发,外国人馋透了!阿里云栖会全栈升级够狠

阿里在2025云栖会全栈升级,发布七款通义新模型,从基础模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。

机器之心
新闻资讯7

打脸哲学无用!牛津博士教出Claude,自曝百万年薪提示词秘诀

Anthropic驻场哲学家Amanda Askell主导设计Claude的性格等机制,她分享制定有效AI提示词方法,认为需哲学思维。此外还提及不同人对提示词看法,以及模型存在的「裂脑问题」。

新智元