「多任务操作」共找到 5661 篇相关文章
斩获7.4K标星!NotebookLM的终极开源平替,私有化多模态播客一键生成!
Google的Notebook LM虽能上传资料一键生成播客总结,但有数据隐私等问题。近期GitHub上的Open Notebook获7.4K标星,它复制并超越前者功能,强调数据主权,有多项亮点且部署灵活。
Mamba-3惊现AI顶会ICLR 2026!CMU知名华人教授一作首代工作AI圈爆红
Transformer有力挑战者Mamba的最新版本Mamba-3进入ICLR 2026盲审。它有三大改进,在长文本处理、实时推理和成本优化有优势。此外,FBAM也从不同角度探索Transformer下一代框架。
OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力
主流OCR评测基准聚焦信息抽取任务,而图文推理任务缺乏系统性评估标准。OCR - Reasoning可系统性评估多模态大模型深度推理能力,还给出多种推理示例,并展示了测评Qwen2.5 - VL - 7B模型的代码。
干货的一天 -【MCP协议驱动的AI新范式】峰会活动精彩回顾
2025年6月14日,“MCP协议驱动的AI新范式”峰会在上海举办。活动汇聚多企业专家与社区代表,通过主题演讲和工作坊,深度探讨MCP协议在技术、商业及生态建设中的价值,多位专家分享见解与技术成果。
ICLR 2025 Oral | LLM也有从众心理!
浙江大学团队论文指出,多AI协作系统存在“群体思维”,多个AI共同决策时会盲目跟多数意见。研究者开发BenchForm测试平台验证LLM从众行为,还分析原因、给出让LLM更独立的方法,指出从众利弊及未来挑战。
Claude Code新功能Auto Mode能否替代人工审核?首个压力测试来了
随着AI coding agent走向“直接执行开发操作”,Anthropic为Claude Code推出Auto Mode。香港科技大学与ETH Zurich研究团队对其进行首个系统压力测试,发现Auto Mode端到端误放行率达81.0%,部分危险操作绕过审核。
英伟达发布了跨 AI、机器人和自动驾驶的开放模型、数据集和工具
英伟达发布涵盖多领域的开放模型、数据集和开发工具,扩展多个模型家族。代理式AI领域扩展Nemotron;机器人技术引入Cosmos;自动驾驶有Alpamayo;医疗保健有Clara相关模型。均开放许可,可经GitHub等访问。
一天 15k 星,代码生成碾压 Claude,连 Cursor 都慌了?谷歌 Gemini CLI 杀疯了
谷歌发布 Gemini CLI,是其 AI 助手终端版,有慷慨免费使用配额。它开源且功能多,支持多平台。接入 Gemini 2.5 Pro 通用模型,开发者反馈其代码生成和修复能力强,谷歌在代码能力上提升明显。
模型一个没换,正确率翻了近三倍,这个项目有点东西啊!
GitHub开源项目AutoResearch用同一模型答题,其EvoMap蜂群模式使正确率近三倍于单Agent和常见Sub - Agent模式。它是多Agent评审系统,靠蜂群机制让AI自动科研,还有诸多防幻觉等特点,能用于多场景优化。
华为助力全球运营商以网为基,以智为翼,业网算协同创新,迈向Token经营新征程
在2026 MWC上海,华为以“业网算协同创新,共赢Byte+Token双增长”为主线,与全球运营商等共话行业发展。华为副董事长汪涛解读移动通信未来十年关键命题,展会发布多领域创新成果,还将携手运营商深耕多领域。