「小喵希拉」共找到 1157 篇相关文章
Meta&CMU:Token级LLM协同路由新范式
Meta AI、CMU等联合推出FusionRoute,是让多个大模型在token级协作的新范式。它能在每个token位置精准选专家,自带“急救包”。经实验验证其高效,也指出了待研究的方向。
为什么Agent总是Demo猛如龙实战一条虫?
一篇51页论文研究主要智能体,指出适应性是关键。它提出2×2分类框架将适应方法分四大范式,还明确不同范式优缺点,发现T2范式数据效率远超A2。最后点明Agent适应性研究的四个前沿方向。
Unsloth让大模型跑在手机上!
Unsloth放出教程,可将其微调模型部署到Pixel 8和iPhone 15 Pro。用ExecuTorch技术优化,Qwen2 - 0.5B在旗舰机上表现流畅。教程介绍量化感知训练控制精度损失,还给出iOS和Android部署步骤及注意事项。
微软又上大分!刚刚开源一款 0.5B 轻量级实时 TTS 模型,还能边想边说!
2025 年大家致力于解决 AI「嘴巴」问题,追求实时流式对话。微软刚开源轻量级 TTS 模型 VibeVoice-Realtime - 0.5B,参数虽小但能边输入边朗读,有诸多特点和广泛应用场景。
又一 AI 视频创作产品火了,用户抢着付费,附实测
Flova 这款 AI 视频创作产品火了,用户抢着付费。它是人和 AI 协作共创的通用视频创作 Agent,无需专业知识,通过对话和故事板完成创作,还支持修改部分内容、一键回溯等,有多种高级玩法。
12ms!一个仅8M的语音停顿检测模型
语音助手准确判断用户是否说完是挑战,Smart Turn将决策过程缩至12毫秒。其v3.1版有改进,新增数据集提升英语识别准确率,推出未量化版本推理更快,8MB模型性能优,已在HuggingFace开源。
OpenAI Atlas等AI浏览器暴露Web Agent安全风险!南洋理工破解底层机制
OpenAI Atlas等AI浏览器提升网页自动化效率,但使智能爬虫威胁加剧。南洋理工等团队研发的WebCloak,混淆网页结构与语义,打破爬虫技术依赖,为数据安全筑防线,适用于数据敏感场景。
OpenAI 万字报告: 不要再卷Agent了~
OpenAI《How People Use ChatGPT》报告显示,73%的ChatGPT用途与工作无关,用户多将其用于实用建议、信息查询和写作。Asking对话占比及满意度更高,机会藏在人类惰性里。
谷歌发布AP2协议,联手PayPal放大招:AI要自己下单了
2025年9月17日,谷歌推出智能体支付协议AP2并开源,宣布与PayPal战略合作。AP2通过‘授权令牌’解决AI下单信任问题,设计三种场景令牌,还采用角色架构保证安全,谷歌联合超60方搭建生态。
GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”
多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。