「数据获取」共找到 2605 篇相关文章
无需任何 API 费用,这个Agent 拥有“看遍全网”的超能力
AI Agent 在网络信息获取上存在诸多难题,而 Agent Reach 能解决这些问题。它免费开源、安全且持续更新,兼容所有 Agent,支持多平台。安装简单,装好即可用,各渠道还能灵活替换。
罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!
Meta、OpenAI、xAI联合发表成果CharacterFlywheel,聚焦在生产环境提升社交型AI对话能力。团队基于LLaMA 3.1迭代15个版本,7/8的A/B测试显示正向提升,介绍了架构、数据管道、奖励模型等内容。
太野了!某龙虾自爆安全漏洞
国内几家厂商上线基于 OpenClaw 的 Claw AI Agent 产品,功能强大。作者测试其中一家,发现它轻易暴露大量信息和安全漏洞,如 Claude API 代理无认证、IMDS 元数据服务无防护等。建议相关厂商自查加固。
首个测试时共进化合成框架TTCS:在「左右互搏」中突破推理瓶颈
厦门大学DeepLIT课题组提出全新测试时课程合成框架TTCS,不依赖外部标注,通过生成器与求解器共进化博弈合成课程数据,解决测试样本过难导致的训练坍塌问题,实验显示其推理能力提升显著。
超越Skill?又一新技术让AI编码准确率从53%跃升至100%
Jude Gao主导的新研究带来上下文工程新发现,仅改动8KB的AGENTS.md文件,就让AI编码智能体表现从53%跃升至100%。对比Skills和AGENTS.md两种方案,后者完胜,还解决了上下文膨胀问题。
大模型微调评测入门:看懂这些指标,才知道模型好不好
文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。
Meta&UIUC大发现:无需标注,Agent复杂的工具使用和搜索能力,是可以“无中生有”的
Meta和UIUC研究发现,无需标注,Agent复杂工具使用和搜索能力可“无中生有”。论文Dr. Zero让大模型自我博弈成搜索专家,用HRPO提效,设计难度导向奖励,实验表现佳,但也存在局限。
AI 味的原因找到了,都是 NTJ 惹的祸
作者因常被说说话像AI,好奇大模型MBTI类型。实验发现Claude - 4、Gemini - 2.5 - pro、GPT - 4为INTJ,DeepSeek是ENTJ。分析了大模型呈现NTJ特质的原因、AI味根源,还给出让大模型有情感的思路和使用技巧。
空间智能终极挑战MMSI-Video-Bench来了,顶级大模型全军覆没
上海人工智能实验室 InternRobotics 团队推出空间智能视频基准 MMSI-Video-Bench,对主流多模态大模型进行评测。该基准题型全面、问题具挑战性,视频数据多样,能针对性测评。结果显示模型与人类差距显著,明确了能力瓶颈。
基于一个MXFP8量化Kernel谈一谈如何在B200上实现高性能的Memory Bound Kernel
作者向SGLang社区提交基于CUTLASS的MXFP8 Blockscaled Grouped GEMM实现,其中包含量化Kernel。文章关注此Kernel,介绍在B200上实现高性能Memory Bound Kernel的优化技术,如整体设计、向量化与合并访问、Occupancy优化、TMA利用等。