锚点验证框架」共找到 2342 篇相关文章

算法论文8

微软推出深度视频探索智能体,登顶多个长视频理解基准

尽管LLMs和VLMs在视频分析和长语境处理有进展,但处理数小时长视频有局限。微软提出智能体Deep Video Discovery (DVD),以简洁框架在LVBench取得高准确率,将以MCP Server形式开源。

机器之心
算法论文8

精准调控大模型生成与推理!浙大&腾讯新方法尝试为其注入“行为定向剂”

ACL 2025中选论文里,浙大与腾讯联合团队提出STA方法,深入模型内部分析神经元激活模式,干预关键神经元,抑制有害行为、保留通用性能,还在多模型实验验证效果,并将部分方法开源。

量子位
推荐文章7

图解Vllm V1系列4:加载模型权重(load_model)

文章聚焦vllm加载模型权重的流程。从入口函数切入,详细分析DefaultModelLoader的工作步骤,包括初始化模型架构和实际加载权重,还给出各步骤代码及作用,为想操作load_model的人提供框架

GiantPandaLLM
新闻资讯7

Anthropic CEO:人的幻觉比AI 更多!这是真的吗?

Anthropic公司CEO称AI幻觉比人类少,创业公司ColdIQ联合创始人Alex Vacca用虚构故事喂给ChatGPT、Claude和Gemini,测试它们识破谎言的能力,实验结果显示各模型表现不同,AI幻觉短期内难消失。

AGI Hunt
推荐文章7

什么!我把SQL编辑器装进了大模型?

文章介绍基于约束解码技术,结合CFG、Jinja模板和XGrammar框架,为大模型SQL生成配备“编辑器”。它能保证语法正确、遵循规则,还具灵活性。但面临约束干扰和性能瓶颈,未来可简化配置惠及更多用户。

阿里云开发者
产品应用7

V0 模型直接进驻 Cursor,UI 生成效果炸裂,氛围编码体验再升级。

AI 编码赛道竞争激烈,Vercel 的 V0 发布 AI 模型,可在 Cursor 中使用,还推出新工作流提升 UI 生成效果。文中介绍了 V0 特点、Cursor 设置方法及使用演示,还分析了 Vercel 自研模型的原因。

AI进修生
新闻资讯7

三金,又是中国队!全球机器人视触融合挑战赛揭榜

ManiSkill - ViTac 2025视触觉融合挑战赛揭榜,全球42支团队参赛,中国两家具身初创公司包揽三金。该赛事聚焦视触觉融合技术,为机器人行业搭建从实验室到现实应用的桥梁,推动相关算法和硬件进步。

新智元
算法论文8

清华刘知远团队:高质量LLM训练数据获取新方法!成本降90%,性能大提升

清华刘知远团队论文提出全新数据筛选方案,解决传统数据筛选验证慢、主观性强问题。发明‘半成品加工法’降成本,用fastText筛数据,筛出Ultra - FineWeb数据集,提升模型性能,还计划拓展到专业领域。

深度学习自然语言处理
新闻资讯8

中国 AI 投资人:练习时长两年半

文章是对多家投资机构的访谈,探讨AI投资与创业趋势。涉及Manus成功经验、DeepSeek影响、模型公司前景、应用机会等,还谈及创业者应对策略、投资策略变化及行业未来思考。

Founder Park
算法论文8

Arc研究所造出能“举一反三”的虚拟细胞模型,破解跨细胞预测难题

生物学和药物研发中,因细胞组合庞大,难以全实验验证,且同药在不同细胞效果不同。Arc Institute 团队推出虚拟细胞模型 STATE 及评测套件 Cell - Eval,STATE 预测效果优,但也存在短板。

DeepTech深科技