「video2code」共找到 2780 篇相关文章
DeepSeek视觉原语论文:当所有人在堆图像分辨率时,它在堆「指代精度」!
4月30日DeepSeek发布多模态论文,核心是“视觉原语”,让模型边推理边输出坐标。它是七大coding agent玩家中最后接入视觉的,但补课方式反共识,不堆分辨率堆指代精度,效率高,拓扑推理成绩领先。
开源「洁癖.skill」,让你的Agent越用越聪明。
作者开源了名为洁癖.Skill的工具,它能在Agent完成功能或解决BUG后,自动审查项目文档体系和记忆文件并迭代,适用于Claude Code、Codex等四个平台,解决上下文混乱问题,让Agent越用越聪明。
蚂蚁技术研究院副院长吕乐当选美国医学与生物工程院(AIMBE)Fellow
美国医学与生物工程院(AIMBE)公布2026届Fellow入选名单,蚂蚁集团技术研究院副院长吕乐博士当选。该机构Fellow评选是领域最高荣誉之一,仅授予全球前2%顶尖人才。吕乐在医疗AI贡献突出。
《动手写AI Agent》50 行代码,你的第一个 Agent
文章教你用50行代码打造能读文件、跑命令、自主决策的AI Agent Ling。介绍用JSON Schema给LLM装工具,通过循环让LLM按需调用工具,还给出运行示例及与Claude Code的对照。
全网都在扒的小米MiMo团队,几乎被“北大学子”承包了
小米MiMo-V2-Pro模型登上OpenRouter调用量榜单第一后,网友关注其团队。该团队成立一两年冲到顶尖,核心作者多来自北大,技术理念受小米产品基因驱动,成功是多重因素叠加结果。
Karpathy刚刚敲响警钟:大模型的“终极之战”打响!Agent大军即将全面接管研发
Andrej Karpathy发布新项目autoresearch,人改提示词,AI改训练代码。经约2天微调,找到约20个降低验证损失的修改,提升排行榜成绩。Agent还发现多项重要改进点,未来前沿LLM实验室或走此路。
破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%
来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,能降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。
Claude被美封杀后,Anthropic CEO回应一切!
2025年7月Anthropic与五角大楼签2亿美元合作合同,因提出AI不得用于全自主武器及大规模国内监控遭拒。美国防部长称其技术有“国家安全供应链风险”,Anthropic CEO回应坚持红线是捍卫美国价值观。
震惊!如果AI掌控核按钮,95%的情况它会按下去
伦敦国王学院研究者让GPT - 5.2、Claude Sonnet 4和Gemini 3 Flash三款模型模拟核危机博弈。不同时间框架下模型表现不同,还展现复杂战略推理能力,95%对局用了战术核武,暴露诸多问题。
从GLM-4.5到GLM-5,我见证了一个模型从码农晋升为架构师
智谱以匿名方式将GLM - 5放到OpenRouter公测,其表现亮眼。在AI编程从Vibe Coding转向Agentic Engineering的背景下,GLM - 5参数规模提升,成绩优异,实测决策有架构师思路,持久力强,不再只是‘平替’。