You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

R语言实现:筛选可经字母重叠拼接加入单词列车的词汇

R语言单词列车匹配问题

基础定义与初始数据

  • 初始单词向量(包含3个基础单词):
first_string <- c("self", "funny", "nymph")
  • 单词列车(word train):将一组单词通过首尾字母重叠的方式拼接得到的连续字符串,重叠的字符长度没有固定限制。例如上述3个基础单词可拼接为selfunnymph:其中self和funny重叠1个字符(末尾/开头的f),funny和nymph重叠2个字符(末尾/开头的ny)。
  • 待筛选的候选单词向量:
second_string <- c("house", "garden", "duck", "evil", "fluff")

筛选规则与输出要求

从候选单词向量中筛选所有可加入原有单词列车的单词,规则如下:

  • 加入新单词时,允许调整原有3个基础单词的排列顺序,无需固定初始单词的先后位置,只要新单词和3个基础单词最终能通过首尾重叠拼成完整连续的单词列车即可。例如若候选词包含hugs,可调整原有单词顺序,按nymph→hugs→self→funny的顺序拼接,依次重叠h、s、f三个单字符,得到完整单词列车nymphugselfunny。
  • 筛选完成后需返回结构化结果,包含匹配到的单词、以及对应拼接完成的完整单词列车。示例中符合要求的单词为house和fluff,预期输出格式如下:
expected <- data.frame(word= c("house", "fluff"), word_train= c("selfunnymphouse", "selfluffunnymph"))

两个匹配词的拼接逻辑:

  • house可拼接在初始顺序拼成的selfunnymph末尾,得到selfunnymphouse
  • fluff可插入self和funny之间,得到selfluffunnymph

内容的提问来源于stack exchange,提问作者LulY

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.27 11:06:18