Efficient Video Transformers via Spatial-temporal Token Merging for Action Recognition.

Saved in:
Bibliographic Details
Title: Efficient Video Transformers via Spatial-temporal Token Merging for Action Recognition.
Authors: Feng, Zhanzhou1, fengzz@stu.pku.edu.cn, Xu, Jiaming2, 2000012915@stu.pku.edu.cn, Ma, Lei3, lei.ma@pku.edu.cn, Zhang, Shiliang1, slzhang.jdl@pku.edu.cn
Source: ACM Transactions on Multimedia Computing, Communications & Applications; Apr2024, Vol. 20 Issue 4, p1-21, 21p
Database: Applied Science & Technology Source
FullText Links:
  – Type: pdflink
Text:
  Availability: 0
Header DbId: aci
DbLabel: Applied Science & Technology Source
An: 174779270
AccessLevel: 2
PubType: Academic Journal
PubTypeId: academicJournal
PreciseRelevancyScore: 0
IllustrationInfo
Items – Name: Title
  Label: Title
  Group: Ti
  Data: Efficient Video Transformers via Spatial-temporal Token Merging for Action Recognition.
– Name: Author
  Label: Authors
  Group: Au
  Data: <searchLink fieldCode="AU" term="%22Feng%2C+Zhanzhou%22">Feng, Zhanzhou</searchLink><relatesTo>1</relatesTo>, <i>fengzz@stu.pku.edu.cn</i><br /><searchLink fieldCode="AU" term="%22Xu%2C+Jiaming%22">Xu, Jiaming</searchLink><relatesTo>2</relatesTo>, <i>2000012915@stu.pku.edu.cn</i><br /><searchLink fieldCode="AU" term="%22Ma%2C+Lei%22">Ma, Lei</searchLink><relatesTo>3</relatesTo>, <i>lei.ma@pku.edu.cn</i><br /><searchLink fieldCode="AU" term="%22Zhang%2C+Shiliang%22">Zhang, Shiliang</searchLink><relatesTo>1</relatesTo>, <i>slzhang.jdl@pku.edu.cn</i>
– Name: TitleSource
  Label: Source
  Group: Src
  Data: <searchLink fieldCode="JN" term="%22ACM+Transactions+on+Multimedia+Computing%2C+Communications+%26+Applications%22">ACM Transactions on Multimedia Computing, Communications & Applications</searchLink>; Apr2024, Vol. 20 Issue 4, p1-21, 21p
PLink https://search.ebscohost.com/login.aspx?direct=true&site=eds-live&db=aci&AN=174779270
RecordInfo BibRecord:
  BibEntity:
    Identifiers:
      – Type: doi
        Value: 10.1145/3633781
    Languages:
      – Code: eng
        Text: English
    PhysicalDescription:
      Pagination:
        PageCount: 21
        StartPage: 1
    Titles:
      – TitleFull: Efficient Video Transformers via Spatial-temporal Token Merging for Action Recognition.
        Type: main
  BibRelationships:
    HasContributorRelationships:
      – PersonEntity:
          Name:
            NameFull: Feng, Zhanzhou
      – PersonEntity:
          Name:
            NameFull: Xu, Jiaming
      – PersonEntity:
          Name:
            NameFull: Ma, Lei
      – PersonEntity:
          Name:
            NameFull: Zhang, Shiliang
    IsPartOfRelationships:
      – BibEntity:
          Dates:
            – D: 01
              M: 04
              Text: Apr2024
              Type: published
              Y: 2024
          Identifiers:
            – Type: issn-print
              Value: 15516857
          Numbering:
            – Type: volume
              Value: 20
            – Type: issue
              Value: 4
          Titles:
            – TitleFull: ACM Transactions on Multimedia Computing, Communications & Applications
              Type: main
ResultId 1