視覺理解與索引
將圖片與影片轉換為結構化、可搜尋的表示,具備物件、動作、場景與事件辨識,以及長影片的時間切分。
Reka 是一家多模態 AI 公司,打造用於影片、圖片、音訊與文字的模型與基礎架構。網站重點介紹了一系列模型,包括 Spark、Edge、Flash 與 Core,同時也提供推論、視覺理解與訓練資料生成產品。
其公開產品面向圍繞 Reka Vision,用於對影片與圖片內容進行搜尋與推理;infer 用於多模態推論;以及 Claru 用於建立訓練資料。Reka Labs 也發表了針對實體 AI 與邊緣部署的研究與開放權重模型。
將圖片與影片轉換為結構化、可搜尋的表示,具備物件、動作、場景與事件辨識,以及長影片的時間切分。
支援跨圖片與影片的自然語言搜尋,包括跨幀與跨場景檢索,以及長時段事件探索。
可從長影片產生重點、摘要與片段,並根據使用者意圖進行重點偵測,且由語音辨識產生字幕。
透過對跨時間的視覺內容進行推理來回答複雜問題,包括多步驟推理、基於時間的查詢,以及跨模態問題。
描述了一個用於多模態 AI 的推論引擎與 API,為速度、規模與企業級可靠性而打造。
提供開放權重的 Edge 模型與部署文件,包含本地使用與 API 存取,以及模型卡、快速入門與整合範例。
依語意而非中繼資料搜尋大型影片資料庫,接著擷取重點、摘要或片段以供審閱或發布。
從攝影機畫面偵測鬥毆、逗留、竊盜、交通事件與其他事件,並向操作人員顯示警示與摘要報告。
檢查工廠產線是否有安全問題或裝配異常,並根據攝影機分析產生結構化事件報告。
在邊緣端執行多模態模型,適用於機器人、車輛或穿戴裝置等低延遲與離線運作很重要的場景。
從第一人稱影片、機器人軌跡、世界模型影像與專家人類判斷建立訓練資料集,以支援前沿 AI 工作流程。
Reka Vision 旨在用於大規模影片與圖片內容的視覺理解與搜尋。來源將其描述為一個可解讀、搜尋並推理視覺內容的多模態 AI 系統。
來源指出,Reka Vision 支援視覺理解與索引、語意影片搜尋、重點與片段生成,以及視覺推理與問答。它也將即時影像監控與警示描述為平台定位的一部分。
Reka Labs 提供開放權重的 7B 視覺語言模型,並表示可在本地執行或透過 API 使用。產品網站也提到 Edge 模型的部署範例,例如 HF 與 vLLM。
網站將 Reka 定位為適合企業、創作者與開發者,應用情境涵蓋工業與製造、實體安全與智慧城市、媒體與娛樂、汽車與車載資訊系統、延展實境,以及國防。
定價頁未顯示有效的價格資訊,而是回傳找不到頁面的訊息。聯絡頁則引導有興趣的使用者申請示範或寄送電子郵件聯絡公司。
Crossing Minds 是一個用於打造精準、安全且可擴展 AI 應用的檢索平台。官方網站亦提到,團隊已加入 OpenAI。
小藝是華為自主研發的 AI 智慧助手,支援知識問答、寫作、文檔閱讀、程式碼輔助與識圖,適用日常查詢、內容處理與鴻蒙開發,並支援檔案拖放輸入。
Orca 是一款 Agent 開發環境,專為搭配 coding agents 發佈軟體而設計。可在隔離的 worktrees 中平行執行多個 CLI agents,並提供桌面與行動裝置輔助工作流程。
Firebase Studio 是一個以瀏覽器為基礎的全端應用開發工作區,提供 Gemini 輔助編碼、應用預覽、雲端模擬器,可匯入既有專案、原型設計、協作與瀏覽器部署。
EZsite AI 是一款 AI 網站建置工具,可將網址轉換成完整的 React 或 Vue.js 應用程式,並提供主機、網域、程式碼匯出與後端功能,適合需要可部署成果的團隊。
AI Magicx 是整合式 AI 工作區,將聊天、圖片、影片、語音、音樂、電子郵件與開發任務集中於一處,方便創作者、團隊與開發者整合多模型,免切換工具與訂閱。