常見問題
常見問題
這裡是我們真的被問到的問題,並以它們應得的篇幅回答,而不是用一句話帶過。已分組整理,讓您不必讀完全部也能找到自己的問題。
如果這裡沒有涵蓋到您的問題,請連同需求一起寄來,我們會直接回答,而不是把您導回這一頁。
01
開始合作
第一次合作會是什麼樣子。
從一個界定範圍的試辦專案開始。您提供一份具代表性的資料樣本,以及模型該做什麼的說明;我們草擬這項任務所需的標註規範決策、標註一小批資料,並呈報在這批資料上量得的一致率。試辦的目的是找出兩位講理的標註人員會在哪裡分歧,因為那正是您的規格不完整的地方。量產規模與價格會依試辦量測到的結果推算,而不是憑估計。
一份資料樣本、任務說明、您需要的輸出格式,以及任何限制條件——期限、保密要求、希望我們在其中作業的工具。只憑任務說明產出的報價是猜測;我們寧可花一小時看真實資料,也不想給出一個第一批交付後就會變動的數字。
從收到資料起算通常是一到三週,取決於這項任務需要多少規格制定工作。其中大部分時間花在草擬標註規範與校準,而不是標註本身。若任務已有既存且驗證過的規範,速度會快上許多。
沒有固定的最低量。我們接小規模試辦,也能擴展到大量的量產計畫。真正形成實務門檻的是建置成本——規範制定、工具建置與校準的成本,大致不隨數量而變,因此一次性的極小案子會攤到不成比例的高成本。遇到這種情況我們會直說,而不是用報價含糊帶過。
以工作單位計價——每筆項目、每小時音訊、每張影像、每次評測——費率取決於任務複雜度、審查深度與所需的專業程度。標註規範的制定與校準會另行計價,因為它們是在任何一筆項目被標註之前就實際發生的工作。試辦範圍界定的洽談,我們不收費。
02
服務與範圍
我們做什麼,以及哪些情況我們不是合適的對象。
日文正是我們的立足點。我們承接日英雙語的工作——翻譯審查、跨語言對齊、平行評測資料集——因為那同樣仰賴對日文的判斷力。至於其他語言的大量作業,我們寧可直接告訴您我們不是合適的供應商,也不願接下案子再轉包出去。
可以。我們能在客戶提供的平台與虛擬桌面中作業,包括政策要求資料絕不離開貴公司基礎設施的情況;若您不方便開設帳號,我們也可在自己的安全環境中進行。改變的是工具;標註規範、審查關卡與品質呈報都不變。
屬於日文語言工作的部分,我們會蒐集與產製資料——撰寫指令資料、建構評測提示、錄製腳本語音、蒐集文件樣本。我們不是通用型的資料蒐集機構;大規模的實地蒐集,交給專門的業者對您比較有利。
可以,而且我們做的第一件事,是讀他們的標註規範,並對他們已交付的資料抽樣進行盲重標註。這會讓您知道自己手上實際擁有什麼——包括既有標籤在內部是否一致——然後我們才往上疊加。在沒有量測現況的情況下繼續擴充一份資料集,正是不一致被複利放大的原因。
有。長期運作的 AI 專案常採用專屬團隊的安排,由同一批標註人員持續承接標註規範,他們累積的脈絡本身就是真正的資產。這也正是規範偏移最需要留意的安排方式,因此它會搭配定期對照黃金樣本的重新校準。
03
日文語言
日文涵蓋範圍在實務上代表什麼。
涵蓋漢字、平假名、片假名與拉丁字母的正式與非正式語體,包含敬語、地區變異、俚語、產業行話,以及日英混雜的技術寫作。文字選擇、數字、標點、表情符號與全形字元的正規化規則會在啟動會議中議定,因為這些選擇決定了語料庫在內部是否一致。
是。這一點對「取決於一句話落在人耳中的效果、而非它字面指涉什麼」的判斷特別重要——一則拒絕讀起來是不是拒絕、某個禮貌程度是否合乎彼此關係、某個說法聽起來是不是翻譯腔。至於規範嚴謹的機械性任務,這個條件就沒那麼關鍵,我們也會據此配置人力,而不會為任務並不需要的專業能力收費。
可以,但要說明:方言涵蓋範圍是人力配置的問題,我們會明確告訴您哪些變體能穩定支援。更重要的決定其實在上游:方言是照說話原樣轉寫,還是正規化成標準日文。這個選擇會徹底改變資料集,必須刻意做出。
靠一份書面的正規化慣例,在標註當下套用,並在交付前由自動檢查強制執行。它涵蓋高頻詞的文字選擇、片假名長音的寫法、阿拉伯數字與漢字數字的取捨、全形與半形字元、拉丁字母前後的空白與標點。正字法上的變異是未訂規格的日文資料集中最常見的缺陷,也是最容易預防的。
可以,而且我們寧可採用貴團隊的,也不想強加我們的——已經以貴公司文風寫作的模型,本來就該繼續這麼寫。我們會做的是在試辦期間拿真實的邊界案例來檢驗它,因為大多數風格指南都有兩三條規則,一碰到實際資料就會互相衝突。
04
品質與交付
品質如何量測,以及您會收到什麼。
附機率校正係數的標註者間一致率、黃金樣本正確率、裁定比例,以及依具名分類細分的錯誤數量,而不是一個籠統的缺陷總數。所有數字都依標籤或標準分別呈報,不做混合,因為混合後的數字恰恰會蓋掉正在出問題的那個類別。品質頁面說明每個數字如何計算,以及它抓不到什麼。
JSONL、CSV、CoNLL-U、COCO、SRT、CTM、TextGrid、hOCR,以及在啟動會議中定義的自訂 schema。範圍型資料無論採用哪種標記格式,底層一律附上字元位移,讓日後更換斷詞器只是重新匯出,而不是重新標註。每一批交付都附上其標註規範版本,以及相對於前一版的異動紀錄。
修訂會走與初次作業相同的審查與裁定流程——開一條「快速修正」的捷徑,正是資料集在批次之間偏移的原因。若成因是規範缺口,我們會修訂規範並重做所有受影響的項目,而不只是您標出來的那幾筆,因為同一個缺口在別處也會製造同樣的錯誤。
產能取決於任務複雜度、審查深度,以及資料本身含有多少真正的歧義,而且不同任務之間的差距比多數估算願意承認的更大。我們會在試辦期間於您的資料上量測真實產能,並據此承諾交付計畫。在任何人真正標註過您的資料之前給出的交期,是把猜測當成承諾。
我們會和您一起看那些具體的項目。通常是三種情況之一:規範有歧義,那我們就修訂規範並重做;規範清楚但被套錯了,那我們就更正並回饋到審查流程;或者規範說的是一件您現在不希望它說的事,那這個變更就是範圍決策。把一次分歧歸入這三類之一,比爭論個別標籤有生產力得多。
05
資訊安全、法務與商務
保密、合約,以及我們如何配合採購流程。
任何資料提供前先簽保密協議、涉及個人資料時簽資料處理協議、以角色為基礎且僅限專案派駐人員的存取權、隔離的作業環境,以及寫入合約而非交由內部政策決定的保存與刪除條款。資訊安全頁面逐項說明各項管控,同樣重要的是,也說明我們不宣稱什麼。
凡是未寫入我們與您合約中的認證,我們一概不宣稱。您可以針對某項具體制度詢問,會得到直接的答覆,包括答案是「沒有」的時候。我們寧可因為據實以告而在採購流程中落選,也不願靠一個撐不過稽核的說法過關。
歸您所有。依合作合約,交付物與衍生的標註成果都屬於貴公司。我們不會為了內部再利用、模型訓練或作品集用途保留客戶資料;本網站上展示的任何範例材料都是我們自製的,僅供示意。
可以,這在企業級合作中很常見。若某項條款要求我們承諾實際做不到的事——某個特定的準確率數字、我們並不持有的認證——我們會直說並提出替代文字,而不是先簽了再賭運氣。這樣的討論比較慢,但比另一種做法短得多。
若涉及委外,我們會主動揭露,並且以與自家員工相同的保密義務約束對方。絕不會默默假定您同意。若貴公司政策完全禁止委外,請告訴我們,我們會在您做出承諾之前,先確認能否在該前提下為專案配置人力。
06
專家標註
領域專家,以及我們宣稱的界線。
對於有此需求的專案,我們會依所需的領域專業組建團隊,其中可能包含在法律、稅務、會計、勞務與社會保險或公司登記等領域具備相關資格或實務經驗的人。我們不維持常設的持照專業人員名單。人力可得性會依每個專案的範圍、資料量、專精程度與時程逐案評估;若貴團隊的專案無法找到所需資格的人選,我們會在專案開始前就告訴您。
看這項任務需要哪一種判斷。術語與文件慣例可以透過一份好的詞彙表加上一輪校準,移轉給受過訓練的標註人員;對多數工作而言那是更好的答案——更快、更一致、也更便宜。當判斷本身屬於專業判斷時才需要專家:某個解釋是否站得住腳、某個答覆會不會讓讀者誤解自己的義務。
可以。領域專家能就事實正確性、推理品質、專業妥適性,以及是否符合貴團隊的標準,為生成的回應評分;也能為對齊工作產出偏好排序,並支援基準資料集、檢索評測與紅隊測試。每一次判斷背後的理由都會被記錄下來,而這通常正是專家評測值得其成本的原因。
不是。他們是在標註與評測資料。產出的是供貴公司 AI 系統使用的訓練或評測資料,而不是給貴公司或貴公司使用者的法律、稅務或會計意見;標註專案中產出的任何內容,都不應被當成專業意見呈現給終端使用者。我們把這一點講明白,是因為這個區別對雙方都很重要。
還有問題嗎?
直接問吧。
把它連同您的需求一起寄來,您會從實際執行過這類專案的人那裡得到具體的答覆——而不是一條指回這一頁的連結。
我們會在一個工作日內回覆。