Chủ quyền

Một cuộc họp InterMIND được xây dựng từ những gì

Bản đồng hành cho sơ đồ runtime của chúng tôi: không phải nơi cuộc họp của bạn diễn ra, mà nó được xây dựng từ những gì. Tầng lớp ngăn xếp — nơi chúng tôi chạy mã của riêng mình hoặc phần mềm mã nguồn mở, nơi chúng tôi thực dụng về SaaS độc quyền, và lý do tại sao động cơ mà hầu hết dữ liệu của bạn đi qua là mã của riêng chúng tôi, cùng với SDK khách hàng công khai, theo giấy phép BSD.

The Mind.com Team

Một cuộc họp InterMIND được xây dựng từ những gì

Một cuộc họp InterMIND được xây dựng từ đâu

Hầu hết mọi sản phẩm đều được xây dựng từ cùng một bộ công nghệ mặc định — các nền tảng SaaS độc quyền lớn mà ai cũng dùng tới. Đó là lựa chọn dễ dàng nhất. Tại mỗi lớp nơi dữ liệu cuộc họp của bạn thực sự tồn tại, chúng tôi đã chọn một hướng đi khác: mã nguồn của chính chúng tôi, hoặc mã nguồn mở mà chúng tôi có thể tự lưu trữ.

Đây là bài viết đồng hành với Một cuộc họp InterMIND thực sự chạy ở đâu, bài viết đã lập bản đồ vị trí địa lý — nơi mỗi dịch vụ thực thi và dữ liệu nào đi qua nó. Bài viết này trả lời câu hỏi mà đội ngũ an ninh mạng sẽ hỏi tiếp theo: thứ này được xây dựng từ đâu — và chúng tôi có thể đọc, kiểm toán, và thay thế nó không?

Không phải nơi nó chạy — mà là nó được tạo ra từ gì, từng lớp một.


Các lựa chọn mặc định, và cái giá của chúng

Mọi sản phẩm đều là một chồng các lựa chọn. Với hầu hết sản phẩm, phần lớn các lựa chọn đó được quyết định theo mặc định: Google Analytics, Firebase, Google Translate API, Auth0, React. Đó là con đường ít sức kháng nhất, và với đa số đội ngũ thì đó là một quyết định hợp lý. Sự đánh đổi là mỗi lựa chọn sẽ đặt một phần hệ thống của bạn sau một nhà cung cấp mà bạn không thể đọc, không thể kiểm toán, và không thể rời đi nếu không viết lại.

Chúng tôi đã đưa ra một lựa chọn khác tại mỗi lớp nơi dữ liệu cuộc họp của bạn thực sự tồn tại: mã nguồn của chúng tôi, hoặc phần mềm nguồn mở mà chúng tôi có thể tự lưu trữ. Ở những lớp không chạm tới nội dung cuộc họp của bạn, chúng tôi giữ cách tiếp cận thực dụng và nói rõ điều đó. Dưới đây là toàn bộ bức tranh.


Xương sống: công cụ là mã của chúng tôi, không phải của bên thứ ba

Hãy bắt đầu với lớp quan trọng nhất, vì phần lớn cuộc họp của bạn chảy qua nó. Truyền tải thời gian thực và dịch giọng nói/trò chuyện đều chạy trên mind-sdk + Mind API — công cụ của chính chúng tôi, trên OVH France. Cách mặc định để xây dựng một cuộc họp có dịch thuật là gắn một SaaS thời gian thực (LiveKit) vào một API dịch thuật (DeepL, Google); chúng tôi không chạy bất kỳ cái nào trong đường dẫn trực tiếp. Không có mô hình dịch thuật bên thứ ba nào trong vòng lặp. (Chúng tôi có dùng DeepL — nhưng chỉ cho tài liệu được thả vào trò chuyện, không phải đường dẫn giọng nói/trò chuyện trực tiếp; xem bản đồ runtime. Chúng tôi đã đề cập đến cơ chế của pipeline trong Bên trong bốn pipeline dịch thuật.)

Dưới đây là phần không có trong bản đồ runtime: SDK mà cuộc họp của bạn chạy trên đó là mã nguồn mở theo giấy phép BSD 3-Clause — client mind-sdk được công khai tại gitlab.com/mindlabs/api/sdk, bản quyền thuộc MindMeeting OÜ, thực thể sở hữu trí tuệ của chúng tôi tại Estonia. Nó giao tiếp với Mind API tại api.mind.com, nơi chúng tôi tự vận hành trên OVH France.

Đây không phải là một thỏa thuận "xem nhưng không chạm vào" kiểu source-available. BSD 3-Clause là một giấy phép thoáng, được OSI phê duyệt. Đội ngũ an ninh mạng của bạn có thể clone SDK, đọc chính xác cách âm thanh và văn bản của bạn được ghi lại, đóng gói và truyền đi, và kiểm toán sự tích hợp đó so với yêu cầu của chính bạn. Công cụ phía máy chủ mà nó giao tiếp là của chúng tôi — không phải hộp đen của bên thứ ba — và một công cụ có thể tự lưu trữ hoàn toàn cho một tenant cần nó nằm trong lộ trình của chúng tôi, không phải thứ chúng tôi cung cấp ngày hôm nay. Chúng tôi sẽ cập nhật bài viết này ngay khi nó được phát hành.


Từng lớp: mặc định so với những gì chúng tôi chạy

LớpMặc định thông thườngNhững gì chúng tôi chạyTại sao điều này quan trọng với bạn
Công cụ thời gian thực + dịch thuật (giọng nói + trò chuyện)LiveKit + một API dịch thuật (DeepL / Google)mind-sdk (client BSD-3-Clause) + Mind API của chúng tôi, OVH FranceLuồng dữ liệu nặng nhất chạy trên công cụ của chúng tôi, không phải mô hình của bên thứ ba — và client SDK của nó mở và có thể kiểm toán
Framework frontendReact (Meta) / Next.jsVue + NuxtOSS do cộng đồng quản lý — không một tập đoàn đơn lẻ nào sở hữu framework mà UI của bạn chạy trên
Phân tích sản phẩmGoogle AnalyticsPostHogNguồn mở, đám mây EU, ủy quyền first-party qua domain của chúng tôi — dữ liệu sử dụng không chảy vào nền tảng quảng cáo của bên thứ ba
Phông chữGoogle Fonts CDNTự lưu trữ (@nuxt/fonts)Không có lệnh gọi phông chữ bên thứ ba từ trang mà người dùng của bạn tải — một vấn đề thường xuyên bị GDPR chỉ ra, đã được tránh
Xác thựcAuth0 / Clerk / Firebase AuthOIDC tự vận hành, liên kết với Google / Microsoft của bạnKhông có trung gian xác thực nào nắm giữ phiên của bạn — bạn mang theo nhà cung cấp danh tính của riêng mình
Dịch tài liệuGoogle TranslateDeepL (Cologne)Nhà cung cấp EU chuyên biệt, xử lý tại Đức
Tính năng AI (tóm tắt, tóm tắt tài liệu, trợ lý viết, Ask AI, Mia)Mô hình của một nhà cung cấp phía sau API của họCổng AI mà tổ chức chọn — Azure OpenAI EU Data Zone (mặc định), Vertex AI EU, Amazon Bedrock Frankfurt — hoặc endpoint tương thích OpenAI của riêng họMô hình là do bạn chọn và lưu trữ; việc tắt AI chỉ là một cài đặt
Nội dung / tài liệuContentful / Sanity (headless CMS)Nuxt Content (markdown theo dõi qua git)Các từ ngữ trên trang web của chúng tôi nằm trong repo của chúng tôi, không phải cơ sở dữ liệu của nhà cung cấp
Cơ sở dữ liệu ứng dụngFirestore / DynamoDB (độc quyền)Postgres (trên Neon)Tiêu chuẩn mở — có thể chuyển sang bất kỳ host Postgres nào, không cần viết lại API truy vấn độc quyền
Lưu trữ đối tượngAPI blob độc quyềnTigris (tương thích S3)Giao thức mở — bản ghi và dữ liệu xuất có thể chuyển sang bất kỳ kho S3 nào
CRM / bán hàngSalesforce / HubSpotPipedrive (Estonia)Hồ sơ khách hàng và giao dịch nằm trong một CRM đặt tại EU, không phải nền tảng bán hàng của Mỹ

Có hai chủ đề chạy xuyên qua bảng đó. Nguồn mở ở những nơi công cụ xử lý dữ liệu của bạn — để nó có thể được kiểm toán và về nguyên tắc là tự lưu trữ. Tiêu chuẩn mở (Postgres, API S3, OIDC) ở nơi chúng tôi phụ thuộc vào hạ tầng — để không có gì bị khóa với giá cả hoặc tư cách tuân thủ của một nhà cung cấp. Postgres có thể chuyển sang bất kỳ host Postgres nào; lưu trữ có thể chuyển sang bất kỳ kho S3 nào; xác thực liên kết với nhà cung cấp danh tính mà bạn đang vận hành. Hàng cuối cùng nằm trên trục thứ ba: CRM nắm giữ hồ sơ khách hàng được đặt tại EU (Pipedrive, Estonia) thay vì một nền tảng bán hàng của Mỹ — không phải nguồn mở, nhưng cũng không thuộc thẩm quyền của Mỹ.

Một vài điểm trong số này đáng được nói thêm một câu. PostHog là nguồn mở và có thể tự lưu trữ; chúng tôi chạy nó trên đám mây EU của PostHog và ủy quyền first-party qua origin của riêng mình, để các sự kiện không bị chặn quảng cáo gỡ bỏ một cách im lặng và không đi qua domain phân tích của bên thứ ba. Xác thực không bao giờ đi tới một SaaS xác thực bên thứ ba nằm giữa bạn và các phiên của bạn — chúng tôi tự chạy luồng OIDC và liên kết với Google hoặc Microsoft identity hiện có của bạn. Và phông chữ trên mỗi trang được phục vụ từ domain của riêng chúng tôi; nơi duy nhất Google Fonts xuất hiện trong codebase của chúng tôi là trong một script tài sản thương hiệu ngoại tuyến, không bao giờ trong ứng dụng mà người dùng của bạn tải.


Nơi chúng tôi thực dụng — nói thẳng ra

Chúng tôi không giả vờ rằng toàn bộ hệ thống được tự viết tay hoặc không phải của Mỹ. Không phải vậy, và một bài viết tuyên bố ngược lại sẽ bị chính bản đồ runtime của chúng tôi bác bỏ.

Cơ sở hạ tầng — lưu trữ và SSR (Vercel), máy chủ tính toán của cuộc họp (Fly.io), thanh toán (Stripe), email giao dịch (Resend) — chạy trên SaaS đặt tại Mỹ. Stripe và Resend xử lý thanh toán và lời mời và không bao giờ thấy nội dung cuộc họp. Vercel và Fly là tính toán thuê: mã của chúng tôi chạy trên đó, và máy chủ cuộc họp trên Fly xử lý phiên trực tiếp và bản ghi chép mà bản tóm tắt của chúng tôi đọc — nhưng đó là mã của chúng tôi trên máy của họ, không phải một sản phẩm của nhà cung cấp hấp thụ cuộc họp của bạn. Tất cả đều thực thi trong EU khi runtime (chủ đề của bản đồ runtime).

Đó là một sự đánh đổi có chủ đích và có giới hạn: sở hữu và mở mã nguồn cho mặt phẳng dữ liệu; sử dụng SaaS tốt nhất có sẵn cho mặt phẳng điều khiển. Việc gọi tên nó chính là điểm mấu chốt — "chủ quyền" không có ý nghĩa gì nếu các ngoại lệ không được đặt trên bàn cạnh những thành tựu.


Các bước AI, và kế hoạch đã được phát hành

Các bước của mô hình ngôn ngữ — AI digest (chủ đề, quyết định, mục hành động), tóm tắt tài liệu, các hành động tạo sinh của AI note-editor, Ask AI và Mia — chạy trên cổng AI mà tổ chức của bạn chọn: Azure OpenAI trong EU Data Zone theo mặc định, Vertex AI trên endpoint đa vùng EU hoặc Amazon Bedrock tại Frankfurt theo lựa chọn, mỗi cái trong tenant của riêng chúng tôi với không lưu giữ dữ liệu và không huấn luyện trên nội dung khách hàng — hoặc endpoint tương thích OpenAI của riêng bạn, giúp giữ mô hình trên hạ tầng mà bạn kiểm soát. Tóm tắt sau cuộc họp và hành động dịch của trình soạn thảo đi qua tract dịch thuật, không phải mô hình ngôn ngữ. Giọng nói, trò chuyện, ghi chú và tài liệu thời gian thực vốn chưa bao giờ tiếp cận một LLM mục đích chung từ đầu.

Đó là hình dạng trung thực của lớp này: các mô hình là độc quyền, và nhà cung cấp của họ là các công ty Mỹ vận hành các khu vực EU — cùng sự đánh đổi như cơ sở hạ tầng ở trên, được nêu ra bên cạnh thay vì bị che giấu. Thứ được phát hành thay vì một mô hình tự lưu trữ của riêng chúng tôi là sự lựa chọn: một tổ chức có thể tắt AI hoàn toàn (transcription và dịch thuật vẫn hoạt động), và nó có thể trỏ mọi tính năng AI tới endpoint của riêng mình — vLLM trong trung tâm dữ liệu của mình, một deployment trong tenant của mình — điều này đặt lớp này trên cùng trục mở-và-tự-lưu-trữ như phần còn lại của mặt phẳng dữ liệu. Benchmark dịch thuật công khai của chúng tôi được chấm điểm bởi một LLM judge (Gemini, với Claude làm phương án dự phòng) trên các câu tham chiếu FLORES-200 cố định — không bao giờ là cuộc họp của ai.


Tại sao điều này quan trọng ngoài chúng tôi

Đây không phải là kỹ thuật vì bản thân kỹ thuật. Lý do để xây dựng một hệ thống theo cách này xuất hiện ở phía bạn trong hợp đồng:

  1. Có thể kiểm toán. SDK mà cuộc họp của bạn chạy trên đó là mã nguồn mở mà đội ngũ an ninh mạng của bạn có thể đọc, và công cụ phía sau nó là của chính chúng tôi — không phải hộp đen của bên thứ ba.
  2. Có thể di chuyển. Tiêu chuẩn mở tại mỗi lớp dữ liệu — Postgres, S3, OIDC — có nghĩa là không có khóa độc quyền. Những gì có thể di chuyển không bị trói vào một nhà cung cấp duy nhất.
  3. Có thể tự lưu trữ. Các lớp dữ liệu tiêu chuẩn mở — Postgres, S3, OIDC — đã chạy trên hạ tầng mà bạn kiểm soát; một công cụ dịch thuật tự lưu trữ hoàn toàn nằm trong lộ trình cho tenant cần nó.

Đây là bức tranh vào ngày 2026-06-07. Chúng tôi sẽ cập nhật nó khi hệ thống thay đổi — một nhà cung cấp được thay thế, một lớp được xây lại, mô hình digest được thay thế. Cấu hình hiện tại có thể kiểm chứng trong tệp vercel.json mở của chúng tôi, nuxt.config.ts của chúng tôi, và repository mind-sdk BSD-3-Clause được liên kết ở trên.

Nếu một lớp ở đây có vẻ sai, hoặc đánh giá an ninh mạng của bạn cần một câu trả lời mà bản đồ này không cung cấp, hãy viết cho chúng tôi. Chúng tôi thà sửa một chi tiết thiếu sót còn hơn là để bạn tìm ra nó trong một cuộc kiểm toán mã.


Nguồn: mind-sdk repository (BSD-3-Clause), FLORES-200; các sự kiện hệ thống được xác minh dựa trên cấu hình đã triển khai (vercel.json, nuxt.config.ts) và mã đã phát hành, kiểm tra vào tháng 8 năm 2026.

Nhận bài viết mới và cập nhật sản phẩm qua email

Một email mỗi tháng với các bài viết mới và cập nhật sản phẩm. Hủy đăng ký bất cứ lúc nào.