- ModelConfig.filename 기본값 gemma4_e2b_q4.bin → gemma-4-E2B-it.litertlm (#342 근본 원인) - _migrateLegacyPath: 기존 .bin 설치본 rename + meta 갱신 (재다운로드 2.4GB 방지, 멱등) - maxTokens 2048 유지 + 1024 회귀 방지 주석 (KV cache < prefill signature 시 추론 실패) - LLM_BACKEND dart-define: 에뮬레이터 CPU 강제 (SwiftShader GPU 네이티브 SIGABRT 회피) - GEMMA_MODEL_URL dart-define: 호스트 로컬 모델 서버 주입 (기본값 = HF URL 불변) - debug 전용 cleartext manifest (10.0.2.2 모델 서버용, release 불변) - 마이그레이션 테스트 4건 신규 (AC-2/3/4). 171 passed, analyze clean 2026-07-14 에뮬레이터 E2E 검증: 다운로드→로드→tool call 왕복 전 구간 성공. Refs #657, #342 Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
213 lines
6.8 KiB
Dart
213 lines
6.8 KiB
Dart
import 'dart:async';
|
|
|
|
import 'package:flutter_riverpod/flutter_riverpod.dart';
|
|
|
|
import '../data/ai/device_capabilities.dart';
|
|
import '../data/ai/llm_service.dart';
|
|
import '../data/ai/model_lifecycle.dart';
|
|
import '../data/db/app_database.dart' as drift;
|
|
import '../domain/ai/frame_candidate.dart';
|
|
import '../domain/ai/suggest_frame.dart';
|
|
import '../domain/models/frame_pattern.dart';
|
|
import 'providers.dart';
|
|
|
|
/// Gemma 4 E2B instruction-tuned LiteRT-LM checkpoint (#218 OQ-1 resolved).
|
|
/// Hosted on HuggingFace `litert-community/gemma-4-E2B-it-litert-lm`.
|
|
/// File ≈ 2.41GB; SHA-256 pinned for integrity check.
|
|
///
|
|
/// Tests / placeholder builds may override `modelLifecycleProvider` with
|
|
/// fixture URLs. Dev/mirror builds may inject an alternate download origin
|
|
/// via `--dart-define=GEMMA_MODEL_URL=...` (e.g. a host-local server when
|
|
/// testing on the Android emulator). SHA-256 stays pinned regardless of
|
|
/// origin, so a tampered mirror still fails verification.
|
|
const _kModelUrl = String.fromEnvironment(
|
|
'GEMMA_MODEL_URL',
|
|
defaultValue:
|
|
'https://huggingface.co/litert-community/gemma-4-E2B-it-litert-lm/resolve/main/gemma-4-E2B-it.litertlm',
|
|
);
|
|
const _kModelSha256 =
|
|
'181938105e0eefd105961417e8da75903eacda102c4fce9ce90f50b97139a63c';
|
|
|
|
/// #218 AC-6: device-capability gate. RAM < 4GB → AI feature disabled.
|
|
/// Default implementation calls the `life_helper/device_caps` MethodChannel
|
|
/// (Android). Override in tests with a `_FakeDeviceCapabilities`.
|
|
final deviceCapabilitiesProvider = Provider<DeviceCapabilities>((ref) {
|
|
return PlatformDeviceCapabilities();
|
|
});
|
|
|
|
/// `true` iff the device has ≥ 4GB RAM. Default `false` (fail-closed) while
|
|
/// the platform call is in flight or on unsupported hosts (iOS / test).
|
|
final deviceMeetsAiRamProvider = FutureProvider<bool>((ref) async {
|
|
return ref.watch(deviceCapabilitiesProvider).meetsAiMinRam();
|
|
});
|
|
|
|
final modelLifecycleProvider = Provider<ModelLifecycle>((ref) {
|
|
return ModelLifecycle(
|
|
meta: ref.watch(metaDaoProvider),
|
|
config: ModelConfig(
|
|
url: Uri.parse(_kModelUrl),
|
|
expectedSha256: _kModelSha256,
|
|
),
|
|
);
|
|
});
|
|
|
|
/// Read-only opt-in state. Default OFF; persisted in `meta_kv`.
|
|
final aiSettingsProvider = FutureProvider<bool>((ref) async {
|
|
final meta = ref.watch(metaDaoProvider);
|
|
final v = await meta.find(AiMetaKeys.optIn);
|
|
return v == 'true';
|
|
});
|
|
|
|
/// Toggles opt-in. On opt-out, purges model file via [ModelLifecycle.purge].
|
|
/// On opt-in, kicks off `ModelDownloadController.start()` so AC2 (progress UI)
|
|
/// has a stream to subscribe to.
|
|
class AiSettingsController {
|
|
AiSettingsController(this.ref);
|
|
final Ref ref;
|
|
|
|
Future<int> setOptIn(bool value) async {
|
|
final meta = ref.read(metaDaoProvider);
|
|
if (value) {
|
|
await meta.put(AiMetaKeys.optIn, 'true');
|
|
ref.invalidate(aiSettingsProvider);
|
|
ref.invalidate(modelAvailabilityProvider);
|
|
// AC2: opt-in triggers download stream so Settings UI can render
|
|
// progress + pause/resume. Fire-and-forget; controller emits states.
|
|
ref.read(modelDownloadControllerProvider.notifier).start();
|
|
return 0;
|
|
}
|
|
// opt-out: cancel any in-flight download, then purge.
|
|
ref.read(modelDownloadControllerProvider.notifier).cancel();
|
|
final freed = await ref.read(modelLifecycleProvider).purge();
|
|
await meta.put(AiMetaKeys.optIn, 'false');
|
|
ref.invalidate(aiSettingsProvider);
|
|
ref.invalidate(modelAvailabilityProvider);
|
|
return freed;
|
|
}
|
|
}
|
|
|
|
final aiSettingsControllerProvider = Provider<AiSettingsController>((ref) {
|
|
return AiSettingsController(ref);
|
|
});
|
|
|
|
/// AC2: streams DownloadProgress + supports pause/resume/cancel.
|
|
/// State `null` means idle (no active subscription).
|
|
class ModelDownloadController extends StateNotifier<DownloadProgress?> {
|
|
ModelDownloadController(this.ref) : super(null);
|
|
final Ref ref;
|
|
StreamSubscription<DownloadProgress>? _sub;
|
|
|
|
void start() {
|
|
cancel();
|
|
final lc = ref.read(modelLifecycleProvider);
|
|
_sub = lc.download().listen(
|
|
(p) {
|
|
state = p;
|
|
if (p.state == DownloadState.completed) {
|
|
ref.invalidate(modelAvailabilityProvider);
|
|
}
|
|
},
|
|
onError: (Object e) {
|
|
state = DownloadProgress(
|
|
bytesReceived: state?.bytesReceived ?? 0,
|
|
totalBytes: state?.totalBytes ?? -1,
|
|
state: DownloadState.failed,
|
|
errorMessage: e.toString(),
|
|
);
|
|
},
|
|
onDone: () {
|
|
_sub = null;
|
|
},
|
|
);
|
|
}
|
|
|
|
/// Pauses by cancelling the subscription. .tmp file + meta_kv preserved so
|
|
/// `start()` resumes via HTTP Range header.
|
|
void pause() {
|
|
_sub?.cancel();
|
|
_sub = null;
|
|
final cur = state;
|
|
if (cur != null && cur.state != DownloadState.completed) {
|
|
state = DownloadProgress(
|
|
bytesReceived: cur.bytesReceived,
|
|
totalBytes: cur.totalBytes,
|
|
state: DownloadState.paused,
|
|
);
|
|
}
|
|
}
|
|
|
|
void resume() => start();
|
|
|
|
void cancel() {
|
|
_sub?.cancel();
|
|
_sub = null;
|
|
state = null;
|
|
}
|
|
|
|
@override
|
|
void dispose() {
|
|
_sub?.cancel();
|
|
super.dispose();
|
|
}
|
|
}
|
|
|
|
final modelDownloadControllerProvider =
|
|
StateNotifierProvider<ModelDownloadController, DownloadProgress?>(
|
|
(ref) => ModelDownloadController(ref),
|
|
);
|
|
|
|
final modelAvailabilityProvider =
|
|
FutureProvider<ModelAvailability>((ref) async {
|
|
final lc = ref.watch(modelLifecycleProvider);
|
|
return lc.checkAvailability();
|
|
});
|
|
|
|
/// Loads FramePatterns from DB and converts to domain models.
|
|
final framePatternsProvider = FutureProvider<List<FramePatternModel>>(
|
|
(ref) async {
|
|
final db = ref.watch(appDatabaseProvider);
|
|
final rows = await db.select(db.framePatterns).get();
|
|
return rows.map(_toDomain).toList(growable: false);
|
|
},
|
|
);
|
|
|
|
FramePatternModel _toDomain(drift.FramePattern r) => FramePatternModel(
|
|
id: r.id,
|
|
domain: r.domain,
|
|
avoidanceKeyword: r.avoidanceKeyword,
|
|
l0Example: r.l0Example,
|
|
l1SimpleReplace: r.l1SimpleReplace,
|
|
l2Suggestion: r.l2Suggestion,
|
|
l3Identity: r.l3Identity,
|
|
);
|
|
|
|
/// Singleton LLM service for the app. v1 starts unloaded; first
|
|
/// [suggestFrame] triggers `.load()` via the dialog. Override in tests with
|
|
/// `MockLlmService`.
|
|
final llmServiceProvider = Provider<LlmService>((ref) {
|
|
throw UnimplementedError(
|
|
'llmServiceProvider must be overridden (Mock in tests, '
|
|
'GemmaLlmService after OQ-1 in production).',
|
|
);
|
|
});
|
|
|
|
/// `family` param wraps a SuggestFrameInput. Loads model lazily before
|
|
/// calling suggestFrame.
|
|
final frameSuggestionsProvider = FutureProvider.autoDispose
|
|
.family<List<FrameCandidate>, SuggestFrameInput>((ref, input) async {
|
|
final llm = ref.watch(llmServiceProvider);
|
|
final patterns = await ref.watch(framePatternsProvider.future);
|
|
if (!llm.isLoaded) {
|
|
try {
|
|
await llm.load();
|
|
} catch (_) {
|
|
return const [];
|
|
}
|
|
}
|
|
return suggestFrame(
|
|
input,
|
|
llm: llm,
|
|
framePatterns: patterns,
|
|
);
|
|
});
|