Skip to content

Releases: redpluglab/tellama

Tellama v1.3.6 — TTFT 안정화 · 모델 전환·슬래시 명령 수정

Choose a tag to compare

@azossy azossy released this 25 Jul 11:11

Tellama v1.3.6

첫 답변까지 걸리는 시간을 안정적으로 줄이고, 모델을 바꾼 직후 메시지가 사라지던 문제와
슬래시 명령이 엉뚱하게 동작하던 문제를 고쳤습니다. 모든 수치는 Galaxy S10(SM-G973N, 8GB)에서
Qwen2.5 1.5B Instruct Q4_K_M 으로 직접 측정한 값입니다.

첫 답변이 빨라졌고, 무엇보다 일정해졌습니다

새 대화에서 다섯 번 연속 질문했을 때의 실측값입니다.

질문 첫 답변 준비 생성 속도
1번째 (앱 켜고 처음) 1.6초 11.3 tok/s
2번째 1.8초 12.6 tok/s
3번째 0.3초 8.0 tok/s
4번째 3.1초 10.6 tok/s
5번째 0.3초 7.6 tok/s

v1.3.4에서 앱을 켜고 첫 질문할 때 7.4초가 걸렸던 구간이 1.6초가 되었고, 간헐적으로
6~8초씩 튀던 현상이 없어졌습니다.

무엇을 고쳤나 — 두 가지입니다. 하나는 이전 대화 내용을 캐시에서 부분적으로 지우는 작업이
이 기기에서 약 6초나 걸린다는 것을 실측으로 확인해, 짧은 대화에서는 캐시를 전부 비우고 다시
채우도록 바꿨습니다(4배 빠릅니다). 다른 하나는 v1.3.5에서 넣은 "미리 준비" 기능이 오히려
생성과 CPU를 다투어 느려지게 만든다는 것을 확인해 기본적으로 끈 것입니다. 프롬프트를 이미
충분히 줄여 둔 덕에 이 기능 없이도 빠릅니다.

모델을 바꾼 직후 메시지가 사라지던 문제 수정

모델 A에서 B로 바꾼 다음 바로 질문을 보내면 답이 오지 않는 경우가 있었습니다. 모델이 준비를
마쳤다고 표시된 뒤에도 내부 기록 작업이 잠깐 더 남아 있었고, 그 사이 도착한 메시지가 조용히
거부됐습니다. 이제 준비가 끝날 때까지 기다린 뒤 정상적으로 답변합니다.

슬래시 명령이 제대로 동작합니다

/clear 를 입력하고 전송하면 명령이 실행되지 않고 모델에게 그대로 전달되어, 모델이
"대화를 지웠습니다" 같은 사실과 다른 답을 만들어 냈습니다. 이제 /clear, /new,
/model, /memory, /export, /help 를 입력해 전송하면 바로 실행됩니다.

새 대화가 더 깨끗해졌습니다

새 대화를 시작하면 이전 대화의 캐시를 확실히 비웁니다. 이전에는 남아 있던 캐시 때문에 새
대화의 첫 답변이 느려질 수 있었습니다.

설치

tellama-v1-3-6.apk 를 받아 설치하세요. 앱 안의 업데이트 기능으로도 받을 수 있습니다.

Tellama v1.3.5 — TTFT 개선 · 모델 전환 버그 수정

Choose a tag to compare

@azossy azossy released this 25 Jul 09:03

Tellama v1.3.5

첫 답변이 나오기까지의 시간(TTFT)을 구조적으로 줄이고, 모델을 바꾼 직후 메시지가 사라지던 문제와
작은 모델이 멀쩡한 질문을 거부하던 문제를 고쳤습니다. 모든 수치는 Galaxy S10(SM-G973N, 8GB)에서
Qwen2.5 1.5B Instruct Q4_K_M 으로 직접 측정한 값입니다.

첫 답변이 빨라졌어요

이전 버전에서는 대화를 이어갈 때는 빨랐지만(0.7초), 앱을 새로 열고 첫 질문을 할 때 프롬프트 전체를
다시 처리해야 해서 오래 걸렸습니다.

상황 v1.3.4 v1.3.5
대화 중 다음 질문 683 ms 458 ms
앱을 새로 열고 첫 질문 (1,300토큰 대화) 약 28초 15.9초

어떻게 바꿨나 — 채팅 화면을 열고 사용자가 질문을 입력하는 동안, 그때까지의 대화 내용을 미리
백그라운드에서 처리해 둡니다. 전송을 누르는 순간에는 새로 입력한 문장만 처리하면 됩니다.
전송·모델 교체가 들어오면 이 작업은 즉시 자리를 비켜줍니다.

배터리와 발열도 함께 챙겼습니다. 절전 모드이거나 기기가 이미 뜨거울 때는 미리 처리하지 않고,
평소처럼 전송 시점에 처리합니다.

프롬프트가 가벼워졌어요

모델에 매번 함께 전달되던 안내문과 기억(메모리) 분량을 줄였습니다. 처리할 양이 줄어드니 첫 답변이
빨라지고 배터리 소모도 함께 줄어듭니다.

  • 기억 주입 분량 축소 (최대 4,000자 → 1,000자)
  • 언어 안내문 202자 → 57자
  • 내부 표식을 짧은 형태로 교체

멀쩡한 질문을 거부하던 문제 수정

"컴퓨터 역사에 대해 길게 써줘" 같은 평범한 요청에 I'm sorry, but I can't assist with that. 이라고
답하는 경우가 있었습니다. FAST 모드에서 모델에 전달되던 안내문 안의 특수 표기가 잘못 해석되어
대화 형식이 어긋나면서 생긴 문제였고, 해당 안내문을 제거했습니다. 안내문 없이도 FAST 모드는
그대로 동작합니다.

모델을 바꾼 직후 메시지가 사라지던 문제 수정

모델 A에서 B로 바꾼 직후에 메시지를 보내면, 답변이 오지 않거나 조용히 무시되는 경우가 있었습니다.

  • 모델 교체 중에는 전송이 교체가 끝날 때까지 기다립니다(최대 60초). 이전에는 바로 포기했습니다.
  • 답변 생성 중에는 모델 교체를 막습니다.
  • 모델이 올라오지 않은 상태를 "메모리 할당 실패"로 잘못 안내하던 것을 바로잡고, 전용 안내
    코드(RUNTIME_009)를 추가했습니다. 15개 언어 모두 반영했습니다.

발열에 대해

궁금해하실 수 있는 부분이라 실측값을 함께 남깁니다. 2분 동안 쉬지 않고 답변을 생성했을 때
배터리 온도는 32.1°C → 36.5°C 였습니다. 스마트폰이 스스로 온도를 관리하는 구간에 한참
못 미치는 값이고, 동영상을 보는 정도의 수준입니다. 다만 충전 중에 긴 대화를 하면 충전열이
더해져 손에 닿는 느낌은 더 따뜻할 수 있습니다.

설치

tellama-v1-3-5.apk 를 받아 설치하세요. 앱 안의 업데이트 기능으로도 받을 수 있습니다.

Tellama v1.3.4 — 🏆 Gold Master

Choose a tag to compare

@azossy azossy released this 23 Jul 04:37

Tellama v1.3.4 makes more models usable on your phone and keeps your question in view.

Highlights

  • Accurate memory requirements. The RAM figures shown for each model were overstated for 4-bit models — some by 2–3× (a 4-bit model that needs about 9GB was labeled 24GB). They are now derived from the model's actual file size, so capable phones see the models they can really run instead of being scared off.
  • Your question stays visible. After you send a message, the chat now scrolls so your just-sent question is fully in view above the keyboard, instead of being cut off at the bottom.
  • Small fix. Phi 3.5 Mini no longer shows an inaccurate "reasoning-heavy" hint.

APK integrity

  • File: tellama-v1-3-4.apk
  • SHA-256: 8cc77f15055a319295c220f7405e342bc3ee357f14991272ff7735740c9a8348
  • Package: com.tellama.app
  • Version: 1.3.4 (versionCode 34)
  • Signer certificate SHA-256: 5c3180b0290135491a0dec1dba6acab9119a8e17a60c8663d390bb2073007516

Updating

Tellama v1.2.1 and later check the public release feed and validate the APK SHA-256, package, higher version, and signing certificate before opening Android's installer.

Tellama v1.3.3

Choose a tag to compare

@azossy azossy released this 22 Jul 15:03

Tellama v1.3.3 makes Qwen3 answer fast.

Highlights

  • Qwen3 responds quickly now. Qwen3 base models (like Qwen3 4B) are hybrid — they support both a thinking mode and a fast non-thinking mode. Tellama previously treated them as thinking-only and forced every reply through hidden chain-of-thought, so the first visible word was slow to appear. They now run in Fast mode by default (no hidden reasoning), so answers start right away. Switch to Deep Thinking in Settings when you want full reasoning.
  • Genuinely reasoning-only models (QwQ, DeepSeek-R1, Qwen3 Thinking variants) still use Deep Thinking as before.

APK integrity

  • File: tellama-v1-3-3.apk
  • SHA-256: 6a926e0a9752526fa4fb9cca85039e88ad644b39028813d4a07bd934819d73d4
  • Package: com.tellama.app
  • Version: 1.3.3 (versionCode 33)
  • Signer certificate SHA-256: 5c3180b0290135491a0dec1dba6acab9119a8e17a60c8663d390bb2073007516

Updating

Tellama v1.2.1 and later check the public release feed and validate the APK SHA-256, package, higher version, and signing certificate before opening Android's installer.

Tellama v1.3.2

Choose a tag to compare

@azossy azossy released this 22 Jul 13:38

Tellama v1.3.2 focuses on the on-device chat experience: faster first response, longer-lasting context, and smoother model handling.

Highlights

  • Faster first token (TTFT). The system prompt is now frozen for the duration of a chat session, so the prompt prefix stays byte-stable across turns and the native KV cache prefix is reused instead of re-processed. Previously, automatic memory changed the system prompt every turn, which forced a full re-prefill and made the first token slower as the conversation grew. Newly captured memories apply from the next conversation.
  • Context lasts longer. Because the memory set no longer grows mid-session, it stops eating into the conversation history budget, so earlier turns stay in context longer.
  • Keyboard no longer covers the input. On Android 15 edge-to-edge, the chat input now rises above the on-screen keyboard (explicit enableEdgeToEdge() plus IME-aware layout), across Android 10–15.
  • Your last model comes back. On relaunch, Tellama warm-loads the model you were last serving in the background, so it is ready when you open a chat instead of starting unloaded.
  • Clearer model errors. A model that fails to load now shows its message in a dialog (with the error code) instead of a banner at the top of the list that scrolls out of view.

APK integrity

  • File: tellama-v1-3-2.apk
  • SHA-256: 43fd6c4739a199b5680dda50b30fe371370144cd1609eb3777d2a621369f46d2
  • Package: com.tellama.app
  • Version: 1.3.2 (versionCode 32)
  • Signer certificate SHA-256: 5c3180b0290135491a0dec1dba6acab9119a8e17a60c8663d390bb2073007516

Updating

Tellama v1.2.1 and later check the public release feed and validate the APK SHA-256, package, higher version, and signing certificate before opening Android's installer.

Tellama v1.3.1

Choose a tag to compare

@azossy azossy released this 22 Jul 08:01

생성 속도를 원래대로 되살린 v1.3.1 골드 마스터예요. ⚡

🚀 이번에 좋아진 점

  • 대답이 다시 빨라졌어요 — 온디바이스 생성 속도가 정상으로 복구됐습니다. 갤럭시 S10(Qwen2.5 1.5B) 기준 디코드 약 0.3 → 9.6 tok/s, 프리필 52 tok/s로 회복.
  • 폰이 뜨거워지지 않아요 — 같은 대화에서 배터리 온도가 크게 낮아졌어요(측정 31.9°C).
  • 원인은 네이티브 연산 커널(ggml/llama.cpp)이 최적화 없이 빌드되던 구조적 문제였고, 항상 -O3로 컴파일하도록 근본 수정했습니다.

🔧 설치

아래 tellama-v1-3-1.apk 를 내려받아 설치하세요. 이전 버전 위에 덮어 설치하면 대화·모델이 유지됩니다.

🔒 APK 무결성

  • 버전: 1.3.1 (versionCode 31)
  • 패키지: com.tellama.app
  • SHA-256: cef1bcead88be527aad58b742af267b4682a1f0fd3b13c634b2e9db2b11940ed
  • 서명 인증서 SHA-256: 5c3180b0290135491a0dec1dba6acab9119a8e17a60c8663d390bb2073007516

Tellama v1.3.0

Choose a tag to compare

@azossy azossy released this 21 Jul 09:11

채팅 사용성을 크게 다듬은 v1.3.0이에요.

✨ 이번에 좋아진 점

  • 채팅 열면 최신 메시지부터 — 긴 대화를 열 때 맨 위 옛날 메시지가 아니라 방금 나눈 최신 메시지가 바로 보입니다. (더 이상 한참 안 내려도 돼요.)
  • 키보드가 입력창을 안 가려요 — 메시지를 입력할 때 입력창과 전송 버튼이 키보드 위로 올라옵니다.
  • 모델 목록이 계열별로 깔끔하게 — Qwen 계열, Llama 계열처럼 묶고, 각 계열 안에서 작은 모델 → 큰 모델 순으로 정리했어요.
  • 웹 출처 표기 등 자잘한 다듬기.

🔧 설치

아래 tellama-v1-3-0.apk 를 내려받아 설치하세요. .sha256 로 무결성을 확인할 수 있어요.

Tellama v1.2.11

Choose a tag to compare

@azossy azossy released this 21 Jul 04:23

Google Play 출시 준비와 개인정보 보호를 다듬은 업데이트예요.

🔒 더 가벼운 권한, 더 정확한 안내

  • 불필요한 권한 제거 — 마이크(RECORD_AUDIO)·Wi-Fi 상태 권한을 앱에서 없앴어요. 음성 입력은 안드로이드 시스템 음성 인식으로 처리되므로 앱이 직접 마이크 권한을 가질 필요가 없습니다. 더 안심하고 쓰실 수 있어요.
  • 외부 API 사용 시 안내 추가 — 외부 제공업체 모델을 추가할 때, 메시지가 그 업체로 전송된다는 안내를 명확히 표시합니다.

✨ 최근 개선 사항도 함께

  • 채팅 메시지를 길게 눌러 복사·기억·삭제를 선택하는 메뉴
  • 텔라마 캐릭터 배지 정리, 긴 대화 안정성, 이모지 처리 개선 등

🔧 설치

아래 tellama-v1-2-11.apk 를 내려받아 설치하세요. .sha256 로 무결성을 확인할 수 있어요.

Tellama v1.2.10

Choose a tag to compare

@azossy azossy released this 21 Jul 03:07

채팅 사용성과 안정성을 한층 끌어올린 업데이트예요.

✨ 새로워진 점

  • 채팅 메시지를 길게 누르면 메뉴가 떠요 — 복사 · 기억하기 · 삭제 중에서 고를 수 있습니다. (예전엔 길게 누르면 바로 저장돼서 복사가 안 됐죠. 이제 원하는 걸 선택하세요!)
  • 텔라마 캐릭터 뱃지가 깔끔해졌어요 — 답변을 준비할 때 뜨는 텔라마 아이콘을 앱 아이콘과 똑같이 동글동글 예쁘게 다듬었습니다.

🛡️ 더 똑똑하고 안정적으로

  • 긴 대화에서 일부 모델(Gemma 계열)이 오류를 내던 문제를 해결했어요.
  • 이모지가 섞인 대화의 이해도가 좋아졌습니다.
  • 답변 중 화면이 더 부드럽게 흐르고, 생성 취소가 정확히 반영돼요.
  • 모델 다운로드·삭제·서버 연동의 안정성을 전반적으로 강화했습니다.
  • 외부 API(OpenAI 호환) 연동 호환성이 개선됐어요.

🔧 설치

아래 tellama-v1-2-10.apk 를 내려받아 설치하세요. .sha256 로 무결성을 확인할 수 있어요.

Tellama v1.2.9

Choose a tag to compare

@azossy azossy released this 20 Jul 03:15

v1.2.8에서 채팅을 보내면 앱이 종료되던 문제를 고친 긴급 핫픽스입니다.

수정

  • 채팅 크래시 수정 — 메시지를 보낸 뒤 ‘생각 중’ 표시가 나타날 때 앱이 강제 종료되던 문제를 해결했습니다. (Compose가 adaptive 아이콘을 로드하지 못하던 원인)

v1.2.8의 나머지 개선(멀티턴 맥락, 새 모델 2종, 생성 속도/안정성)은 그대로 유지됩니다.

업데이트 권장

v1.2.8 사용자는 바로 업데이트해 주세요.

설치

아래 tellama-v1-2-9.apk를 내려받아 설치하세요. .sha256 파일로 무결성을 확인할 수 있어요.

  • SHA-256: 6ab83b8e4b86b476d8f8d20f490b360920a1da020e642fb9ea6a5be915d19539
  • Package: com.tellama.app
  • Version: 1.2.9 (versionCode 27)