昨日(2026-08-16)のブックマーク

1

Your buttons are missing a sound. building tactile 10…
投稿者
Daniel White (@dwhitedesign)
投稿日時
2026-07-03 22:47 +07
元リンク
https://x.com/dwhitedesign/status/2073071132605817298
自動生成記事
オーディオファイルなしで作る「触覚的」UIサウンドの設計
日本語訳
ボタンから音が聞こえません。 tactile 10 の合成 UI サウンド (さらに追加予定)、オーディオ ファイルなし、約 2 kb を構築しています。依存関係はありません。もうすぐドロップします👀
本文
Your buttons are missing a sound. building tactile 10 synthesised UI sounds (more coming), zero audio files, ~2kb. no dependencies. dropping soon 👀
動画の詳しい解説

概要

約2KB・依存なしをうたうWeb Audio製UIサウンドライブラリ「tactile」のデモ。10種類の合成音を試し、hover/press・release/toggleへdata属性だけで割り当てる流れを見せている。

詳細解説

約24.6秒の画面デモ。冒頭のページには「tactile」「v0.1.0・~2 kb・0 deps」と、Web Audioでその場で合成するため音声ファイルも依存関係もない、という説明が表示される。Soundboardにはchime、sparkle、droplet、bloom、whisper、tick、press、release、toggle、successの10ボタンが並び、クリックや1〜0キーで鳴らすと波形、音名、周波数帯、長さが更新される。代表フレームではsparkleが1.8–3.5 kHz・0.26秒、tickが5.4 kHz・0.02秒と表示された。後半は実装例で、data-sound-hoverを付けたDocs/Examples/Changelog、data-sound-pressとdata-sound-releaseを付けたSaveボタン(押下時にSavedへ変化)、data-sound-toggleのスイッチを操作する。最後に「npm install tactile」と、HTML要素へdata-sound-*属性を付けるUsageコードを示し、既存UIへ宣言的に効果音を追加できることを実演している。

重要ポイント

  • Web Audioで短いUI音をライブ合成し、事前録音した音声ファイルを配布しない設計を示す。
  • Soundboardで10種類の音と波形・周波数帯・再生時間をその場で確認できる。
  • hover、press+release、toggleという操作状態ごとに音を割り当てられる。
  • HTMLではdata-sound-hover、data-sound-press、data-sound-release、data-sound-toggleを付ける簡潔なAPIになっている。
  • Save→Savedの視覚変化と効果音を組み合わせ、操作完了のフィードバックを補強する使い方が中心。

実務/開発への示唆

  • ボタン押下・完了・切替の音を短く一貫させると、視線を動かさずに状態変化を伝えやすい。
  • 宣言的なdata属性方式なら、既存コンポーネントへ小さく導入し、必要な箇所だけ段階的に試せる。
  • hover音は動画内にもあるdebounceのような抑制を入れ、ポインター移動で連打されないようにする。
  • ミュート設定、音量、prefers-reduced-motion相当のユーザー配慮、ブラウザーの自動再生制約を実装時に確認する。

注意点

  • 動画と投稿は短い製品予告/デモであり、公開時のAPI、対応ブラウザー、パッケージサイズ、ライセンス条件は別途確認が必要。
  • 「~2 kb」「0 deps」「音声ファイルなし」は画面上の製品説明で、この動画解析ではビルド成果物を独立計測していない。
  • UI効果音はアクセシビリティや周囲環境によって不要・不快になり得るため、無効化手段と視覚フィードバックを残すべき。
  • AAC音声はあるが明瞭なナレーションは確認できず、mlx_whisperの「Thank you.」は先頭語の確率が約0.038で映像内容とも合わないため誤認識扱いとした。
文字起こし・画面内テキスト

明瞭なナレーションなし。音声は画面操作に同期する短い合成UI効果音。mlx_whisperは1.62〜2.88秒を「Thank you.」と出力したが、Thankの単語確率が0.038と低く、UIサウンド実演という映像内容とも整合しないため採用していない。主な画面内テキスト(原文): 「Ten little sounds that make interfaces feel physical. Synthesized live with Web Audio — no files, no dependencies.」/「chime, sparkle, droplet, bloom, whisper, tick, press, release, toggle, success」/「npm install tactile」/「data-sound-hover」「data-sound-press」「data-sound-release」「data-sound-toggle」。

2

【保存版】デジタル庁が「行政手続𝟳𝟱,𝟬𝟬𝟬件を𝗠𝗖𝗣で自然言語分析する実装」を𝗚𝗶𝘁𝗛𝘂𝗯公開しました。…
投稿者
けいたろう@Manusフェロー (@keitaro_aigc)
投稿日時
2026-08-14 19:28 +07
元リンク
https://x.com/keitaro_aigc/status/2088241263560753363
自動生成記事
行政手続データを自然言語で分析するMCP設計――7.5万件規模で考える実務上の要点
本文
【保存版】デジタル庁が「行政手続𝟳𝟱,𝟬𝟬𝟬件を𝗠𝗖𝗣で自然言語分析する実装」を𝗚𝗶𝘁𝗛𝘂𝗯公開しました。設計思想が実務でそのまま使えるレベルで参考になります 社内データをAIに分析させていて、こんな壁にぶつかっていませんか?

3

I wanted voice dictation on macOS to feel instant and…
投稿者
Tornike Gomareli (@tornikegomareli)
投稿日時
2026-08-15 14:13 +07
元リンク
https://x.com/tornikegomareli/status/2088524464224919700
自動生成記事
音声入力の体感速度は「認識精度」だけでは決まらない——Talkifyの123msが示す設計論
日本語訳
私は、macOS での音声ディクテーションを瞬時かつネイティブに感じられるようにしたいと考え、リリースからテキストまでのレイテンシの中央値が 123 ミリ秒で、8.2 MB の macOS ディクテーション アプリである Talkify を構築しました。これは、superwisper、voiceink、wispr flow、macwisper に先立ってテストされた 5 つのアプリの中で最速でした。それはあなたのノッチに住んでいます
本文
I wanted voice dictation on macOS to feel instant and native, and I built Talkify an 8.2 MB macOS dictation app with 123 ms median release-to-text latency. It was the fastest of five apps tested ahead of superwhisper, voiceink, wispr flow and macwhisper. It lives in your notch
動画の詳しい解説

概要

macOSのノッチ常駐型音声入力アプリ「Talkify」の短い無音デモ。ホットキーでListening状態に入り、波形とノッチ風アニメーションを出しながら認識文を逐次表示する。

詳細解説

約14.85秒の製品ショーケースで、上段に赤橙、緑、虹色、青の4種類のノッチ風UIが並び、発話中を示すように縁の発光と粒子が動く。下段右には多色の音声波形、左には状態と認識文のパネルがある。開始時に「Listening (latched)」と表示され、その後「Instead of typing...」で始まる英文が数語ずつ伸びていくため、ホットキーで録音を開始し、別ウィンドウを開かずにリアルタイム文字起こしを受け取る体験を表現している。最終表示には「hold and key」「is transcript into text」「complicated workload」など不自然な語句も残る。動画自体には音声トラックがなく、投稿本文にある8.2 MB、中央値123 ms、他4製品より高速という比較値や実際の任意アプリへの貼り付け場面は映像内には表示されていない。

重要ポイント

  • 「Listening (latched)」の状態表示で、録音中かどうかをノッチ付近から確認できる。
  • 音声波形、発光、粒子アニメーションを同時に出し、マイク入力への即時フィードバックを与える。
  • 認識文が一括ではなく数語ずつ増え、ストリーミング文字起こしの挙動を示す。
  • 4種類の色・ノッチ表現を並べ、常駐UIの見た目のバリエーションを見せている。
  • 独立した大きな入力画面ではなく、ホットキーと小さなオーバーレイで完結させる設計が訴求点。

実務/開発への示唆

  • 音声入力では録音開始、入力中、確定処理中、完了を色・波形・テキストで明確に分けると誤操作を減らせる。
  • 採用前に自分のMac、使用言語、マイク、日常的な文章長で、キー解放から文字確定までの中央値と上位パーセンタイルを測る。
  • マイク権限、音声のローカル/クラウド処理、保存期間、機密テキストの扱いを確認してから業務データへ使う。
  • ホットキー競合、誤認識の修正手段、句読点、専門用語辞書、任意アプリへの貼り付け互換性も評価項目に含める。

注意点

  • 8.2 MB、123 ms中央値、5製品中最速という数値は投稿者の主張で、動画内に測定条件、試行回数、端末、比較表はなく独立検証できない。
  • MP4に音声トラックがないため、元の発話、認識精度、声と表示の時間差を直接照合できない。
  • 最終画面には「hold and key」「is transcript into text」「complicated workload」という不自然な認識結果が見え、精度が完全ではないことも示している。
  • 映像は黒背景のスタイライズされたショーケースで、インストール、設定、権限要求、他アプリの入力欄での実動作は確認できない。
文字起こし・画面内テキスト

音声トラックなし。画面内テキスト(原文・表示上の誤りをそのまま記載): 「Listening (latched)」/「Instead of typing, I can simply hold and key and start talking, everything I say is transcript into text as I speak. There is no window to open, no account to create and no complicated workload」。“and key”は“a/any key”、“is transcript”は“is transcribed”、“workload”は“workflow”を意図した可能性があるが、動画上では上記の文字列に見える。